18:10elvis@omarsar0Grok 4.6正式发布,官方称其具备前沿智能。相比Grok 4.5,性能显著提升,但价格维持不变。原推文对Grok 4.6能否媲美Fable 5的质量表示不确定。目前官方未公布具体基准测试数据。AI模型Grok 4.6Grok 4.5SpaceXAI推荐理由:哎,Grok 4.6出来了,说比4.5强不少,价格没变。到底能不能打Fable 5还不清楚,先观望下。原文稍后读已读值得跟进有用关注 Grok 4.6
18:10向阳乔木@vista8腾讯旗下有混元和WeLM两个大语言模型。WeLM由微信团队构建,是一个大语言模型家族。该模型以资源效率为核心设计目标。腾讯官方在X平台通过微信账号介绍了WeLM。AI模型腾讯微信WeLM推荐理由:微信团队自己做了个WeLM大模型,主打资源效率,跟混元是腾讯的两个大模型,来了解下吧。原文稍后读已读值得跟进有用关注 腾讯
18:10Mustafa Suleyman@mustafasuleyman微软AI负责人Mustafa Suleyman在X上发布推文,公开了MAI Thinking的试用链接aka.ms/mai-thinking-1。该推文目前获得2条回复、1次转发和12个赞,但已有2395次查看。从命名看,MAI Thinking可能是微软面向推理场景推出的模型。用户可直接通过链接体验,无需等待排队。具体能力和基准成绩尚未公布。AI模型MAI ThinkingMicrosoftMustafa Suleyman推荐理由:微软AI老大亲自甩了个体验链接,MAI Thinking听着像推理模型,想抢先试的直接点。原文稍后读已读值得跟进有用关注 MAI Thinking
18:10The Rundown AI@therundownaiSpaceXAI发布了Grok 4.6。该模型在智能、编码和智能体任务等基准上接近或达到Fable和5.6-Sol的水平。定价明显低于同类前沿模型。AI模型Grok 4.6SpaceXAIFable推荐理由:Grok 4.6跑分追上Fable和5.6-Sol,价格还便宜不少,可以关注下。原文稍后读已读值得跟进有用关注 Grok 4.6
18:10Fireworks AI@FireworksAI_HQ精选Qwen3.8-2.4T-A95B 已在 Fireworks 平台上线,提供 Day-0 支持。该模型采用 2.4T 参数 MoE 架构,专为自主智能体、重度编码和大上下文窗口设计。Fireworks 表示它适合编码和智能体任务,开发者现在即可开始使用。AI模型Qwen3.8-2.4T-A95BFireworks智能体推荐理由:Fireworks 上线了 Qwen3.8-2.4T-A95B,2.4T 参数 MoE,主打智能体和写代码,有 Day-0 支持,直接就能用。原文稍后读已读值得跟进有用关注 Qwen3.8-2.4T-A95B
18:10向阳乔木@vista8DeepSeek V4 Pro在未开启思考模式下,按提示词“鹈鹕骑自行车svg,撞上大象,循环播放”生成动画。测试动画中鹈鹕骑自行车撞上大象并循环播放,说明模型能理解多物体交互和循环指令。该模型名为DeepSeek-V4-Pro-0813,百万tokens输入(缓存未命中)定价3元,输出定价6元,均高于DeepSeek Flash的1元和2元。其并发限制为500,低于DeepSeek Flash的2500。AI模型DeepSeekDeepSeek V4 Pro视频生成9 个信源在谈事件专题推荐理由:DeepSeek V4 Pro不开思考模式就能按提示词生成鹈鹕撞大象的SVG动画,效果挺逗,价格和限流也都摸清了,来看看。原文稍后读已读值得跟进有用关注 DeepSeek
18:09Sualeh Asif@sualehasif996SpaceXAI 发布 Grok 4.6,定位前沿智能水平的日常驱动模型。官方称其相较 Grok 4.5 有显著进步,且保持相同定价。目前未公布具体基准成绩,但强调这是值得日常使用的升级版本。AI模型GrokSpaceXAI推理模型推荐理由:Grok 4.6 来了,官方说比 4.5 强不少还同价,日常用着应该更顺手。原文稍后读已读值得跟进有用关注 Grok
18:09官方一手歸藏(guizang.ai)@op7418DeepSeek V4 Pro 正式版 0813 发布。从流传的测试成绩来看,0813 的性能表现相当突出。目前官方尚未公布 0813 的完整基准数据。AI模型DeepSeekDeepSeek V4 Pro模型发布9 个信源在谈事件专题推荐理由:DeepSeek V4 Pro 0813 正式版来了,听说测试成绩很炸,想蹲实测的可以先围观。原文稍后读已读值得跟进有用关注 DeepSeek
18:09Windsurf@windsurf_ai精选Cognition 宣布 Grok 4.6 登陆 Devin Desktop 和 Devin CLI。相比 Grok 4.5 提升明显,性能超过 GPT-5.6 Sol。目前表现仅次于 Opus 5 和 Fable 5。AI模型Grok 4.6DevinGPT-5.6 Sol推荐理由:Grok 4.6 已经能在 Devin 里用了,Desktop 和 CLI 都支持,比 GPT-5.6 Sol 强,仅次于 Opus 5 和 Fable 5,想尝鲜的赶紧试试。原文稍后读已读值得跟进有用关注 Grok 4.6
18:08官方账号Cohere@cohere精选Cohere 今日推出 North Micro Vision,这是其最小的视觉语言模型,专为复杂文档理解设计。该模型以 Apache 2.0 许可证开源,权重已上传至 Hugging Face。相比 Cohere 其他模型,North Micro Vision 更轻量,适合在资源受限场景下处理视觉任务。开发者可直接从 Hugging Face 下载权重进行部署。AI模型CohereNorth Micro Vision视觉语言模型推荐理由:Cohere 出了个超小的视觉模型 North Micro Vision,专门用来读懂复杂文档,而且开源了,直接去 Hugging Face 就能下载权重。原文稍后读已读值得跟进有用关注 Cohere
18:07官方账号xAI@xai75°Grok 4.6 今日上线,已同步开放至 Grok Build、Cursor、Grok Bot 和 API。用户在 Cursor 与 Grok Build 中可在首周享受 2 倍用量。官方公告详见 x.ai/news/grok-4-6。AI模型Grok 4.6CursorGrok Build8 个信源在谈事件专题推荐理由:官方发布了 Grok 4.6,Cursor 和 Grok Build 里首周用量翻倍,想尝鲜的赶紧去试试。原文稍后读已读值得跟进有用关注 Grok 4.6
18:06官方账号Simon Willison’s Weblog(博客/媒体)80°Meta 发布开源模型 Muse Glimmer,参数规模 30B,采用 Apache 2.0 许可证。该模型在 DeepSearch QA、MCP-Atlas、τ-Bench 和 SWE-Bench 等基准上取得较高成功率,可完成端到端智能体任务。Muse Glimmer 支持可靠工具调用,并在复杂工作流中维持多步推理。作者用 LM Studio 的 18.16GB 量化版本进行了本地测试,还搭配 llm-coding-agent 插件试用。Muse Glimmer 还是视觉模型,能生成详细图片描述。AI模型Muse GlimmerMeta开源模型推荐理由:Meta 出了个 30B 开源模型 Muse Glimmer,Apache 2.0 协议,能自主调工具、多步推理,本地跑挺不错。原文稍后读已读值得跟进有用关注 Muse Glimmer
18:06官方账号NVIDIA AI@NVIDIAAI精选71°Harvey联合Trajectory Labs对NVIDIA的Nemotron 3.5 Lightning进行后训练,在Legal Agent Bench上得分从0%升至8.3%。该成绩超过了Opus 4.6和更大的后训练版Nemotron 3 Ultra。后训练覆盖九个执业领域,未出现能力退化。平均输出长度从90k tokens降至37k tokens,每token奖励提升2.4倍。AI模型Nemotron 3.5 LightningNVIDIAHarvey10 个信源在谈事件专题推荐理由:Harvey把Nemotron 3.5 Lightning后训练了一把,法律Agent评测从0冲到8.3%,比Opus 4.6还强,输出也从90k缩到37k,省Token。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
18:06IT之家(博客/媒体)DeepSeek 发布 DeepSeek-V4-Pro-0813 正式版,API 同步上线更新。新版本增强了智能体能力,支持 Responses API 和 Codex 接入。在多项测试中,DeepSeek V4 Pro 正式版性能接近 Fable 5,相比预览版大幅提升。AI模型DeepSeek V4 Pro智能体Responses API9 个信源在谈事件专题推荐理由:DeepSeek 又发新版本了,V4 Pro 正式版 API 已上线,智能体能力更强,还支持 Codex,性能直逼 Fable 5。原文稍后读已读值得跟进有用关注 DeepSeek V4 Pro
18:05小互@imxiaohuLightricks发布开源视频模型LTX-2.5。生成10秒视频只需6.8秒。支持文本、图片、视频三种输入。画面和声音在同一模型中联合生成。支持原生多镜头,跨镜头保持人物、场景和声音一致。年营收1000万美元以下可免费商用。AI模型LTX-2.5Lightricks视频生成推荐理由:Lightricks把LTX-2.5开源了,6.8秒就能出10秒带声视频,还支持多镜头,小团队免费商用,赶紧试试。原文稍后读已读值得跟进有用关注 LTX-2.5
18:05Cognition@cognition_labsGrok 4.6 现已集成到 Devin 中。相比 Grok 4.5,它在多项基准上表现更好。成绩超过 GPT-5.6 Sol,排名仅次于 Opus 5 和 Fable 5。AI模型GrokDevinGPT-5.6推荐理由:Grok 4.6 上 Devin 了,跑分超过 GPT-5.6 Sol,只差 Opus 5 和 Fable 5,想试试的可以关注。原文稍后读已读值得跟进有用关注 Grok
18:04官方账号NVIDIA AI@NVIDIAAI精选NVIDIA Nemotron 3.5 Lightning 已在 Together AI 平台上线。该模型被定位为同类中速度最快的开源模型。它专为常驻型智能体设计,能快速完成高吞吐量的专业工作。AI模型NVIDIANemotron 3.5 LightningTogether AI10 个信源在谈事件专题推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 开源模型上线 Together AI,跑得最快,适合需要高强度处理任务的智能体。原文稍后读已读值得跟进有用关注 NVIDIA
18:04官方账号NVIDIA AI@NVIDIAAI精选Reasonable 团队用 4B token 的合成 Verus 数据微调了 NVIDIA 最新开源模型 Nemotron 3.5 Lightning(30B)。微调后的模型在单次尝试通过率上超越了一个规模约 50 倍于它的模型,pass@3 则几乎持平。它的 token 生成速度也快于测试过的所有同尺寸开源模型。配套博客还分析了各模型在形式化证明中的失败方式、作弊行为,以及微调带来的影响。AI模型NemotronNVIDIAVerus10 个信源在谈事件专题推荐理由:Reasonable微调了NVIDIA的30B开源模型,形式化证明通过率胜过50倍大的模型,生成还更快。博客还拆解了模型怎么作弊。原文稍后读已读值得跟进有用关注 Nemotron
18:04Poe@poe_platformGrok 4.6 已在 Poe 平台正式上线。该模型拥有 500K token 的上下文窗口。它专为长时间运行的智能体、编程和知识工作设计。用户可通过 poe.com/Grok-4.6 直接试用。AI模型Grok 4.6Poe智能体推荐理由:Grok 4.6 上架 Poe 了,上下文窗口有 500K,跑长任务智能体和写代码都合适,想试直接去 Poe 点开就能用。原文稍后读已读值得跟进有用关注 Grok 4.6
18:04官方账号NVIDIA AI@NVIDIAAIFastino Labs与NVIDIA合作发布两款开源模型Fastino-Nemotron-3.5-Lightning-Finance和Fastino-Nemotron-3.5-Lightning-Healthcare,均基于Nemotron 3.5 Lightning微调。金融模型在FinQA基准上执行准确率从15.86%提升至59.23%,增幅43.37个百分点;在BizFinBench上从49.65%升至57.46%。医疗模型在HealthAdminBench上从25.67%升至29.95%,在MedCalc-Bench上从49.09%升至54.18%。两款模型均以Apache 2.0许可发布在Hugging Face上。同时,Fastino还发布了自动微调工具Fastino Fine-Tuning Agent的私人预览版。AI模型FastinoNVIDIANemotron 3.510 个信源在谈事件专题推荐理由:Fastino跟NVIDIA合作,用自动微调Agent搞出了金融和医疗两个开源模型,FinQA涨了43个点,Apache 2.0随便用。原文稍后读已读值得跟进有用关注 Fastino
18:03官方账号Runway ML@runwaymlRunway 宣布 Grok Imagine Image 2.0 上线其平台。该模型是 Runway 当前提供的最新图像生成模型,与平台上其他图像和视频模型并列。用户现在即可通过 Runway 官方链接试用 Grok Imagine Image 2.0。AI模型Grok Imagine Image 2.0Runway图像生成推荐理由:Grok Imagine Image 2.0 现在能在 Runway 直接用了,和顶级图像视频模型放一块,试图像生成又多了个选择。原文稍后读已读值得跟进有用关注 Grok Imagine Image 2.0
18:02官方账号Simon Willison’s Weblog(博客/媒体)DeepSeek V4 Pro 0813 已通过 OpenRouter 以 API 形式上线,官方没有专门公告页。新模型提供低、中、高三档推理等级,作者测试同一提示词时三档输出差异明显。截至发稿,DeepSeek 未确认是否开放权重,但 4 月的 V4 Pro 和 7 月的 V4 Flash 0731 均已开源,因此概率较高。基准数据先出现在官方微信群,被转载到 Reddit 后因“低质量”删除,现以 ASCII 表格形式流传于 Hacker News。AI模型DeepSeekV4 Pro 0813OpenRouter推荐理由:DeepSeek 新模型只走 API,OpenRouter 上能直接试。三档推理等级画出来的鹈鹕都不一样,想玩可以拿同一道题对比看看。原文稍后读已读值得跟进有用关注 DeepSeek
18:02爱范儿@莫崇宇DeepSeek V4 Pro 正式版发布。该模型在多项核心基准测试中接近 Fable 5 的水平。目前官方尚未公布具体评测数字。更多性能细节有待后续信息披露。AI模型DeepSeekDeepSeek V4 ProFable 510 个信源在谈事件专题推荐理由:DeepSeek 的新旗舰 V4 Pro 上线了,多项测试快赶上 Fable 5,关心模型性能的可以留意。原文稍后读已读值得跟进有用关注 DeepSeek
18:02官方账号NVIDIA AI@NVIDIAAI72°NVIDIA今日推出Nemotron 3.5 Lightning模型,并已上线Tinker平台。该模型仅激活3B参数,针对吞吐速度进行优化。它面向对延迟和成本敏感的应用场景,适合高频实时推理任务。用户可在Tinker上直接体验该模型。AI模型NemotronNVIDIATinker10 个信源在谈事件专题推荐理由:NVIDIA出了个轻量级新模型,3B参数跑得快又便宜,延迟敏感场景用得上,Tinker上现在就能玩。原文稍后读已读值得跟进有用关注 Nemotron
18:02Genspark@genspark_ai71°Grok 4.6已在Genspark平台上线,用户可在AI Chat、Code Agent和Genspark Claw中直接选用。该模型由xAI推出,专为长时间运行的智能体和编码任务设计。相比Grok 4.5,Grok 4.6在保持相同定价的同时实现了显著性能提升,属于前沿智能水平。用户只需在模型选择器中切换即可使用。AI模型Grok 4.6GensparkxAI1 个信源在谈事件专题推荐理由:Genspark上线了xAI的新模型Grok 4.6,专为长任务智能体和写代码优化,价格不变但比4.5强不少,做Agent开发可以试试。原文稍后读已读值得跟进有用关注 Grok 4.6
18:01官方账号arXiv cs.AI@Yan Deng, Fei XuDreamFly 是基于 Dream-VLA 的扩散式航空视觉语言导航框架。它引入因果对齐历史记忆,仅使用当前决策前的观测增强视觉表征,避免未来信息泄漏。导航采用 receding-horizon 扩散规划,预测 K 步动作块但只执行第一步,实现 plan-K、execute-one 策略。LiteStop 在初始全掩码状态直接从动作 logits 估计停止概率,将终止判断与动作生成解耦。在 OpenFly 基准上,DreamFly 在 test-seen/test-unseen 上分别取得 32.04%/29.46% SR 和 28.22%/23.54% SPL,并达到最低导航误差。AI模型DreamFlyDream-VLAOpenFly推荐理由:做航空视觉语言导航的看这个:DreamFly在OpenFly上SR和SPL都超过现有方法,导航误差最低,还能判断何时到达。原文稍后读已读值得跟进有用关注 DreamFly
18:00shao__meng@shao__meng81°Grok 4.6 已通过 Grok Build、Cursor、Grok Bot 和 API 开放。官方对比 Grok 4.5 High、GPT-5.6 Sol Max、Fable 5 Max,Artificial Analysis 综合指数 61,与 GPT-5.6 Sol Max 持平,距 Fable 5 Max 的 62 差 1 分。长程 Agent 任务提升明显:DeepSWE 从 54% 升至 65.9%,APEX-Agents 从 47.1% 升至 57.5%,Terminal-Bench 从 15.7% 升至 26%。上下文窗口 50 万 token,支持文本与图像输入、文本输出,函数调用和结构化输出。相对 4.5 的 10 项评测全升,但 APEX-SWE 仅增加 2.8 个百分点,编码能力提升不均。AI模型Grok 4.6GrokCursor9 个信源在谈事件专题推荐理由:Grok 4.6 上线,长程 Agent 强化,指数追平 GPT-5.6 Sol Max,试试?原文稍后读已读值得跟进有用关注 Grok 4.6
17:59量子位@JayDeepSeek V4 Pro正式版已经发布。它在多项能力上对标Fable 5。开发者现在调用V4 Pro,能直接用上完全体。AI模型DeepSeekV4 ProFable 56 个信源在谈事件专题推荐理由:DeepSeek的V4 Pro正式版出来了,好几项直接对标Fable 5,现在开发者调用就能用上完全体,想试的赶紧上手。原文稍后读已读值得跟进有用关注 DeepSeek
17:59AI Will@FinanceYF572°xAI 发布 Grok 4.6,已上线 Cursor、Grok Build、API、OpenRouter、Vercel 和 Cloudflare 六个平台。普通版价格维持不变,Fast 版本价格翻倍。Cursor 与 Grok Build 首周提供 2 倍包含用量,现已开放试用。AI模型Grok 4.6CursorOpenRouter8 个信源在谈事件专题推荐理由:Grok 4.6 一口气上了 Cursor 和 API 等多个平台,普通版没涨价,Fast 版翻倍,首周还有双倍用量可薅。原文稍后读已读值得跟进有用关注 Grok 4.6
17:58IT之家(博客/媒体)72°Dyna Robotics 发布机器人基础模型 DYNA-2,预训练数据超过 100 万小时第一人称人类视频,相当于 170 年人类经验。该模型被称为世界动作模型,通过预测下一帧画面和动作来学习空间关系与接触物理。在 15 项基准任务中,随着预训练数据增加,任务成功率从约 20% 提升至 80% 到 90%。一次客户部署中,DYNA-2 质量通过率达 87%,而上一代 Dyna-1 为 46%。AI模型DYNA-2Dyna Robotics机器人模型推荐理由:Dyna Robotics 拿 170 年人类视频训了个机器人模型,成功率能到九成,比上代翻倍,搞具身智能的值得看看。原文稍后读已读值得跟进有用关注 DYNA-2
17:57shao__meng@shao__mengDeepSeek 静默发布新模型 V4-Pro-0813,官方 X 账号未官宣。Cline 团队实测其在 Terminal-Bench 2.1 上得分 87.9,仅比 Claude Fable 5 低 0.1 分。该模型价格约为 Fable 5 的 1/57,参数规模 1.6T,激活参数 49B,上下文窗口 1M。模型已上线 ClinePass,Cline 称其为当前市场性价比最高的模型。AI模型DeepSeek-V4-Pro-0813Claude Fable 5Terminal-Bench1 个信源在谈事件专题推荐理由:DeepSeek 新模型跑分只比 Claude Fable 5 低 0.1,价格却便宜 57 倍,Cline 用户现在就能用,高性价比首选。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Pro-0813
17:56爱范儿@张子豪国产具身智能机器人只用了两只标准夹爪,就实现了更低成本的操作方案。该方案在性能上反超了美国机器人公司 Figure AI。这一成果被业内称为具身智能的「DeepSeek 时刻」。AI模型Figure AIDeepSeek具身智能推荐理由:国产机器人只用两只夹爪就把成本打下来,性能还赢了 Figure AI,看看他们怎么做到的。原文稍后读已读值得跟进有用关注 Figure AI
17:56IT之家(博客/媒体)78°谷歌DeepMind发布大规模多语言手语转文本模型SL2T,Pixel 11系列手机上的Gboard和Live Transcribe应用率先支持美国手语输入。该模型在超过50种手语的10万小时数据上训练,能识别身体多部位同步运动。测试显示,美国手语输入比英语打字更快更自然。模型将手语转为姿势特征点,在设备端完成处理,无需上传原始视频,保护用户隐私。AI模型手语转文本Google DeepMindPixel 114 个信源在谈事件专题推荐理由:谷歌DeepMind把手语转文字做进了Pixel 11,美国手语直接变成文本,比打字还快,而且数据在本地处理,隐私有保障。原文稍后读已读值得跟进有用关注 手语转文本
17:56IT之家(博客/媒体)韩国 Upstage 发布商用大模型 Solar Pro 4,上下文窗口 512K,输出长度 128K token。定价方面,输入每百万 tokens 0.3 美元,缓存读取 0.06 美元,输出 1.2 美元。该模型在 Terminal-Bench v2.1 得分 57,τ³-Banking 得分 23,AA-LCR 得分 71。在 Agent Arena 榜单排名第 44,与 MiniMax M2.7 同级,也是首个登上该榜单的韩国实验室模型。AI模型Solar Pro 4UpstageAgent Arena推荐理由:Upstage 发了主打智能体任务的 Solar Pro 4,定价不高,Agent Arena 排名和 MiniMax M2.7 同级,适合处理长文档和多轮工具调用。原文稍后读已读值得跟进有用关注 Solar Pro 4
17:55Geek@geekbb博主geekbb在X上表示,日常使用中已无法区分DeepSeek-V4-Pro-0813和DeepSeek-V4-Flash-0731的表现。他翻看了X上其他用户的评价,认为Pro相比Flash没有明显优势。他还提到,Pro-0813缺少Flash-0731刚发布时的惊艳感。AI模型DeepSeekDeepSeek-V4-Pro-0813DeepSeek-V4-Flash-07318 个信源在谈事件专题推荐理由:有博主说DeepSeek新Pro和Flash用起来没啥差别,还嫌Pro没惊喜,可以看看社区咋说。原文稍后读已读值得跟进有用关注 DeepSeek
17:55官方账号NVIDIA AI@NVIDIAAI72°英伟达宣布推出开源权重模型 Nemotron 3.5 Lightning。Deep Cogito 表示该模型继续推动开放模型生态,并宣布加入英伟达后训练合作伙伴生态。此次合作聚焦开源权重与可定制模型,旨在让前沿智能更易获取。AI模型Nemotron 3.5 LightningNVIDIADeepCogito10 个信源在谈事件专题推荐理由:英伟达出了开源版 Nemotron 3.5 Lightning,Deep Cogito 马上加入了它的后训练伙伴计划。想搞开源模型定制化的,这条有信息量。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:55官方账号NVIDIA AI@NVIDIAAIUniphore实测NVIDIA Nemotron 3.5 Lightning在企业级智能体工作负载中的表现。与参数规模相近的Gemma 4 31B IT相比,Nemotron 3.5 Lightning吞吐量提升5倍,准确率也有明显增长。Uniphore已将其纳入Business AI Cloud高流量路径的评估范围。AI模型Nemotron 3.5 LightningNVIDIAGemma 410 个信源在谈事件专题推荐理由:NVIDIA新模型在企业任务上直接碾压Gemma 4,吞吐量翻5倍,跑真实负载的数据很硬核。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:55爱范儿@彭海星DeepSeek V4 Pro正式版发布,实测性能直逼Fable 5。DeepSeek V4 Pro在AI Agent方向上发力,还藏了一个大招。爱范儿实测显示,DeepSeek V4 Pro在智能体任务中表现抢眼。AI模型DeepSeek V4 ProDeepSeekFable 510 个信源在谈事件专题推荐理由:DeepSeek V4 Pro正式版来了,实测跟Fable 5有得一拼,还藏了个大招,想玩智能体的朋友可以看看。原文稍后读已读值得跟进有用关注 DeepSeek V4 Pro
17:54AI Will@FinanceYF575°Grok 4.6正式发布,延续4.5的定价策略。新版本在Agent能力和编程任务上有所提升,并能更长时间处理复杂任务。在AA Intelligence Index基准上,Grok 4.6得分追平GPT-5.6 Sol。API价格为每百万输入Token 2美元,输出Token 6美元。AI模型GrokGPT-5.6 Sol智能体推荐理由:Grok 4.6发布,价格不变,Agent和编程更强,AA Intelligence Index追平GPT-5.6 Sol,API输入2美元/百万Token。原文稍后读已读值得跟进有用关注 Grok
17:54官方账号Simon Willison’s Weblog(博客/媒体)Simon Willison公开了Claude Opus 5的系统提示词全文。提示词要求Claude准确说明2026年6月12日Anthropic因美国商务部出口管制暂停Claude Fable 5和Mythos 5,并于7月1日恢复访问。系统提示词指示Claude只提供事实、不分享个人观点,并引导用户查阅Anthropic官方声明。由于这些事件发生在Claude训练数据截止之后,提示词专门补充了这段背景信息。AI模型Claude Opus 5Anthropic系统提示词10 个信源在谈事件专题推荐理由:Simon Willison贴出Claude Opus 5系统提示词,看Anthropic怎么让模型谈出口管制,还给了官方声明链接。原文稍后读已读值得跟进有用关注 Claude Opus 5