03:46Guillermo Rauch@rauchgVercel将Meta的Muse Spark 1.1多模态推理模型集成到AI Gateway中。该模型专为智能体任务设计,兼具高速推理和高智能水平。同时,Grok 4.5和GLM 5.2可能在本周发布,预计将显著分走token市场份额。当前是使用AI Gateway的好时机。AI模型Meta Spark 1.1Grok 4.5GLM 5.2推荐理由:Vercel把Meta的Muse Spark 1.1接入AI Gateway,这是个专门干智能体任务的又快又聪明的多模态模型,你值得试试。原文稍后读已读值得跟进有用关注 Meta Spark 1.1
03:36OpenRouter@OpenRouterAIOpenRouter 已上线 GPT-5.6 模型,提供三个版本:旗舰版 Sol、均衡版 Terra 和快速低成本版 Luna。早期测试显示,GPT-5.6 的 token 效率更高,能降低使用成本并加快任务完成速度。AA 的测试结果也验证了这一点。AI模型GPT-5.6OpenRouterSol推荐理由:OpenRouter 上新了 GPT-5.6,三个版本可选,Sol 旗舰、Luna 便宜,实测更省 token 更快。原文稍后读已读值得跟进有用关注 GPT-5.6
03:33宝玉@dotey83°OpenAI 发布了 GPT-5.6 系列模型(Sol, Terra, Luna),已开始在 ChatGPT、Codex 和 API 中推出。此次合并将 ChatGPT 和 Codex 统一为一个名称。新模型家族包含三个变体,针对不同场景优化。AI模型GPT-5.6ChatGPTCodex10 个信源在谈事件专题推荐理由:OpenAI 把 ChatGPT 和 Codex 合并了,还出了 GPT-5.6 三个新模型,Sol、Terra、Luna 各有侧重,快去试试。原文稍后读已读值得跟进有用关注 GPT-5.6
03:29lmarena.ai@lmarena_aiOpenAI 在 arena.ai 上开放了 GPT-5.6 的 Battle Mode 和 Agent Mode 测试入口。用户可以直接体验模型在对抗场景和智能体任务中的表现。官方表示后续会公布评测分数。AI模型GPT-5.6OpenAI智能体10 个信源在谈事件专题推荐理由:想试试 GPT-5.6 的新模式吗?现在就能去 arena.ai 玩 Battle Mode 和 Agent Mode,体验还在热乎的测试版。原文稍后读已读值得跟进有用关注 GPT-5.6
03:22lmarena.ai@lmarena_ai93°OpenAI 推出的 GPT-5.6 系列包含 Sol、Terra 和 Luna 三个模型,已登陆 Agent Arena、ChatGPT、Codex 和 API。Agent Arena 在数百万真实世界长程智能体任务上评测模型,支持网页搜索、文件系统和终端工具。Leaderboard 采用因果追踪方法衡量模型输出相对于平均模型的效果。Sol 还额外支持搜索功能。用户投票将驱动排名更新。AI模型GPT-5.6SolTerra10 个信源在谈事件专题推荐理由:OpenAI 把 GPT-5.6 三兄弟 Sol、Terra 和 Luna 放到 Agent Arena 里了,能跑真实世界智能体任务,还能用网络和终端工具,去投个票就能影响排行榜。原文稍后读已读值得跟进有用关注 GPT-5.6
03:19官方一手@OpenAIDevs@OpenAIDevs精选Vercel 软件主管 Andrew Qu 使用 OpenAI 的 GPT-5.6 和 Codex 解除了内部数据科学代理在先前模型卡住的任务。该代理此前在处理某些复杂工作时因模型能力不足而停滞。GPT-5.6 的推理能力使其能够继续推进这些任务。AI模型GPT-5.6CodexVercel10 个信源在谈事件专题推荐理由:Vercel 用 GPT-5.6 让数据科学代理更聪明,之前卡住的任务现在能搞定了。原文稍后读已读值得跟进有用关注 GPT-5.6
03:15coderabbitai@coderabbitaiCodeRabbit测试了GPT-5.6的两个变体Sol和Terra。Sol在遵循长任务、保持仓库上下文和代码审查基准中展现了更好的召回。Terra作为更便宜的选项适用于小范围工作。报告对比了Fable 5和Opus 4.8的定价与性能。AI模型GPT-5.6CodeRabbit编码代理推荐理由:CodeRabbit实测了GPT-5.6的两个版本,Sol在代码审查中召回更强,Terra则更省钱。对比Fable 5和Opus 4.8,想升级编码工具可以看。原文稍后读已读值得跟进有用关注 GPT-5.6
03:14AI Engineer@aiDotEngineerOpenAI 推出了 GPT-5.6 模型,包含 Sol、Terra 和 Luna 三个版本。@romainhuet、@embirico 和 @steipete 在视频中称这是 AI 工程黄金时代的开端。该推文获得 15 次点赞和 4067 次浏览。具体性能细节请查看视频。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 一口气发了三个版本,还有行业大佬站台,快去看视频了解吧!原文稍后读已读值得跟进有用关注 GPT-5.6
03:09The Rundown AI@therundownai91°OpenAI 发布了三个 GPT-5.6 模型:Sol、Terra 和 Luna。Sol 在 Artificial Analysis Intelligence Index 上略低于 Anthropic 的 Fable,但在多个 agentic coding 基准上超越 Fable。模型定价与 GPT-5.5 相同,远低于 Fable 的成本。同时推出了由 5.6 Sol 驱动的 agent ChatGPT Work,可跨应用和文件工作并内置 Codex。还发布了新 ChatGPT Desktop App(集成 Codex 和浏览器)以及 Hosted Sites 公开测试版。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI 一口气发了三个 GPT-5.6 模型,编程更强的 Sol 比 Fable 便宜,还出了个能跨应用干活的 agent 和桌面应用,开发者快去体验。原文稍后读已读值得跟进有用关注 GPT-5.6
03:07官方一手@OpenAIDevs@OpenAIDevs91°OpenAI 发布 GPT-5.6,分为三个模型层级:Sol 用于长周期编程与智能体任务,Terra 平衡日常任务性能与成本,Luna 专注高速高频任务。在知识工作评估中,GPT-5.6 Terra 超越 GPT-5.5 且成本更低。GPT-5.6 Luna 接近 GPT-5.5 峰值性能,但 API 成本不到一半。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI 给 GPT-5.6 分了三个档,Sol 专攻复杂编程和智能体任务,Terra 比上一代更强更便宜,Luna 跑得快还省一半钱。原文稍后读已读值得跟进有用关注 GPT-5.6
03:06官方一手@OpenAIDevs@OpenAIDevsOpenAI Devs展示了工程师Sam Kronick使用GPT-5.6从自然语言规范端到端构建一个完整服务的案例。该服务完全基于口语描述生成,无需手写代码。此举展示了GPT-5.6在代码生成方面的能力。具体实现流程未公开,但演示了从语音到可运行服务的完整链路。AI模型GPT-5.6OpenAI编程助手10 个信源在谈事件专题推荐理由:看OpenAI工程师怎么用GPT-5.6,光靠嘴巴说就把整个服务写出来了,比传统编程快太多。原文稍后读已读值得跟进有用关注 GPT-5.6
03:03岚叔@lufzzlizMeta 今天发布了新模型 Muse Spark 1.1。该模型在定价和多项基准跑分上表现突出,引发社区讨论。用户可在 OpenRouter 上测试该模型。AI模型MetaMuse Spark 1.1模型发布推荐理由:Meta 新出的 Muse Spark 1.1,价格实惠跑分又高,想试试性价比模型可以关注。原文稍后读已读值得跟进有用关注 Meta
02:58GitHub@github86°OpenAI 发布 GPT-5.6 系列,包含三个变体:Sol、Terra 和 Luna。Sol 拥有最高推理上限,适合复杂代码库推理和长时间代理任务。Terra 是平衡默认选项,适合日常交互和代理编码。Luna 是轻量低成本变体,适合快速小任务。该系列已在 GitHub Copilot 中逐步推出。AI模型GPT-5.6OpenAIGitHub Copilot10 个信源在谈事件专题推荐理由:GitHub Copilot 现在能用 GPT-5.6 了,分三个版本:Sol 专治复杂推理,Terra 日常够用,Luna 省成本又好使。原文稍后读已读值得跟进有用关注 GPT-5.6
02:57宝玉@doteyMeta今日发布Muse Spark 1.1模型,主打智能体与编程能力。该模型定价较低,通过Meta Model API和Meta AI提供服务。Mark Zuckerberg在X上宣布了这一消息。AI模型Muse Spark 1.1Meta智能体推荐理由:Meta出了个便宜的编程和智能体模型Muse Spark 1.1,试试API或Meta AI呗。原文稍后读已读值得跟进有用关注 Muse Spark 1.1
02:52官方一手@OpenAIDevs@OpenAIDevsOpenAI在API中推出GPT-5.6系列,包含三个模型。旗舰模型Sol在编程、知识工作、网络安全和科学领域领先。Terra以较低成本提供与GPT-5.5相当的性能。Luna是最快、最便宜的模型,适合高流量任务。AI模型GPT-5.6SolTerra10 个信源在谈事件专题推荐理由:OpenAI刚发了GPT-5.6的三个新模型:Sol旗舰强在编程和科学,Terra性价比高,Luna又快又便宜。原文稍后读已读值得跟进有用关注 GPT-5.6
02:49官方账号OpenAI@OpenAI91°OpenAI发布GPT-5.6 Sol模型,在编码、知识工作、网络安全和科学领域实现最先进性能。该模型使用更少token并降低计算成本。相比前代,它在多个基准测试中表现更优,但具体数字未公开。AI模型GPT-5.6 SolOpenAI编程助手10 个信源在谈事件专题推荐理由:OpenAI新出的GPT-5.6 Sol能在编程、科研等领域做到顶尖,还省token省成本,想尝鲜的可以试试。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
02:46Lovable@lovable_dev精选Lovable 宣布集成 OpenAI 的 GPT-5.6 模型。相比此前模型,GPT-5.6 在构建生产级应用的长复杂工作流中,步骤减少约 25%,工具调用次数降低 35% 至 48%。项目成功率有所提升,卡住运行的几率降低 15%。AI模型GPT-5.6Lovable编程助手10 个信源在谈事件专题推荐理由:Lovable 上了 GPT-5.6,跑复杂项目更快了,步数省四分之一,工具调用少四成,卡壳也少了,效率党可以试试。原文稍后读已读值得跟进有用关注 GPT-5.6
02:35官方账号OpenAI@OpenAIOpenAI宣布ChatGPT Work由GPT-5.6模型驱动。GPT-5.6使ChatGPT在复杂任务推理上达到最先进水平。它还能根据用户模板、参考文件和偏好风格自动生成材料。用户只需描述期望结果,无需逐步说明步骤。AI模型GPT-5.6OpenAIChatGPT Work10 个信源在谈事件专题推荐理由:OpenAI给ChatGPT Work换上了GPT-5.6,推理和按模板生成都变强了,不用一步步教它怎么做。原文稍后读已读值得跟进有用关注 GPT-5.6
02:31Aravind Srinivas@AravSrinivas精选Arav Srinivas宣布将在美国的NVIDIA B200s上托管一个模型,并计划对Nemotron 3 Ultra进行后训练。后训练旨在提升该模型的性能,使其与美国开源模型具备同等能力。更多细节即将公布。AI模型Nemotron 3 UltraB200sNVIDIA10 个信源在谈事件专题推荐理由:Arav Srinivas说要在美国用B200s跑Nemotron 3 Ultra后训练,让美国开源模型追上对手进度。原文稍后读已读值得跟进有用关注 Nemotron 3 Ultra
02:23官方一手@OpenAIDevs@OpenAIDevs82°OpenAI 宣布 GPT-5.6 是其当前在网络安全和生物相关任务上能力最强的模型。部分 API 调用可能被阻止或暂停,以便安全系统在双用途领域(如网络安全)进行额外审查,因为防御性和攻击性活动初看相似。OpenAI 表示将根据实际使用持续调整安全措施。该发布强调了模型在敏感领域的应用风险与安全平衡。AI模型GPT-5.6OpenAI网络安全10 个信源在谈事件专题推荐理由:OpenAI 出了 GPT-5.6,专攻网络安全和生物任务,API 调用还会被安全审查,想了解最前沿模型能力与安全权衡的可以看看。原文稍后读已读值得跟进有用关注 GPT-5.6
02:22官方一手@OpenAIDevs@OpenAIDevs83°OpenAI 在 API 中推出了 GPT-5.6 的三个变体:Sol、Terra 和 Luna。Responses API 新增了 Programmatic Tool Calling(程序化工具调用)功能,同时 Multi-agent(多智能体)功能以 beta 形式提供。开发者可以通过 API 直接使用这些新能力。该更新旨在增强模型调用外部工具和多智能体协作的灵活性。AI模型GPT-5.6OpenAIProgrammatic Tool Calling10 个信源在谈事件专题推荐理由:OpenAI 刚发了 GPT-5.6 三个版本,Sol/Terra/Luna 各有侧重,还上了程序化工具调用和多智能体 beta,搞 Agent 的赶紧摸摸。原文稍后读已读值得跟进有用关注 GPT-5.6
02:19elvis@omarsar0GPT-5.6 Sol 在多项基准测试中取得最高分,其推理成本仅为竞争对手的一半以下。该模型相比 GPT-4 系列在效率上有显著提升,具体数字尚未完全公开,但性能数据已引起关注。测试覆盖了数学推理、代码生成等关键领域。AI模型GPT-5.6 SolOpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 Sol 比对手便宜一半还得分最高,搞 AI 的朋友值得看看这个新动向。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
02:11官方账号Sam Altman@sama93°OpenAI CEO Sam Altman 在 X 上宣布发布 GPT-5,称其是公司迄今为止最好的模型,同时也是一篇最好的博客文章。博客链接公开在 openai.com/index/gpt-5-6/。该模型在性能上超越 GPT-4 系列,具体基准成绩尚未在帖子中公布。AI模型GPT-5OpenAI前沿模型10 个信源在谈事件专题推荐理由:OpenAI 正式推出了 GPT-5,Sam Altman 亲自吹捧这是他们最好的模型,快去看看博客里写了什么新能力。原文稍后读已读值得跟进有用关注 GPT-5
02:06Aravind Srinivas@AravSrinivas精选Perplexity发布了基于GLM 5.2的编排器模型研究预览。该模型为计算机工具后训练,成本仅为Opus的0.344倍。与advisor配对时可达Opus 4.8级性能。目前以研究预览形式开放。AI模型GLM 5.2PerplexityOpus推荐理由:Perplexity新出的编排器模型基于GLM 5.2,成本只有Opus的三分之一,性能接近前沿。研究预览版本,赶紧试试。原文稍后读已读值得跟进有用关注 GLM 5.2
02:02Cognition@cognition_labsCognition 宣布 GPT-5.6 系列已在 Devin 中可用。在 FontierCode 1.1 Extended 基准上,GPT-5.6 系列实现了强得分与成本效率的平衡。其中 GPT 5.6 Sol 达到顶级性能,成本仅为次优模型的一半。该更新旨在提升 Devin 的编码任务表现。AI模型GPT-5.6DevinFontierCode推荐理由:Devin 现在能用 GPT-5.6 了,尤其是 Sol 版本,跑分高还省一半钱,做编码任务更划算。原文稍后读已读值得跟进有用关注 GPT-5.6
01:56OpenRouter@OpenRouterAIOpenRouter 发布 GPT-5.6 Luna 低成本版本,针对高吞吐量、低延迟场景优化,适用于聊天、分类和轻量级智能体。该模型保留完整的 GPT-5.6 推理能力但速度更快、成本更低。目前已在 OpenRouter 平台上线。AI模型GPT-5.6 LunaOpenRouter推理模型推荐理由:OpenRouter 出了 GPT-5.6 的便宜快版本,做聊天和智能体特别合适,比原版便宜还快。原文稍后读已读值得跟进有用关注 GPT-5.6 Luna
01:55OpenRouter@OpenRouterAIOpenRouter推出GPT-5.6 Terra模型,在编码、推理和智能体任务中达到GPT-5.5级别质量。其API成本约为GPT-5.5的1/2,每百万token输入2美元、输出6美元。该模型定位为日常使用的平衡驱动,兼顾性能与性价比。初期仅通过OpenRouter平台提供访问。AI模型GPT-5.6 TerraOpenRouterGPT-5.5推荐理由:想省钱又想有GPT-5.5级别编码和推理能力?试试OpenRouter的GPT-5.6 Terra,价格腰斩,性能不减。原文稍后读已读值得跟进有用关注 GPT-5.6 Terra
01:47官方账号OpenAI@OpenAI91°OpenAI推出了GPT-5.6系列模型。该系列包含三个子模型:Sol、Terra和Luna。这些模型已开始在ChatGPT、Codex和API中逐步推出。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI出了GPT-5.6系列,Sol、Terra、Luna三个模型现在就能在ChatGPT和API里用了,赶紧试试有什么不一样。原文稍后读已读值得跟进有用关注 GPT-5.6
01:43Ethan Mollick@emollickGPT-5.6 正式上线后,作者公开了预览阶段的演示项目。通过单条提示词,GPT-5.6 生成了游戏“Don't Discuss Goblins”的创意、机制和图形。该游戏展现了模型在创意设计和简单编程上的能力。AI模型GPT-5.6创意生成游戏开发推荐理由:GPT-5.6 刚上线,看它只用提示词就生成了一款带图形的小游戏,创意和机制还挺聪明。原文稍后读已读值得跟进有用关注 GPT-5.6
01:42官方账号Greg Brockman@gdbOpenAI推出GPT-5.6系列模型,旗舰模型Sol在编码、知识工作、网络安全和科学任务上表现优异。Terra和Luna作为低成本变体,以更低价格和更少token消耗提供高性能。新系列在多项基准上超越前代,整体成本降低30%以上。AI模型GPT-5.6SolTerra10 个信源在谈事件专题推荐理由:OpenAI出了GPT-5.6,Sol很强,还有便宜的Terra和Luna,编程和科学更厉害,token用得少。原文稍后读已读值得跟进有用关注 GPT-5.6
01:19elvis@omarsar0作者对GPT-5.6在编排与验证任务中的表现感到好奇。他通常使用不同的模型进行验证,并认为这种方式能带来更好的性能并减少奖励破解(reward hacking)导致的异常行为。目前尚缺乏适合这种测试时计算(test-time compute)范式的基准测试,作者通过多个实际项目来评估这些模式的效果。AI模型GPT-5.6OpenAI智能体10 个信源在谈事件专题推荐理由:一个开发者分享了他对GPT-5.6编排和验证的实践心得,用不同模型做验证能减少奖励破解,很实用。原文稍后读已读值得跟进有用关注 GPT-5.6
01:08The Rundown AI@therundownaiReve 2.1 图像生成模型正式发布。在 Text-to-Image Arena 基准中,Reve 2.1 超越 Muse Image 升至第二名,仅次于 gpt-image-2。Reve 表示 2.1 的训练计算量不到竞争对手实验室的十分之一。该模型在排名上实现了反超。AI模型ReveReve 2.1gpt-image-21 个信源在谈事件专题推荐理由:Reve 2.1 用不到十分之一的算力就拿到了图像生成第二,性价比拉满,值得看看。原文稍后读已读值得跟进有用关注 Reve
01:04lmarena.ai@lmarena_aiReve 2.1 在 Text-to-Image Arena 中凭借 1306 分升至第二名,领先第三名 28 分,相比一个月前的 Reve 2.0 提升 36 分。该模型在6个类别中均进入前三,包括产品/品牌/传播、卡通/动漫/奇幻、照片级/电影级图像、艺术、文字渲染,以及肖像类第三名。AI模型ReveReve 2.1Text-to-Image Arena1 个信源在谈事件专题推荐理由:Reve 更新了 2.1,直接在文生图排行榜冲到第二,比自家上一代猛涨36分,还赢了第三名28分,六个细分项目全在前三。原文稍后读已读值得跟进有用关注 Reve
00:22岚叔@lufzzliz用户实测对比Grok-4.5与GPT 5.5的前端编码能力,认为Grok-4.5凭借速度优势体验更好。Grok-4.5能快速迭代代码并理解用户需求,前端编写过程更流畅。该评价来自X平台个人分享。AI模型Grok-4.5GPT 5.5前端编程推荐理由:写前端代码试试Grok-4.5,比GPT 5.5快不少,迭代起来很顺手。原文稍后读已读值得跟进有用关注 Grok-4.5
00:10The Rundown AI@therundownaiMark Zuckerberg三年来首次在平台发帖宣布Meta发布新模型。Muse Spark 1.1是一款专注于智能体和编程任务的模型。该模型定价较低,可通过Meta Model API和Meta AI访问。AI模型MetaMuse Spark 1.1Zuckerberg推荐理由:Meta出了Muse Spark 1.1,主打智能体和编程,价格很实惠,值得试试。原文稍后读已读值得跟进有用关注 Meta
23:59小互@imxiaohuMeta 发布 Muse 多模态推理模型,专为 agentic 任务设计。在多葛代理评估中,Muse 性能媲美 GPT-5.5 和 Opus-4.8。模型拥有 1M 令牌上下文窗口,并配备主动上下文管理功能,可从早期交互中检索信息、压缩关键步骤。Muse 支持计算机使用,能操作桌面、浏览器和移动设备。AI模型MuseMeta智能体推荐理由:Meta 新出的 Muse 在 agent 任务上直追 GPT-5.5,还有 1M 上下文和主动记忆管理,跑长任务再也不怕忘事了。原文稍后读已读值得跟进有用关注 Muse
23:53小互@imxiaohuSpark 1.11.1被训练为能编排多Agent系统,目标优化端到端延迟。作为主Agent时,它先收集上下文并制定计划,然后将执行拆分给并行子Agent。作为普通Agent时,它守住任务边界,识别可用工具,必要时升级回主Agent。该版本通过动态角色切换提升多Agent协作效率。AI模型Spark1.11.1智能体推荐理由:Spark 1.11.1 专门优化多Agent协作,能自动切换主从角色,有效降低端到端延迟。原文稍后读已读值得跟进有用关注 Spark
23:52Justine Moore@venturetwinsFable 5、GPT-5.6和Grok 4.5等新模型在本周密集出现,展示出语言模型能力仍在持续提升。开发者社区在社交平台上注意到这些模型的新特性,并讨论其与前辈的差异。这一轮模型更新被视为LLM能力天花板再次被推高的信号。AI模型Fable 5GPT-5.6Grok 4.58 个信源在谈事件专题推荐理由:这周Fable 5、GPT-5.6、Grok 4.5都冒出来了,LLM能力好像又突破了,值得看看大家怎么说的。原文稍后读已读值得跟进有用关注 Fable 5
23:48elvis@omarsar076°Meta发布了Muse Spark 1.1模型,性能接近Opus-4.8/GPT-5.5级别。该模型支持1M上下文窗口,并新增计算机使用能力,可编写脚本、点击操作并批量生成动作。开发者可通过新的Meta Model API预览访问,用户也可在Meta AI应用中体验推理模式。AI模型Muse SparkMeta计算机使用推荐理由:Meta的新模型Muse Spark 1.1性能逼近GPT-5.5,还有1M上下文和电脑操控功能,适合搞自动化任务。原文稍后读已读值得跟进有用关注 Muse Spark
23:47elvis@omarsar0Meta CEO Mark Zuckerberg 宣布发布 Muse Spark 1.1,一个面向智能体和编码任务的模型。该模型通过 Meta Model API 和 Meta AI 提供,价格非常低廉。发布时间与 GPT-5.6 同周,形成竞争态势。AI模型Muse SparkMetaGPT-5推荐理由:Meta 新模型 Muse Spark 1.1 主打智能体和编码,价格低,还和 GPT-5.6 正面刚。原文稍后读已读值得跟进有用关注 Muse Spark