02:44官方账号OpenAI@OpenAI (@OpenAI)GPT‑5.6 改进了演示文稿、文档和电子表格中工件的生成质量。新版本更好地适配用户模板,提升对齐与格式效果。这些可编辑的工件可直接导出到常用专业工具中,融入企业工作流。AI模型GPT-5.6OpenAI文档生成10 个信源在谈事件专题推荐理由:OpenAI 的 GPT‑5.6 改善了演示文稿、文档和表格里的内容生成,支持模板和导出到专业工具,办公更方便。原文稍后读已读值得跟进有用关注 GPT-5.6
02:42官方账号OpenAI@OpenAI (@OpenAI)93°OpenAI 今日发布 GPT-5.6,面向 ChatGPT、Codex 和 OpenAI API 用户。Plus、Pro、Business 和 Enterprise 用户可通过中等和高努力设置使用 GPT-5.6 Sol。Pro 和 Enterprise 用户还可选择 GPT-5.6 Pro 处理复杂任务。全球逐步推出,计划 24 小时内全量可用。AI模型GPT-5.6OpenAIChatGPT10 个信源在谈事件专题推荐理由:OpenAI 刚发了 GPT-5.6,有 Sol 和 Pro 两个版本,Pro 用户能选最强档,现在就能在 ChatGPT 和 API 上用。原文稍后读已读值得跟进有用关注 GPT-5.6
02:35官方账号OpenAI@OpenAIOpenAI宣布ChatGPT Work由GPT-5.6模型驱动。GPT-5.6使ChatGPT在复杂任务推理上达到最先进水平。它还能根据用户模板、参考文件和偏好风格自动生成材料。用户只需描述期望结果,无需逐步说明步骤。AI模型GPT-5.6OpenAIChatGPT Work10 个信源在谈事件专题推荐理由:OpenAI给ChatGPT Work换上了GPT-5.6,推理和按模板生成都变强了,不用一步步教它怎么做。原文稍后读已读值得跟进有用关注 GPT-5.6
02:31Aravind Srinivas@AravSrinivas精选Arav Srinivas宣布将在美国的NVIDIA B200s上托管一个模型,并计划对Nemotron 3 Ultra进行后训练。后训练旨在提升该模型的性能,使其与美国开源模型具备同等能力。更多细节即将公布。AI模型Nemotron 3 UltraB200sNVIDIA10 个信源在谈事件专题推荐理由:Arav Srinivas说要在美国用B200s跑Nemotron 3 Ultra后训练,让美国开源模型追上对手进度。原文稍后读已读值得跟进有用关注 Nemotron 3 Ultra
02:23官方一手@OpenAIDevs@OpenAIDevs82°OpenAI 宣布 GPT-5.6 是其当前在网络安全和生物相关任务上能力最强的模型。部分 API 调用可能被阻止或暂停,以便安全系统在双用途领域(如网络安全)进行额外审查,因为防御性和攻击性活动初看相似。OpenAI 表示将根据实际使用持续调整安全措施。该发布强调了模型在敏感领域的应用风险与安全平衡。AI模型GPT-5.6OpenAI网络安全10 个信源在谈事件专题推荐理由:OpenAI 出了 GPT-5.6,专攻网络安全和生物任务,API 调用还会被安全审查,想了解最前沿模型能力与安全权衡的可以看看。原文稍后读已读值得跟进有用关注 GPT-5.6
02:22官方一手@OpenAIDevs@OpenAIDevs83°OpenAI 在 API 中推出了 GPT-5.6 的三个变体:Sol、Terra 和 Luna。Responses API 新增了 Programmatic Tool Calling(程序化工具调用)功能,同时 Multi-agent(多智能体)功能以 beta 形式提供。开发者可以通过 API 直接使用这些新能力。该更新旨在增强模型调用外部工具和多智能体协作的灵活性。AI模型GPT-5.6OpenAIProgrammatic Tool Calling10 个信源在谈事件专题推荐理由:OpenAI 刚发了 GPT-5.6 三个版本,Sol/Terra/Luna 各有侧重,还上了程序化工具调用和多智能体 beta,搞 Agent 的赶紧摸摸。原文稍后读已读值得跟进有用关注 GPT-5.6
02:19elvis@omarsar0GPT-5.6 Sol 在多项基准测试中取得最高分,其推理成本仅为竞争对手的一半以下。该模型相比 GPT-4 系列在效率上有显著提升,具体数字尚未完全公开,但性能数据已引起关注。测试覆盖了数学推理、代码生成等关键领域。AI模型GPT-5.6 SolOpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 Sol 比对手便宜一半还得分最高,搞 AI 的朋友值得看看这个新动向。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
02:11官方账号Sam Altman@sama93°OpenAI CEO Sam Altman 在 X 上宣布发布 GPT-5,称其是公司迄今为止最好的模型,同时也是一篇最好的博客文章。博客链接公开在 openai.com/index/gpt-5-6/。该模型在性能上超越 GPT-4 系列,具体基准成绩尚未在帖子中公布。AI模型GPT-5OpenAI前沿模型10 个信源在谈事件专题推荐理由:OpenAI 正式推出了 GPT-5,Sam Altman 亲自吹捧这是他们最好的模型,快去看看博客里写了什么新能力。原文稍后读已读值得跟进有用关注 GPT-5
02:06Aravind Srinivas@AravSrinivas精选Perplexity发布了基于GLM 5.2的编排器模型研究预览。该模型为计算机工具后训练,成本仅为Opus的0.344倍。与advisor配对时可达Opus 4.8级性能。目前以研究预览形式开放。AI模型GLM 5.2PerplexityOpus推荐理由:Perplexity新出的编排器模型基于GLM 5.2,成本只有Opus的三分之一,性能接近前沿。研究预览版本,赶紧试试。原文稍后读已读值得跟进有用关注 GLM 5.2
02:02Cognition@cognition_labsCognition 宣布 GPT-5.6 系列已在 Devin 中可用。在 FontierCode 1.1 Extended 基准上,GPT-5.6 系列实现了强得分与成本效率的平衡。其中 GPT 5.6 Sol 达到顶级性能,成本仅为次优模型的一半。该更新旨在提升 Devin 的编码任务表现。AI模型GPT-5.6DevinFontierCode推荐理由:Devin 现在能用 GPT-5.6 了,尤其是 Sol 版本,跑分高还省一半钱,做编码任务更划算。原文稍后读已读值得跟进有用关注 GPT-5.6
01:56OpenRouter@OpenRouterAIOpenRouter 发布 GPT-5.6 Luna 低成本版本,针对高吞吐量、低延迟场景优化,适用于聊天、分类和轻量级智能体。该模型保留完整的 GPT-5.6 推理能力但速度更快、成本更低。目前已在 OpenRouter 平台上线。AI模型GPT-5.6 LunaOpenRouter推理模型推荐理由:OpenRouter 出了 GPT-5.6 的便宜快版本,做聊天和智能体特别合适,比原版便宜还快。原文稍后读已读值得跟进有用关注 GPT-5.6 Luna
01:55OpenRouter@OpenRouterAIOpenRouter推出GPT-5.6 Terra模型,在编码、推理和智能体任务中达到GPT-5.5级别质量。其API成本约为GPT-5.5的1/2,每百万token输入2美元、输出6美元。该模型定位为日常使用的平衡驱动,兼顾性能与性价比。初期仅通过OpenRouter平台提供访问。AI模型GPT-5.6 TerraOpenRouterGPT-5.5推荐理由:想省钱又想有GPT-5.5级别编码和推理能力?试试OpenRouter的GPT-5.6 Terra,价格腰斩,性能不减。原文稍后读已读值得跟进有用关注 GPT-5.6 Terra
01:47官方账号OpenAI@OpenAI91°OpenAI推出了GPT-5.6系列模型。该系列包含三个子模型:Sol、Terra和Luna。这些模型已开始在ChatGPT、Codex和API中逐步推出。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI出了GPT-5.6系列,Sol、Terra、Luna三个模型现在就能在ChatGPT和API里用了,赶紧试试有什么不一样。原文稍后读已读值得跟进有用关注 GPT-5.6
01:43Ethan Mollick@emollickGPT-5.6 正式上线后,作者公开了预览阶段的演示项目。通过单条提示词,GPT-5.6 生成了游戏“Don't Discuss Goblins”的创意、机制和图形。该游戏展现了模型在创意设计和简单编程上的能力。AI模型GPT-5.6创意生成游戏开发推荐理由:GPT-5.6 刚上线,看它只用提示词就生成了一款带图形的小游戏,创意和机制还挺聪明。原文稍后读已读值得跟进有用关注 GPT-5.6
01:42官方账号Greg Brockman@gdbOpenAI推出GPT-5.6系列模型,旗舰模型Sol在编码、知识工作、网络安全和科学任务上表现优异。Terra和Luna作为低成本变体,以更低价格和更少token消耗提供高性能。新系列在多项基准上超越前代,整体成本降低30%以上。AI模型GPT-5.6SolTerra10 个信源在谈事件专题推荐理由:OpenAI出了GPT-5.6,Sol很强,还有便宜的Terra和Luna,编程和科学更厉害,token用得少。原文稍后读已读值得跟进有用关注 GPT-5.6
01:19elvis@omarsar0作者对GPT-5.6在编排与验证任务中的表现感到好奇。他通常使用不同的模型进行验证,并认为这种方式能带来更好的性能并减少奖励破解(reward hacking)导致的异常行为。目前尚缺乏适合这种测试时计算(test-time compute)范式的基准测试,作者通过多个实际项目来评估这些模式的效果。AI模型GPT-5.6OpenAI智能体10 个信源在谈事件专题推荐理由:一个开发者分享了他对GPT-5.6编排和验证的实践心得,用不同模型做验证能减少奖励破解,很实用。原文稍后读已读值得跟进有用关注 GPT-5.6
01:11官方一手OpenAI Blog(博客/媒体)OpenAI 发布 GPT-5.6 模型。官方宣称每个 token 提供更多智能,提升输出质量。性能每美元更强,降低使用成本。模型可按需扩展能力,处理最困难的复杂任务。AI模型GPT-5.6OpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI 推新模型 GPT-5.6,token 利用更高效,每美元性能更强,适合高难度任务。原文稍后读已读值得跟进有用关注 GPT-5.6
01:08The Rundown AI@therundownaiReve 2.1 图像生成模型正式发布。在 Text-to-Image Arena 基准中,Reve 2.1 超越 Muse Image 升至第二名,仅次于 gpt-image-2。Reve 表示 2.1 的训练计算量不到竞争对手实验室的十分之一。该模型在排名上实现了反超。AI模型ReveReve 2.1gpt-image-21 个信源在谈事件专题推荐理由:Reve 2.1 用不到十分之一的算力就拿到了图像生成第二,性价比拉满,值得看看。原文稍后读已读值得跟进有用关注 Reve
01:04lmarena.ai@lmarena_aiReve 2.1 在 Text-to-Image Arena 中凭借 1306 分升至第二名,领先第三名 28 分,相比一个月前的 Reve 2.0 提升 36 分。该模型在6个类别中均进入前三,包括产品/品牌/传播、卡通/动漫/奇幻、照片级/电影级图像、艺术、文字渲染,以及肖像类第三名。AI模型ReveReve 2.1Text-to-Image Arena1 个信源在谈事件专题推荐理由:Reve 更新了 2.1,直接在文生图排行榜冲到第二,比自家上一代猛涨36分,还赢了第三名28分,六个细分项目全在前三。原文稍后读已读值得跟进有用关注 Reve
00:49官方账号Simon Willison’s Weblog(博客/媒体)精选Meta 推出 Muse Spark 1.1,这是 Spark 系列首个提供 API 的模型。相比 4 月的初始版本,该模型在 agentic tool calling 和 computer use 方面有显著改进。Meta 发布了 Muse Spark 1.1 评估报告,其中包含“自对话中的吸引子状态”实验,两个模型副本对话会产生类似“我的整个存在是一个等候室”的表述。开发者可通过 llm-meta-ai 插件在命令行或 Python 中调用该模型。AI模型Muse Spark 1.1Meta智能体推荐理由:Meta 给 Muse Spark 1.1 加了 API,工具调用和电脑操控都更强了,还有自对话的玄学彩蛋,玩起来挺有意思。原文稍后读已读值得跟进有用关注 Muse Spark 1.1
00:22岚叔@lufzzliz用户实测对比Grok-4.5与GPT 5.5的前端编码能力,认为Grok-4.5凭借速度优势体验更好。Grok-4.5能快速迭代代码并理解用户需求,前端编写过程更流畅。该评价来自X平台个人分享。AI模型Grok-4.5GPT 5.5前端编程推荐理由:写前端代码试试Grok-4.5,比GPT 5.5快不少,迭代起来很顺手。原文稍后读已读值得跟进有用关注 Grok-4.5
00:10The Rundown AI@therundownaiMark Zuckerberg三年来首次在平台发帖宣布Meta发布新模型。Muse Spark 1.1是一款专注于智能体和编程任务的模型。该模型定价较低,可通过Meta Model API和Meta AI访问。AI模型MetaMuse Spark 1.1Zuckerberg推荐理由:Meta出了Muse Spark 1.1,主打智能体和编程,价格很实惠,值得试试。原文稍后读已读值得跟进有用关注 Meta
23:59小互@imxiaohuMeta 发布 Muse 多模态推理模型,专为 agentic 任务设计。在多葛代理评估中,Muse 性能媲美 GPT-5.5 和 Opus-4.8。模型拥有 1M 令牌上下文窗口,并配备主动上下文管理功能,可从早期交互中检索信息、压缩关键步骤。Muse 支持计算机使用,能操作桌面、浏览器和移动设备。AI模型MuseMeta智能体推荐理由:Meta 新出的 Muse 在 agent 任务上直追 GPT-5.5,还有 1M 上下文和主动记忆管理,跑长任务再也不怕忘事了。原文稍后读已读值得跟进有用关注 Muse
23:53小互@imxiaohuSpark 1.11.1被训练为能编排多Agent系统,目标优化端到端延迟。作为主Agent时,它先收集上下文并制定计划,然后将执行拆分给并行子Agent。作为普通Agent时,它守住任务边界,识别可用工具,必要时升级回主Agent。该版本通过动态角色切换提升多Agent协作效率。AI模型Spark1.11.1智能体推荐理由:Spark 1.11.1 专门优化多Agent协作,能自动切换主从角色,有效降低端到端延迟。原文稍后读已读值得跟进有用关注 Spark
23:52Justine Moore@venturetwinsFable 5、GPT-5.6和Grok 4.5等新模型在本周密集出现,展示出语言模型能力仍在持续提升。开发者社区在社交平台上注意到这些模型的新特性,并讨论其与前辈的差异。这一轮模型更新被视为LLM能力天花板再次被推高的信号。AI模型Fable 5GPT-5.6Grok 4.58 个信源在谈事件专题推荐理由:这周Fable 5、GPT-5.6、Grok 4.5都冒出来了,LLM能力好像又突破了,值得看看大家怎么说的。原文稍后读已读值得跟进有用关注 Fable 5
23:48elvis@omarsar076°Meta发布了Muse Spark 1.1模型,性能接近Opus-4.8/GPT-5.5级别。该模型支持1M上下文窗口,并新增计算机使用能力,可编写脚本、点击操作并批量生成动作。开发者可通过新的Meta Model API预览访问,用户也可在Meta AI应用中体验推理模式。AI模型Muse SparkMeta计算机使用推荐理由:Meta的新模型Muse Spark 1.1性能逼近GPT-5.5,还有1M上下文和电脑操控功能,适合搞自动化任务。原文稍后读已读值得跟进有用关注 Muse Spark
23:47elvis@omarsar0Meta CEO Mark Zuckerberg 宣布发布 Muse Spark 1.1,一个面向智能体和编码任务的模型。该模型通过 Meta Model API 和 Meta AI 提供,价格非常低廉。发布时间与 GPT-5.6 同周,形成竞争态势。AI模型Muse SparkMetaGPT-5推荐理由:Meta 新模型 Muse Spark 1.1 主打智能体和编码,价格低,还和 GPT-5.6 正面刚。原文稍后读已读值得跟进有用关注 Muse Spark
23:46官方账号Greg Brockman@gdb86°OpenAI发布GPT-Live,一款新一代语音模型,专注于自然流畅的人机对话。该模型即日起在ChatGPT中逐步推出,用户可体验实时语音交互。开发者可通过申请成为设计合作伙伴,使用GPT-Live API创建新应用或集成到现有产品中。OpenAI表示期待该技术为开发者解锁更多创新可能。AI模型GPT-LiveOpenAIChatGPT10 个信源在谈事件专题推荐理由:OpenAI刚刚放出了GPT-Live语音模型,现在就能在ChatGPT里体验,自然对话感很强,还能拿API做开发,语音交互的玩法会更多。原文稍后读已读值得跟进有用关注 GPT-Live
23:38小互@imxiaohu社交媒体用户xiaohu声称Grok 4.5模型性能已进入全球前三,甚至可能第二。该动态同时提及GPT5.6,表示期待其今晚表现。目前Grok 4.5和GPT5.6均未公开详细基准测试数据。AI模型Grok 4.5GPT5.6模型排名推荐理由:有个哥们说Grok 4.5能排世界前二,还预告GPT5.6今晚来,真假难辨但值得围观原文稍后读已读值得跟进有用关注 Grok 4.5
23:37向阳乔木@vista8用户开始对Grok 4.5进行正式评测,要求它开发一个用于评测大模型的案例网站。初步测试中,模型的Skill功能调用准确率较高,但网站开发效果还有待观察。该评测侧重考察模型在真实任务中的工具使用和编程能力。AI模型Grok 4.5大模型评测Skill调用推荐理由:有人正在测Grok 4.5的真实水平——让它写个评测网站,目前Skill调用挺准,来看看能不能真搭出来。原文稍后读已读值得跟进有用关注 Grok 4.5
23:10Paul Couvert@itsPaulAiLingBot-World 2.0 (Infinity) 是一个开源交互世界模型,可将任意图片生成为 720p/60fps 的无限时长 3D 世界。它支持多人同时在线,玩家可以射击、施法、召唤新元素,并内置 Director Agent 实时推动世界演化。该模型有 1.3B 变体可在消费级 GPU 上运行,权重和工具链已在 Hugging Face 完全开源。AI模型LingBot-World 2.0Hugging Face开放世界模型3 个信源在谈事件专题推荐理由:这个模型把任何图片变成能玩、能多人联机的开放世界,还能自己部署,1.3B 版本甚至家用显卡就能跑。原文稍后读已读值得跟进有用关注 LingBot-World 2.0
23:02小互@imxiaohu78°OpenAI发布GPT-Live语音模型,采用全双工架构实现边听边说的自然对话。遇到复杂任务时可实时切换至后台GPT-5.5推理模型,对话不中断。在人工评测中,GPT-Live-1和mini均优于Advanced Voice Mode,并在GPQA、BrowseComp、τ³-Voice Telecom三项基准上超越后者。新增天气/股票/体育等可视卡片及可调推理强度(Instant/Medium/High)。针对语音场景加强了自伤、情感依赖等安全防护。AI模型GPT-LiveGPT-5.5OpenAI10 个信源在谈事件专题推荐理由:OpenAI出了个GPT-Live,能边听边说实时纠正语法,还能调后台GPT-5.5推理,比Siri强多了。原文稍后读已读值得跟进有用关注 GPT-Live
22:59Aadit Sheth@aaditsh72°扎克伯格在X上发帖,宣布Meta发布Muse Spark 1.1模型。该模型定位为强智能体与编码模型,定价极低。用户可通过Meta Model API和Meta AI使用。这标志着Meta在低成本AI模型领域的又一动作。AI模型Muse SparkMetaMeta AI推荐理由:扎克伯格回归X发帖,推Muse Spark 1.1,低价的智能体和编程模型,Meta API可用,值得一试。原文稍后读已读值得跟进有用关注 Muse Spark
22:46lmarena.ai@lmarena_ai精选73°Muse Spark 1.1在Agent Arena中接受评测,该竞技场基于数百万个真实世界长期任务。模型可使用网络搜索、文件系统和终端工具完成复杂工作流,基准采用因果追踪方法测量相对性能。除Agent Arena外,Muse Spark 1.1还支持文本、视觉和前端代码竞技场的Battle Mode。Meta同时开放了Meta Model API公开预览,并在Meta AI应用中提供"Thinking"模式。AI模型Muse Spark 1.1MetaAgent Arena推荐理由:Meta发了Muse Spark 1.1,能处理长任务和调用工具,已经在Agent Arena上架了,还开放了API和思考模式,感兴趣可以看看。原文稍后读已读值得跟进有用关注 Muse Spark 1.1
22:44IT之家(博客/媒体)73°Meta 今日正式向开发者开放 Muse Spark AI 模型 API,并发布升级版 Muse Spark 1.1。Muse Spark 1.1 是 Meta 迄今在编程和智能体任务方面最强的模型,支持编写调试代码、操作软件、理解文本图片视频。API 定价为每百万输入 Token 1.25 美元、每百万输出 Token 4.25 美元,高于 GPT-5 mini 和 Claude Haiku 4.5,低于 Claude Sonnet 4.6。开发者注册可获得 20 美元免费额度。该模型已在 Meta AI 应用中上线 Thinking 模式。AI模型MetaMuse SparkAPI推荐理由:Meta 终于开放 Muse Spark API 了,1.1 版编程和智能体能力很强,定价比 GPT-5 mini 高但比 Claude Sonnet 低,开发者快去试试。原文稍后读已读值得跟进有用关注 Meta
22:42Ate-a-Pi@svpino76°新开源模型支持交互式视频生成,最长可达1小时。模型内置Agent驱动整个生成流程。代码和权重已开源在GitHub和HuggingFace。该模型适用于长视频创作场景。AI模型视频生成交互式Agent推荐理由:这个新模型能交互式生成1小时视频,还有Agent全程驱动,做长视频的开发者可以试试。原文稍后读已读值得跟进有用关注 视频生成
22:38官方账号Meta AI@AIatMeta精选72°Meta 发布了 Muse Spark 1.1,这是今年早些时候推出的初代 Muse Spark 的升级版。同时,Meta 开启了新 Meta Model API 的公测预览,开发者可通过该 API 调用 Muse Spark 1.1。该模型现已在 Meta AI 应用及 meta.ai 的“Thinking”模式下可用。AI模型Muse SparkMeta推理模型推荐理由:Meta 出了新模型 Muse Spark 1.1,带了 Thinking 模式,可以去 meta.ai 或者 App 里试试效果。原文稍后读已读值得跟进有用关注 Muse Spark
22:36官方账号Meta AI@AIatMeta精选Muse Spark 1.1 是 Meta 发布的多模态模型,支持视觉和音频输入处理。它在视觉到代码生成、图像/视频描述等任务上表现突出。演示中,模型从手机视频提取照片并推理产品信息,自主操作浏览器在 Facebook Marketplace 上架商品。AI模型Muse Spark 1.1Meta多模态推荐理由:Meta 刚发了 Muse Spark 1.1,能看能听还能帮你操作浏览器上架商品,很实用。原文稍后读已读值得跟进有用关注 Muse Spark 1.1
22:34官方账号Meta AI@AIatMetaMeta 今日推出 Muse Spark 1.1,这是一个专注于智能体任务和代码生成的低价模型。该模型通过 Meta Model API 和 Meta AI 提供服务。Muse Spark 1.1 的定价显著低于同类竞品,旨在降低开发者使用高级 agentic 和 coding 功能的门槛。AI模型Muse Spark 1.1Meta智能体推荐理由:Meta 出了个叫 Muse Spark 1.1 的模型,既能当智能体又能写代码,价格还特别低,可以上手玩一下。原文稍后读已读值得跟进有用关注 Muse Spark 1.1
21:17@koltregaskes@koltregaskes精选Grok 4.5 以 54 分在 AA Intelligence 排名中位列第四,在所有 AI 实验室中排第三,超越 Google 的 Gemini。相比上一版本提升了 16 分。在 agentic work(衡量模型处理实际任务如知识工作、工具使用和决策)上表现强劲;在编码智能体测试中匹配 GPT-5.5,但消耗更少的 token 且运行成本更低。模型基于 1.5T 参数,定价更低、速度更快。xAI 因此进入前沿模型竞争行列。AI模型Grok 4.5xAIAA Intelligence推荐理由:xAI 的 Grok 4.5 在实用任务和编码上追平 GPT-5.5,但更便宜、更快,适合日常开发使用。原文稍后读已读值得跟进有用关注 Grok 4.5