7月10日
03:46
03:46Guillermo Rauch@rauchg
Vercel将Meta的Muse Spark 1.1多模态推理模型集成到AI Gateway中。该模型专为智能体任务设计,兼具高速推理和高智能水平。同时,Grok 4.5和GLM 5.2可能在本周发布,预计将显著分走token市场份额。当前是使用AI Gateway的好时机。
推荐理由:Vercel把Meta的Muse Spark 1.1接入AI Gateway,这是个专门干智能体任务的又快又聪明的多模态模型,你值得试试。
03:36
03:33
03:33宝玉@dotey
83°
OpenAI 发布了 GPT-5.6 系列模型(Sol, Terra, Luna),已开始在 ChatGPT、Codex 和 API 中推出。此次合并将 ChatGPT 和 Codex 统一为一个名称。新模型家族包含三个变体,针对不同场景优化。
事件专题

推荐理由:OpenAI 把 ChatGPT 和 Codex 合并了,还出了 GPT-5.6 三个新模型,Sol、Terra、Luna 各有侧重,快去试试。
03:29
03:19
03:19官方一手@OpenAIDevs@OpenAIDevs
精选
Vercel 软件主管 Andrew Qu 使用 OpenAI 的 GPT-5.6 和 Codex 解除了内部数据科学代理在先前模型卡住的任务。该代理此前在处理某些复杂工作时因模型能力不足而停滞。GPT-5.6 的推理能力使其能够继续推进这些任务。
事件专题

推荐理由:Vercel 用 GPT-5.6 让数据科学代理更聪明,之前卡住的任务现在能搞定了。
03:15
03:15coderabbitai@coderabbitai
CodeRabbit测试了GPT-5.6的两个变体Sol和Terra。Sol在遵循长任务、保持仓库上下文和代码审查基准中展现了更好的召回。Terra作为更便宜的选项适用于小范围工作。报告对比了Fable 5和Opus 4.8的定价与性能。

推荐理由:CodeRabbit实测了GPT-5.6的两个版本,Sol在代码审查中召回更强,Terra则更省钱。对比Fable 5和Opus 4.8,想升级编码工具可以看。
03:14
03:14AI Engineer@aiDotEngineer
OpenAI 推出了 GPT-5.6 模型,包含 Sol、Terra 和 Luna 三个版本。@romainhuet、@embirico 和 @steipete 在视频中称这是 AI 工程黄金时代的开端。该推文获得 15 次点赞和 4067 次浏览。具体性能细节请查看视频。
事件专题

推荐理由:OpenAI 的 GPT-5.6 一口气发了三个版本,还有行业大佬站台,快去看视频了解吧!
03:07
03:07官方一手@OpenAIDevs@OpenAIDevs
91°
OpenAI 发布 GPT-5.6,分为三个模型层级:Sol 用于长周期编程与智能体任务,Terra 平衡日常任务性能与成本,Luna 专注高速高频任务。在知识工作评估中,GPT-5.6 Terra 超越 GPT-5.5 且成本更低。GPT-5.6 Luna 接近 GPT-5.5 峰值性能,但 API 成本不到一半。
事件专题

推荐理由:OpenAI 给 GPT-5.6 分了三个档,Sol 专攻复杂编程和智能体任务,Terra 比上一代更强更便宜,Luna 跑得快还省一半钱。
03:03
02:57
02:52
02:52官方一手@OpenAIDevs@OpenAIDevs
OpenAI在API中推出GPT-5.6系列,包含三个模型。旗舰模型Sol在编程、知识工作、网络安全和科学领域领先。Terra以较低成本提供与GPT-5.5相当的性能。Luna是最快、最便宜的模型,适合高流量任务。
事件专题

推荐理由:OpenAI刚发了GPT-5.6的三个新模型:Sol旗舰强在编程和科学,Terra性价比高,Luna又快又便宜。
02:49
02:49官方账号OpenAI@OpenAI
91°
OpenAI发布GPT-5.6 Sol模型,在编码、知识工作、网络安全和科学领域实现最先进性能。该模型使用更少token并降低计算成本。相比前代,它在多个基准测试中表现更优,但具体数字未公开。
事件专题

推荐理由:OpenAI新出的GPT-5.6 Sol能在编程、科研等领域做到顶尖,还省token省成本,想尝鲜的可以试试。
02:46
02:46Lovable@lovable_dev
精选
Lovable 宣布集成 OpenAI 的 GPT-5.6 模型。相比此前模型,GPT-5.6 在构建生产级应用的长复杂工作流中,步骤减少约 25%,工具调用次数降低 35% 至 48%。项目成功率有所提升,卡住运行的几率降低 15%。
事件专题

推荐理由:Lovable 上了 GPT-5.6,跑复杂项目更快了,步数省四分之一,工具调用少四成,卡壳也少了,效率党可以试试。
02:35
02:35官方账号OpenAI@OpenAI
OpenAI宣布ChatGPT Work由GPT-5.6模型驱动。GPT-5.6使ChatGPT在复杂任务推理上达到最先进水平。它还能根据用户模板、参考文件和偏好风格自动生成材料。用户只需描述期望结果,无需逐步说明步骤。
事件专题

推荐理由:OpenAI给ChatGPT Work换上了GPT-5.6,推理和按模板生成都变强了,不用一步步教它怎么做。
02:31
02:31Aravind Srinivas@AravSrinivas
精选
Arav Srinivas宣布将在美国的NVIDIA B200s上托管一个模型,并计划对Nemotron 3 Ultra进行后训练。后训练旨在提升该模型的性能,使其与美国开源模型具备同等能力。更多细节即将公布。
事件专题

推荐理由:Arav Srinivas说要在美国用B200s跑Nemotron 3 Ultra后训练,让美国开源模型追上对手进度。
02:11
02:11官方账号Sam Altman@sama
93°
OpenAI CEO Sam Altman 在 X 上宣布发布 GPT-5,称其是公司迄今为止最好的模型,同时也是一篇最好的博客文章。博客链接公开在 openai.com/index/gpt-5-6/。该模型在性能上超越 GPT-4 系列,具体基准成绩尚未在帖子中公布。
事件专题

推荐理由:OpenAI 正式推出了 GPT-5,Sam Altman 亲自吹捧这是他们最好的模型,快去看看博客里写了什么新能力。
02:06
01:56
01:47
01:43
01:42
01:42官方账号Greg Brockman@gdb
OpenAI推出GPT-5.6系列模型,旗舰模型Sol在编码、知识工作、网络安全和科学任务上表现优异。Terra和Luna作为低成本变体,以更低价格和更少token消耗提供高性能。新系列在多项基准上超越前代,整体成本降低30%以上。
事件专题

推荐理由:OpenAI出了GPT-5.6,Sol很强,还有便宜的Terra和Luna,编程和科学更厉害,token用得少。
01:08
01:08The Rundown AI@therundownai
Reve 2.1 图像生成模型正式发布。在 Text-to-Image Arena 基准中,Reve 2.1 超越 Muse Image 升至第二名,仅次于 gpt-image-2。Reve 表示 2.1 的训练计算量不到竞争对手实验室的十分之一。该模型在排名上实现了反超。
事件专题

推荐理由:Reve 2.1 用不到十分之一的算力就拿到了图像生成第二,性价比拉满,值得看看。
01:04
01:04lmarena.ai@lmarena_ai
Reve 2.1 在 Text-to-Image Arena 中凭借 1306 分升至第二名,领先第三名 28 分,相比一个月前的 Reve 2.0 提升 36 分。该模型在6个类别中均进入前三,包括产品/品牌/传播、卡通/动漫/奇幻、照片级/电影级图像、艺术、文字渲染,以及肖像类第三名。
事件专题

推荐理由:Reve 更新了 2.1,直接在文生图排行榜冲到第二,比自家上一代猛涨36分,还赢了第三名28分,六个细分项目全在前三。
00:10
7月9日
23:52
23:52Justine Moore@venturetwins
Fable 5、GPT-5.6和Grok 4.5等新模型在本周密集出现,展示出语言模型能力仍在持续提升。开发者社区在社交平台上注意到这些模型的新特性,并讨论其与前辈的差异。这一轮模型更新被视为LLM能力天花板再次被推高的信号。
事件专题

推荐理由:这周Fable 5、GPT-5.6、Grok 4.5都冒出来了,LLM能力好像又突破了,值得看看大家怎么说的。
23:47

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。