7月9日
23:38
23:37
22:59
22:42
22:38
22:34
22:34官方账号Meta AI@AIatMeta
Meta 今日推出 Muse Spark 1.1,这是一个专注于智能体任务和代码生成的低价模型。该模型通过 Meta Model API 和 Meta AI 提供服务。Muse Spark 1.1 的定价显著低于同类竞品,旨在降低开发者使用高级 agentic 和 coding 功能的门槛。
推荐理由:Meta 出了个叫 Muse Spark 1.1 的模型,既能当智能体又能写代码,价格还特别低,可以上手玩一下。
18:45
18:45官方账号OpenAI@OpenAI
91°
OpenAI 发布 GPT-5.6 系列有限预览,包括三个模型:GPT-5.6 Sol 为前沿模型,GPT-5.6 Terra 为面向日常任务的平衡模型,GPT-5.6 Luna 为高吞吐量场景的快速低价模型。用户可通过链接申请有限预览权限。
事件专题

推荐理由:OpenAI 推出了 GPT-5.6 三个版本,Sol 最强、Terra 均衡、Luna 便宜快。按需求选吧。
18:44
18:36
18:36orange.ai@oran_ge
BytePlus 宣布 Seedream 5.0 Pro API 正式可用。该模型专注于设计场景,支持精确编辑、复杂信息可视化、逼真渲染和跨语言图像生成。其画质对标 GPT image 2 级别,可生成企业级视觉素材。同时 ListenHub 和 Cola 正在接入中。
推荐理由:BytePlus 上线了 Seedream 5.0 Pro API,画质和 GPT image 2 看齐,设计场景功能超实用,做图搞创意可以试试。
17:30
17:30Hunyuan@TXhunyuan
腾讯混元推出 Hy3,一个 295B 参数的 MoE 模型,支持 256K 上下文窗口。该模型针对编码、推理、智能体和可靠工具使用进行优化。即日起至 7 月 21 日,可通过 OpenRouter 免费使用,并可在 OpenClaw 中调用。
事件专题

推荐理由:腾讯新出的 Hy3 模型 295B 参数,256K 上下文,现在 OpenRouter 上免费到月底,编码和推理都很强,赶紧去试试。
16:00
16:00Genspark@genspark_ai
73°
SpaceXAI 发布 Grok 4.5,这是其首个专门针对编码和智能体任务训练的模型。该模型使用 Cursor 进行训练,在保持前沿智能水平的同时,实现了领先的速度和成本效率。目前 Grok 4.5 已在 Genspark AI Chat 中上线。
事件专题

推荐理由:SpaceXAI 出了个专门做编码和智能体的 Grok 4.5,用 Cursor 练的,速度又快又省钱,现在 Genspark 里就能用。
14:28
13:28
12:31
12:31Ethan Mollick@emollick
OpenAI 为新模型 GPT-5.6 开发了高质量自主任务基准 GDPval,但未公开该基准的测试结果。该基准旨在评估模型在困难任务上的自主能力,开发成本高昂。外部评论者指出 OpenAI 在指标讨论中回避关键数据,引发透明性质疑。
事件专题

推荐理由:OpenAI 自己搞了个硬核自主任务基准 GDPval,花了大钱,结果 GPT-5.6 的成绩藏起来了。背后有啥故事?不点进来看看?
12:28
12:02
11:59
11:59Sualeh Asif@sualehasif996
71°
SpaceXAI 发布了 Grok 4.5,在 GDPval-AA v2 基准上以 Elo 1543 排名第四,仅次于 Anthropic 的最新 Claude 版本。每个任务的成本为 0.49 美元,低于 GLM-5.2 和 Kimi K2.6,且比排名更高的模型便宜近 90%。该模型在性能与成本的帕累托前沿上表现突出。
事件专题

推荐理由:Grok 4.5 在代理知识工作基准上排第四,每个任务只要 49 美分,比前面的模型便宜 90%,性价比很能打。
11:46
11:46AI Will@FinanceYF5
93°
OpenAI 推出 GPT-Live,一款专为语音交互优化的新模型。该模型从今天起在 ChatGPT 中分阶段上线,旨在提升对话的流畅度与自然度。用户可通过声音与模型直接对话,体验更接近真人交流的交互方式。
事件专题

推荐理由:OpenAI 出了个专门的语音模型 GPT-Live,今天开始在 ChatGPT 里逐步推送,聊天能更自然了,试试开声音。
11:30
11:30官方账号Sam Altman@sama
Sam Altman 转发 dax 的推文,称 GPT-5.6 对团队产生了巨大影响,团队 Token 使用量达到以前的 5 倍。dax 表示 GPT-5.6 虽然不如 Fable 聪明,但极其可靠且使用体验愉快。这是 Altman 罕见地主动 hype 一个模型发布。
事件专题

推荐理由:Sam Altman 亲自夸 GPT-5.6 可靠又好用,团队用量翻了 5 倍,看看他为什么破例。
11:11
11:08
11:08小互@imxiaohu
87°
OpenAI 今起面向全球 ChatGPT 用户上线 GPT-Live-1 和 GPT-Live-1 mini 两个版本。Go、Plus、Pro 订阅用户默认使用 GPT-Live-1,Free 用户默认使用 GPT-Live-1 mini。两个版本均面向对话场景优化,具体性能参数未在公告中披露。
事件专题

推荐理由:OpenAI 今天直接上线了 GPT-Live-1 系列,付费用户和免费用户分成两个版本,想试试新模型的快去更新 ChatGPT。
09:44
09:44Cognition@cognition_labs
Cognition 推出 SWE-1.7 模型,基于 Kimi K2.7 基座并改进强化学习流程。其自研 FrontierCode 基准测试关注代码合并意愿,SWE-1.7 在该基准 Main 集上取得 42.3% 的分数,每个任务成本降至 1.97 美元,优化了成本-性能帕累托曲线。
事件专题

推荐理由:Cognition 新模型 SWE-1.7 基于 Kimi K2.7 用强化学习改进,FrontierCode 基准上 42.3% 分且每任务仅 1.97 美元,性价比突出。
08:53
08:53@koltregaskes@koltregaskes
83°
MiniMax计划在Q3开源代号M3 Pro的模型,参数量达2.7T,是当前旗舰M3(428B参数)的6倍多。新模型在复杂推理和多步任务上有显著提升。由于规模巨大,M3 Pro仅适合在专业基础设施上运行,无法在消费级硬件上实时使用。开源权重可供社区实验、微调或蒸馏更小模型。

推荐理由:MiniMax要开源2.7T参数的巨模型,比M3大六倍多,专攻复杂推理。虽然本地跑不动,但开源权重让研究者能动手玩,看看中国厂商怎么卷。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。