7月9日
08:02
08:02官方一手marktechpost@Michal Sutter
SpaceXAI推出Grok 4.5,该模型使用Cursor进行训练,专为编程、智能体任务和知识工作设计。推理速度达80 TPS,成本为每百万输入token $2、输出token $6。在Harvey法律智能体基准测试中排名第一。
事件专题

推荐理由:Grok 4.5用Cursor训练,编程和智能体任务表现强,法律基准第一,性价比不错。
03:39
03:19
03:19官方一手NVIDIA AI Blog@Adel El Hallak
精选
NVIDIA Nemotron 3 Ultra 在 LangChain 的 Deep Agents 框架上取得开放模型最高准确率。它完成更多任务且吞吐量更高,运行速度提升10倍。其成本低于顶级闭源模型。这使得 Nemotron 3 Ultra 成为构建 AI 智能体的高性价比选择。
事件专题

推荐理由:NVIDIA 的 Nemotron 3 Ultra 和 LangChain 合作,以更低成本跑出比闭源模型快10倍的成绩,做智能体首选。
03:16
03:16官方账号Decoder@Matthias Bastian
精选
xAI发布Grok 4.5,模型基于数万块Nvidia GB300 GPU训练。在编码基准上,Grok 4.5落后于Fable 5和GPT-5.5,但相比Opus 4.8,token消耗减少4.2倍。Grok 4.5定价每百万输入token仅2美元,远低于竞品。欧盟市场预计7月中旬可用。
事件专题

推荐理由:Grok 4.5每百万token才2美元,编码虽不如Fable 5但便宜到可以忽略差距,性价比碾压。
02:18
02:18官方账号OpenAI@OpenAI (@OpenAI)
73°
OpenAI 推出 GPT-Live 语音模型,专为提升人机交互自然度而设计。该模型即日起在 ChatGPT 中逐步上线,支持更流畅的对话体验。官方演示视频展示了其逼真的语音响应和情感表达能力。推文获得超 5200 次点赞和 34 万次观看。
事件专题

推荐理由:OpenAI 出了个新语音模型 GPT-Live,今天就能在 ChatGPT 里用,说话更自然更像真人,快去试试吧
02:16
02:16官方一手marktechpost@Michal Sutter
73°
OpenAI 推出新一代语音模型 GPT-Live 和 GPT-Live-1 mini,用于 ChatGPT Voice。GPT-Live 采用全双工架构,能够同时听和说。该模型将搜索与推理任务委托给 GPT-5.5 处理。GPT-Live-1 mini 是轻量版本。
事件专题

推荐理由:OpenAI 用 GPT-Live 把语音交互做到实时全双工,还能让 GPT-5.5 处理复杂推理,听说是你聊天的好帮手。
01:04
7月8日
22:25
22:25量子位@思邈
RoboDojo新基准测试发布,人类表现100分,最强AI模型仅获12.8分。该基准包含200个具身智能任务,覆盖抓取、导航、操作等场景。当前模型在长时序任务和细粒度控制上明显落后于人类。测试揭示了机器人在泛化能力和物理交互方面的核心瓶颈。
推荐理由:RoboDojo这个新基准把人类和模型放到同一考场,人类满分100,最强模型才12.8,差距大到离谱,值得看看模型到底在哪栽跟头。
20:57
19:31
19:31官方账号Decoder@Maximilian Schreiner
71°
Meta旗下Superintelligence Labs推出首个图像生成模型Muse Image。该模型类似OpenAI的GPT Image 2,能通过代码执行和网页搜索等工具自主优化生成结果。其@-mention功能允许用户基于他人公开的Instagram照片生成图像,无需对方同意。这种opt-out模式可能违反GDPR和欧盟AI法案。技术亮点与隐私争议并存。
事件专题

推荐理由:Meta新出的Muse Image能像GPT Image 2一样调用工具自动改图,但争议点在于它能拿你Insta照片生成别人头像,隐私风险很大。
18:19
18:19量子位@思邈
精选
智源研究院提出悟界·Orca方法,改变大模型训练顺序,先让模型学习世界动态变化规律。该方法旨在避免AI直接进入任务执行。相关论文入选Hugging Face论文月榜第一。
推荐理由:智源搞了个新训练法Orca,不让AI一上来就干杂活,先学世界怎么变。论文上了Hugging Face月榜第一,值得看看他们的思路。
17:16
16:07
16:07官方账号Decoder@Matthias Bastian
91°
OpenAI 将于周四推出 GPT-5.6,此前因美国政府要求额外测试而延迟。该模型代号 Sol,在编码基准上以约一半的成本超越 Anthropic 的 Claude Mythos 5。目前尚无模型审批的绑定标准。
事件专题

推荐理由:OpenAI 的 GPT-5.6 来了,代号 Sol,编码能力比 Claude Mythos 5 强,成本还低一半,值得看看。
14:43
14:43IT之家博客/媒体
71°
马斯克确认 SpaceXAI 将于当地时间 7 月 8 日或 9 日向公众开放 Grok 4.5 模型。该模型基于 1.5T 参数的 V9 基础模型,补充训练中加入了 Cursor 数据。声称对标 Anthropic Opus 级别,速度更快、Token 效率更高、成本更低。
事件专题

推荐理由:马斯克说 SpaceXAI 明天就放 Grok 4.5 了,对标 Opus 还更快更省钱,想尝鲜的可以关注。
10:16
10:16官方一手pandaily@contact@pandaily.com (Pandaily)
字节跳动的 Seedance 2.0 成为中国首个在视频生成领域占主导地位的模型,毛利率达 70-90%。该模型在多个基准测试中超越竞品,包括在 VideoBench 上领先 15% 以上。Seedance 2.0 改变了 AI 商业模式,通过高效的训练和推理架构实现了高利润率。其成功也标志着中国视频生成技术在全球竞争中的转折点。
事件专题

推荐理由:字节跳动这个视频模型毛利率能到90%,比很多软件公司还赚钱,而且技术上领先竞品一大截,值得一看它是怎么做到的。
08:54
08:54官方一手marktechpost@Asif Razzaq
NVIDIA发布了Nemotron-Labs-Audex-30B-A3B(Audex)模型,这是一个混合专家(MoE)架构,统一了音频理解、语音识别、翻译、文本转语音和音频生成五种能力。该模型以Nemotron-Cascade-2为骨干,仅在音频任务上产生边际的性能回归。Audex在30B总参数中仅有3B活跃参数,高效实现了多模态融合。
事件专题

推荐理由:NVIDIA发了款新模型Audex,能同时搞定音频理解、语音识别、翻译、TTS和音频生成,而且几乎没牺牲原有文本模型的性能。
08:49
06:21
02:09
02:09官方账号Decoder@Matthias Bastian
Cohere发布了开源模型Transcribe Arabic,拥有20亿参数,专为阿拉伯语方言、代码切换和阿拉伯语-英语双语语音识别优化。该模型在多项测试中性能超过Whisper和OmniASR。模型已上传至Hugging Face,采用Apache 2.0许可证。

推荐理由:Cohere搞了个阿拉伯语语音模型,20亿参数,专门对付方言和双语,据说比Whisper还牛,搞语音识别的快试试。