全部动态
Fireworks 在 Kimi K3 上做了个减法:推理 token 少用 40% 但质量不掉,跑推理烧钱的朋友可以看看。
阿里把 Qwen3.8 Max 出了个高吞吐版 Prime,2.4T 参数、1M 上下文还能吃图和视频,已经能在 OpenRouter 直接调了。
Claude Opus 5.5 和 GPT-6 Sol 都上了 Arena,可以直接并排看两个模型的输出,还能自己上手测。
OpenRouter 让 8 个模型画同一张梗图,还把两个真人用户 P 进去,第二季 B 组投票开始了,去围观哪个模型最有梗。
Anthropic 的 Claude 在自家湿实验室里自己发现了一套类似 Crispr 的酶系统,公司拿它当 AI 做科研的第一个实绩,还赶在上市前公布。
OpenAI 新的 GPT-6 Sol 在真实用户投票的 Code Arena 拿了第4,价格只要 Claude Opus 5 的一半不到,做 Web 开发的可以看看分数再决定用哪个。
一个叫 Audio8 ASR Infinite 的流式语音识别开源了,能 7x24 无限时长转写不漂移,靠语义轮次检测解决长音频老毛病,做实时转写可以看看。
OpenAI 一次出了 GPT-6 Sol 和 Luna 两个模型,价格砍半还带新缓存,跑业务任务比 Claude Opus 5 便宜九成,做 API 应用的可以看看。
Anthropic 的新 Opus 5.5 比上一代便宜四成、快三成,写代码和文字水平赶上 Fable 5.1,挑模型时可以对比看看。
NVIDIA 开源了个说话人追踪模型,1秒语音就能分清谁在说话,还能让 Reachy Mini 机器人认人记名字,商用许可也友好。
Google 新出的 Gemini 3.8 Flash 语音模型,2000 多个音色支持 100 种语言,还能克隆声音,Hume 基准第一名。
Google 出了两个新 TTS 模型,Gemini 3.8 Flash TTS 和 Flash-Lite 版,语音更有表现力,去 AI Studio 就能试,做语音应用的可玩玩。
谷歌新出的两款 TTS 模型能逐行控制台词语气,还能用 30 秒录音复制声音,做播客有声书的朋友可以去 AI Studio 试试。
小米把 MiMo-V2.6 整套开源了,Pro 在智能体基准上打平 Claude Opus 5,本地跑前沿模型的门槛又降了。
OpenRouter 上新了个隐身模型 Space Bunny Alpha,100 万 token 上下文,能吃视频输入,推理速度还能调,快去试试是什么底子。
NVIDIA 的说话人分离模型拿了 Diarization-Bench 第一,错误率 14.72%,比第二名低了近四分之一,做语音相关应用的可以关注下。
NVIDIA 出了个 100M 参数的小模型,专门搞定多人说话分不清谁是谁的问题,8 人以内、说话重叠都能识别,已经上了 Hugging Face。
Anthropic 工程师亲口承认 Claude 新模型写得越来越怪,原因是训练偏重代码和数学,想写文案的可以看看 Opus 4.6 还是不是最优解。
小米把 1M 长上下文的预填充成本砍掉 5 倍,KV 缓存也小了 4.5 倍,跑智能体任务的人可以看看这套 HySparse 2 架构。
Latent Space 采访了 Radical Numerics 的 CEO,聊他们怎么用生物思维链和多模态感知做生物防御,还能设计新基因组,思路挺新鲜的。
阿里 Qwen 出了三个手机智能体,能规划任务、操作手机、一句话生图,还把测试基准开源了,做移动端 Agent 的可以看看。
Claude Opus 5.5 在 FrontierCode 编程基准上,思考档位调到 med 和 max 成绩差不多,还比 high 高,省钱党可以看下再选档位。
Step 5 Preview 刚发布,作者拿发动机动画和3D抓娃娃机两个任务实测它,和 GLM-5.3、DeepSeek-V4.1-Flash、GPT-5.6 Sol 逐项对比耗时和成品质量,比看跑分实在。
阿里 Qwen 把语音识别、合成、实时对话打包成五个模型一起发,ASR 最高打 0.5 折,做播客或有声书的可以试试 TTS-Next。
斑马智能在云栖大会发了端侧模型 AutoOmni 2.0-23B-A3B,参数 23B 只激活 3B,跑在车机这类终端上,关注智能座舱的可以看看。
蚂蚁百灵开源了两个 6B 的设计生图模型,能直接出 UI 和海报,还能把图拆成透明图层,评测里开源第一,OpenRouter 可免费试用两周。
科大讯飞发了 Spark-ASR-2.0,方言和嘈杂环境识别提升明显,成本只涨 10%,明天就能在讯飞输入法里用上。
Anthropic 的 Claude Opus 5.5 出来了,编程测试跑赢 Fable 5.1,API 价格还不到对方一半,付费用户限额也变宽了。
Alibaba 在 Apsara 2026 透露 Qwen4 正在训练,后续 Qwen4.5、Qwen5 要做到 5–10T 参数,用 Qwen 的可以关注下节奏。
Claude Opus 5.5 刚出就成了 AINews 的默认模型,OpenAI 的 GPT6 反而被抢了风头,各家还集体降价 40-50%,降价后入手正合适。
阿里这次一口气发了五款语音模型,方言识别和能自己生成配乐音效的 TTS-Next 都挺有意思,价格还砍了一波。
Anthropic 把 Claude Opus 5.5 发出来了,一天跑完 68 万行代码迁移,API 还降价到 8 折,缓存读取便宜了 60%,写代码的可以看看。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档