全部动态
Google 把 Gemini 3.8 Flash TTS 和 Flash-Lite TTS 开放进 AI Studio 和 API 了,能自定义声音、写剧本让两个角色对话,做配音的可以去试试。
OpenAI 拉了 80 多位心理医生做了个心理健康对话基准,GPT-6 Astra 考了 57.3 分,GPT-4o 只有 32.1,想看模型心理对话靠谱程度可以关注这套评测。
Anthropic 让 949 个 Claude 智能体自己跑 21 小时,扫了 19 亿蛋白簇,真挖出一个类似 CRISPR 的新酶系统,AI 做科研这回是真落地了。
OpenAI 给手机版 ChatGPT 加了语音智能体,Plus 和 Pro 用户能用 Work 页写文档、发邮件、总结 Slack 消息,还能建网站和幻灯片。
Anthropic 拿出湿实验室的首个成果,950 个 Claude agent 跑 21 小时真发现了一种噬菌体新酶,AI 做科学这事有实锤了。
OnSolo 出了个视频生成工具 Solo Video,一次能出 15 秒,主打开降低失败率,重试少花钱也少,比只拼时长的实在。
VoiceArena 搞了个 diarization 评测榜,12 款系统同题同规则比拼,还能看时间容差一变分数差多大,做语音的可以去看看。
有人分享了个后台小模型,发邮件或 Slack 消息前自动检查有没有违反公司政策,支持 Gmail 和 Teams,写错话之前先拦住你。
Google 官宣 Gemini 4 进入 post-training 了,初步版本很快就来,盯着 OpenAI 那边的朋友可以对照看看进度。
TSMC 拉上 Synopsys 和 Cadence,把 agentic AI 工具直接塞进先进制程的芯片设计流程,还带认证 UALink IP,做芯片的可以关注。
Uber 拿 500 辆现代 Ioniq 5 上路采数据,Nvidia 和 Wayve 都能用,自动驾驶训练数据又多了一条来源。
开源助理 OpenClaw 更新了,一次接入 Opus 5.5 和 GPT-6,还能记会议笔记、恢复中断任务,自己搭助理的可以看看。
Nous Research 给 Hermes 加了个桌面端,能实时看智能体操作浏览器和终端,输密码时还能随时接管,挺实用。
Anthropic 让约 950 个 Claude 智能体跑 21 小时,自己从 DNA 数据库里挖出一个类似 CRISPR 的新酶系统,还做了湿实验验证,很科幻的一条。
一个才 9.7 MB 的小适配器,挂在 Bonsai 2 27B 上就能去掉拒绝回答,MMLU 几乎不掉分,16 GB 的 MacBook 也能跑。
有人用 Codex 复刻了《是男人就下18层》联机版,从想法到上线全程记录,素材、音效、部署都是 AI 生成,流程很值得抄。
Anthropic 给 Claude Code 的 Projects 加了本地支持,threads 能直接跑在你自己电脑上,本地开发不用再连远端了。
Anthropic 工程师讲他们怎么用 Claude 给 claude.ai 提速 3 倍,连提示词都贴出来了,做性能优化的直接抄作业。
Emad 晒了 Stability AI 当年那台 4000 张 A100 的 Ezra 集群,全球前十,再看现在 8 个 B300 节点就接近它,算力迭代真快。
Zenith 用最便宜的 DeepSeek v4.1 Flash 打赢了 GPT 5.6 Sol,开源党可以看看它怎么做到的。
Epoch AI 搞了个叫 FAB 的新基准,让模型看宜家说明书加半成品照片找拼装错误,10 个月内最高分从 28% 冲到 80%。
CodeRabbit 出了个 Change Stack,能把一个 PR 的改动分层讲清楚,还告诉你影响范围,review 前先看它省不少劲。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档