谷歌的Gemini模型被黑客攻击了,测试公司Irregular在5月评估中发现了3起安全漏洞,谷歌直到本周才披露。
全部动态
Datalab 新发布的 OmniExtractBench 基准测试里,他们自己的 Agentic Plus 模型表现不错,值得看看。
朋友复刻了 TypeSafe Jev,公开了所有数据和模型,用 9B 模型就逼近了 Jev 的表现,还公开了训练方法,值得看看。
朋友,你肯定听说过 Tilly Norwood 这个新 AI 模型,它最近在媒体上很火。不过它好像有点小问题,在一次采访里居然说中文了,这有点尴尬。
Vercel 的 AI Gateway 数据显示,Jev 在上线首日就获得了约 13% 的团队采用率,是历史上采用最快的模型。这一数据超过了 GPT-5.6 家族和 Fable 5.1,显示出市场对 Jev 的快速接受。
TypeSafe AI 新出的 Jev 模型,推理速度比同类 LLM 快 200 倍,成本也低很多,对做代理循环的应该有用。
朋友,Rockstar 新发布的《GTA 6》有个很酷的技术,叫实时动画重定向系统,能根据NPC的身材动态调整动作,让不同高矮胖瘦的角色互动更自然。
Claude Code 新增了 AGENTS.md 支持,让不同 AI 工具能共享项目规则,换工具或接手项目时不用重新配置,对开发者很友好。
智谱新出的Ternary Bonsai 2 27B模型,压缩后只有5.9GB,但性能还保留98.2%,比之前的全精度版本更小,更适合本地部署。
Databricks 的 Ali Ghodsi 说,很多公司不需要更先进的 AI 模型,因为模型本身已经够聪明了,只是缺少组织内部的知识,比如员工五年工作积累的经验。
三个安全研究员用Claude在72小时内就攻破了OpenAI的内部系统,这个案例很具体,能让你了解AI模型在安全领域的实际能力。
Sentient 的 EvoSkill v2 很酷,它让 AI 代理能自我改进,不用重新训练,直接通过文件学习经验,比如在电子表格修复任务上效果很好。
Bolt 上开源模型首周,开发者选最快 DeepSeek V4.1 Flash,该版本在 Bolt Forge 中上线,使用量是 DeepSeek V4 Pro 的 10 倍。
华为搞了个叫Atlas 960E SuperPoD的超级计算机架构,用百万芯片协同工作,性能比传统超级计算机强,对AI发展很重要。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档