7月6日
19:36
12:24
12:24elvis@omarsar0
Fable 5 在 Three.js 环境下的 3D 模拟生成任务中表现突出,被评价为目前最擅长此任务的 LLM。该模型可与 OpenAI 的 gpt-realtime-2 结合,用于生成交互式教育 3D 世界。相关演示由 dair_ai 团队发布。
事件专题

推荐理由:看看这个帖子,Fable 5 用 Three.js 生成 3D 世界超强,还能和实时语音模型搭配做教育场景。
11:00
11:00Geek@geekbb
精选
小红书团队开源了一个高效长上下文LLM服务框架。该框架通过注意力头分类和分段式KV缓存策略,将长上下文大模型推理的预填充FLOPs降低约50%-70%。同时保持接近无损的精度。代码已在GitHub上开源。
推荐理由:小红书开源了一个长上下文LLM推理框架,用注意力头分类和分段缓存把预填充算力省掉一半多,精度基本没损失,适合超长文本场景。
7月5日
23:27
08:34
08:34AI Will@FinanceYF5
用户 Nicolas Bustamante 测试 Claude Fable 5,发现该模型能根据模糊提示一次性生成逼真的埃菲尔铁塔代码。他多次评估后认为 Fable 5 是特殊模型,擅长从模糊描述完成一次生成。该模型在代码生成任务中表现出色。
事件专题

推荐理由:Anthropic 的 Claude Fable 5 回来了,能从一句话就写出埃菲尔铁塔代码,一次成型不用改,写代码神器。
04:25
04:25lmarena.ai@lmarena_ai
Claude Fable 5 模型再次亮相,@petergostev 对其进行了 60 多项最难 3D 生成任务测试,涵盖现代城市、艺术品、世界奇观等。结果显示 Fable 在 3D 生成质量上明显领先其他模型。相关视频已发布在 YouTube 上,详细展示了测试对比。
事件专题

推荐理由:Anthropic 的 Claude Fable 5 在 3D 生成上又刷屏了,60 多项测试全拿下,效果比之前强很多,值得一看。
03:03
03:03lmarena.ai@lmarena_ai
Fable 5模型重回LMSys Chatbot Arena,官方发布了一段蒙太奇视频,展示多个测试prompts。用户可以在Battle Mode和Agent Mode中直接体验该模型。官方排行榜分数即将公布,供社区参考。
事件专题

推荐理由:Fable 5又回Arena了,还加了Agent模式,想自己动手测测看?直接去Battle Mode里玩,官方排名马上出。
7月4日
10:25
06:36
06:36Ethan Mollick@emollick
用户反复要求Claude Fable将游戏做得更“AAA”,Claude Fable响应升级了图形、增加了Boss战、改进了游戏机制并加入了自定义音效和配乐。最终游戏达到了WebGL渲染的技术极限。这个实验展示了Claude Fable在游戏生成方面的能力边界。

推荐理由:有人让Claude Fable不断把游戏改得更华丽,结果它一路升级画面、Boss战和音效,直到撑爆WebGL,挺有意思。
01:36
01:36lmarena.ai@lmarena_ai
Anthropic重新部署的模型在Arena上通过Fable 5测试集,涉及60多项复杂3D生成、小游戏和世界构建任务。该模型由@petergostev进行评测,结果展示在YouTube视频中。测试覆盖了高难度3D场景生成和交互式世界构建。
事件专题

推荐理由:Anthropic的模型又升级了,一口气通过了60多项3D生成和世界构建测试,挺能打的。
01:02
01:02官方账号MIT CSAIL@MIT_CSAIL
MIT CSAIL提出Masked IRL方法,利用LLM解决机器人面对模糊指令的问题。该方法包含两个模型:一个用于澄清用户提示,另一个忽略无关信息。这使机器人能更准确执行含糊不清的任务如'把那个东西放好'。

推荐理由:机器人终于能听懂'把那个东西放好'这种模糊话了。MIT的Masked IRL用LLM先理清意图再干活,挺实用。
7月3日
23:34
23:34@koltregaskes@koltregaskes
OpenAI 的 Codex 代码中出现了 Sol、Tera、Luna 三个新模型名称,暗示 GPT-5.6 可能即将发布。这些名称与先前传闻中的模型代号一致,但目前仍在隐藏状态。外界推测 GPT-5.6 可能带来推理能力提升,并将与现有模型形成产品线区分。
事件专题

推荐理由:OpenAI 的新模型可能很快就要来了,代码里已经出现了三个新名字,看看是不是 GPT-5.6 的前奏。
18:40
18:40AI Will@FinanceYF5
Claude Fable 5 成功在 Godot 游戏引擎中创建了一个蜘蛛侠荡网游戏。与 GPT-5.5 相比,Fable 5 在 Godot 代码生成中产生的错误显著更少。该演示展示了 Fable 5 在游戏开发场景中的编程能力。
事件专题

推荐理由:Claude Fable 5 能把蜘蛛侠荡网变成可玩的 Godot 游戏,而且比 GPT-5.5 少出不少错,做游戏可以试试它。
16:06
16:06AI Will@FinanceYF5
同一prompt和航班数据,分别让Sonnet 5和Fable 5写单文件HTML做3D地球。Sonnet 5花0.1美元,输出悬浮连线地球;Fable 5花0.77美元,包含海洋、冰盖、光晕等细节。价格相差7倍,但Fable 5的视觉完成度远超Sonnet 5。
事件专题

推荐理由:想看这两个模型写代码的差距?Fable 5多花7倍钱,但画出的地球像真的,Sonnet 5的就像个线框球。
15:45
15:45官方账号vLLM@vllm_project
74°
Qwen3-Omni采用多模态Thinker与Talker(Code2Wav)流水线架构。高并发下仅复制语音阶段,复用Thinker结果,首音频延迟从约6秒降至0.6秒。吞吐量在同GPU上提升5.4倍,语音生成快于实时。该优化由阿里、蚂蚁集团SCT团队和vLLM-Omni团队共同实现。

推荐理由:阿里和蚂蚁团队搞了个优化,Qwen3-Omni实时对话延迟从6秒降到0.6秒,吞吐还翻了5倍多,推荐看技术博客。
11:15
11:12
11:01
11:01官方账号Epoch AI@EpochAIResearch
73°
2026年6月,21家知名组织披露约1500个高危和严重CVE,是Claude Mythos Preview发布前月纪录的3.5倍以上。该数据由Epoch AI Research发布。AI正规模化发现软件漏洞,安全态势或面临变革。

推荐理由:Epoch AI数据显示,Claude Mythos预览版让漏洞发现量狂飙3.5倍,AI挖洞能力被实锤了。
10:59
10:58
10:58官方账号Epoch AI@EpochAIResearch
Epoch AI Research 推出新基准 EBR-bench,专门测量 AI 的实时学习(on-the-fly learning)能力。AI 反复玩一款名为 Earthborne Rangers 的高难度棋盘游戏,并尝试从错误中学习。截至目前,AI 未显示出任何改进迹象。
事件专题

推荐理由:Epoch AI 搞了个新基准 EBR-bench,专门看 AI 能不能边玩边学,结果 Earthborne Rangers 这游戏 AI 完全没进步,挺有意思的。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。