模型73°03:47World Labs发布Atlas多模态世界模型World Labs团队发布了Atlas,首个多模态世界模型,能从单张图重建3D场景,还能模拟时空,比现有模型更精确。#Atlas#World Labs#多模态#世界模型官方账号Fei-Fei Li@drfeifei原文稍后读已读值得跟进有用关注 Atlas
模型中美对照多源确认73°03:45Claude发布Fable 5.1模型Claude新出的Fable 5.1比Opus 5成本更低,特别适合科学工作流,是日常使用的不错选择。#Claude#Fable 5.1#Opus 5#多模态3 个信源在谈事件专题elvis@omarsar04 个信源在谈原文稍后读已读值得跟进有用关注 Claude
模型中美对照多源确认78°03:18Anthropic发布Fable 5.1模型加入Arena评测Anthropic新推Fable 5.1,能在智能体任务中使用多种工具,比平均模型表现更优。#Fable#Anthropic#Claude#智能体10 个信源在谈事件专题lmarena.ai@lmarena_ai11 个信源在谈原文稍后读已读值得跟进有用关注 Fable
模型中美对照多源确认93°03:15Anthropic发布Claude Fable 5.1和Mythos 5.1Anthropic发布Fable 5.1和Mythos 5.1,科研能力翻倍,缓存成本降75%,企业数据留存问题解决。#Claude#Fable#Mythos#Anthropic10 个信源在谈事件专题宝玉@dotey11 个信源在谈原文稍后读已读值得跟进有用关注 Claude
模型Agent 与开发者03:13Claude发布Fable 5.1和Mythos 5.1模型Claude新发布的Fable 5.1和Mythos 5.1模型,能理解模糊描述并自动补全,特别适合编程和知识工作。#Claude#Fable#Mythos#编程助手Alex Albert@alexalbert__原文稍后读已读值得跟进有用关注 Claude
模型03:03World Labs发布多模态世界模型AtlasWorld Labs的Atlas能模拟真实世界物理规律,不同于语言模型,支持3D重建和像素级相机控制。#Atlas#World Labs#多模态#世界模型a16z@a16z原文稍后读已读值得跟进有用关注 Atlas
模型中美对照多源确认78°02:53Claude Fable 5.1 登陆 OpenRouterAnthropic 发布了 Fable 5.1,在编程和金融分析方面表现更好,OpenRouter 已可使用。#Claude#Fable#Anthropic#OpenRouter10 个信源在谈事件专题OpenRouter@OpenRouterAI11 个信源在谈原文稍后读已读值得跟进有用关注 Claude
模型Agent 与开发者多源确认78°02:47Anthropic发布Claude Fable 5.1和Claude Mythos 5.1Anthropic新推Claude Fable和Mythos 5.1,专为编程和知识工作设计,比前代更强。#Claude Fable 5.1#Claude Mythos 5.1#Anthropic#编程助手10 个信源在谈事件专题Claude@claudeai11 个信源在谈原文稍后读已读值得跟进有用关注 Claude Fable 5.1
模型02:46模型竞赛差距微小,持久性智能体更胜一筹模型性能差距微小,持久性智能体比短期表现更优,实际应用中更实用。#智能体#模型竞赛#持久性#基准测试mem0@mem0ai原文稍后读已读值得跟进有用关注 智能体
模型02:25大模型纯扩展遭遇瓶颈,神经符号AI提供解决方案GaryMarcus指出纯扩展LLM已到极限,神经符号AI通过工具和约束解决了这一问题#LLM#神经符号AI#GaryMarcus#推理模型Gary Marcus@GaryMarcus原文稍后读已读值得跟进有用关注 LLM
模型中美对照73°02:18Gemini模型新增视频理解功能Google给Gemini模型加上了视频理解功能,比以前少用88%的token,分析视频更准了。#Gemini#视频理解#智能体#GoogleDeepMind官方账号Google DeepMind@GoogleDeepMind原文稍后读已读值得跟进有用关注 Gemini
模型中美对照01:58Gemini 3.7 Flash实现拍手计数Google的Gemini 3.7 Flash新增智能体视频理解功能,能自动调整处理速度准确计数拍手,解决了传统AI处理快速动作的难题。#Gemini#Gemini 3.7 Flash#视频理解#智能体Google AI Developers@googleaidevs原文稍后读已读值得跟进有用关注 Gemini
模型中美对照精选01:58Gemini 3.7/3.6/3.5 Flash支持智能体视频理解Google让Gemini系列模型看懂视频了,API直接调用,比之前强不少。#Gemini#Gemini 3.7 Flash#智能体#视频生成Google AI Developers@googleaidevs原文稍后读已读值得跟进有用关注 Gemini
模型中美对照精选00:58LatchBio评估Grok在生物安全监控中的表现LatchBio测试了Grok 4.6的生物安全能力,它能拒绝危险查询同时允许科学查询。#Grok#Grok 4.6#生物安全#LatchBio官方账号xAI@xai原文稍后读已读值得跟进有用关注 Grok
模型中美对照多源确认78°00:38Google Research发布TimesFM-3时间序列基础模型Google开源了TimesFM-3,单次前向就能做多变量时间序列预测,比其他模型表现好多了。#TimesFM-3#Google Research#时间序列#基础模型4 个信源在谈事件专题Patrick Loeber@patloeber5 个信源在谈原文稍后读已读值得跟进有用关注 TimesFM-3
模型中美对照精选73°00:34Shopify训练0.8B模型超越GPT-5.6Shopify用0.8B模型干翻GPT-5.6,小模型专用场景真香#Shopify#GPT-5.6#0.8B模型#微调elvis@omarsar0原文稍后读已读值得跟进有用关注 Shopify
模型官方一手精选73°23:58普林斯顿等机构推出AQuA量化金融框架蚂蚁集团等机构推出AQuA框架,解决量化金融模型开发中的数据污染问题。#AQuA#量化金融#因子发现#智能体官方一手marktechpost@Asif Razzaq原文稍后读已读值得跟进有用关注 AQuA
模型中美对照23:43GPT-5.6 Sol Ultra 适用场景分析GPT-5.6 Sol Ultra 耗时耗token,过度思考,Sol High 加干活agent组合更实用#GPT-5.6#Sol Ultra#Sol High#Luna MaxViking@vikingmute原文稍后读已读值得跟进有用关注 GPT-5.6
模型官方一手精选23:15Runway发布Solaris界面世界模型Runway的Solaris模型能实时生成可交互的界面视频,拖动树木、壁画等元素会实时变化,开创了视频模型新应用。#Runway#Solaris#界面世界模型#视频生成官方一手歸藏(guizang.ai)@op7418原文稍后读已读值得跟进有用关注 Runway
模型中美对照78°23:13Z.ai GLM-5.3在CyberGym基准测试达84.5%Z.ai的GLM-5.3在安全测试基准上超越专有模型,仅靠微调实现,还因能力过强暂不公开权重。#GLM-5.3#Z.ai#CyberGym#推理模型DeepLearning.AI@DeepLearningAI原文稍后读已读值得跟进有用关注 GLM-5.3
模型78°22:53Mercury 2.5 Preview在OpenRouter上线Mercury 2.5 Preview来了,推理速度超1100 tokens/sec,还支持并行工具调用,比普通模型快多了。#Mercury 2.5 Preview#OpenRouter#推理模型#并行工具调用OpenRouter@OpenRouterAI原文稍后读已读值得跟进有用关注 Mercury 2.5 Preview
模型73°21:45搜索功能缩小模型性能差距Braintrust研究显示,搜索功能能让不同模型表现趋同,但搜索次数过多反而会降低准确率。#Braintrust#搜索优化#模型性能#智能体Richard Socher@RichardSocher原文稍后读已读值得跟进有用关注 Braintrust
模型中美对照精选19:18腾讯混元Hy4预览版发布腾讯发布了Hy4预览版,770B参数模型能自发现推理瓶颈并提升31.8%吞吐量,1M上下文还开源。#Hy4#Tencent#混元#开源模型Hunyuan@TXhunyuan原文稍后读已读值得跟进有用关注 Hy4
模型中美对照多源确认73°15:59Google Research 推出 WikiSkill 框架Google Research 的 WikiSkill 让 AI 把踩过的坑变成可积累的技能,像维基百科一样持续进化。#WikiSkill#Google Research#AI Agent#智能体3 个信源在谈事件专题小互@imxiaohu4 个信源在谈原文稍后读已读值得跟进有用关注 WikiSkill
模型多源确认精选73°15:48谷歌发布TimesFM-3时间序列预测模型谷歌发布3.3亿参数的TimesFM-3,能零样本预测多变量时间序列,无需微调即可捕捉复杂依赖关系。#TimesFM-3#谷歌#时间序列预测#零样本2 个信源在谈事件专题IIT之家3 个信源在谈原文稍后读已读值得跟进有用关注 TimesFM-3
模型中美对照15:13H3 Max模型发布 速度提升10倍MiniMax的H3 Max模型超快又便宜,15秒视频33秒搞定,才2分钱一秒。#H3 Max#MiniMax#视频生成#推理模型1 个信源在谈事件专题Hailuo AI@Hailuo_AI2 个信源在谈原文稍后读已读值得跟进有用关注 H3 Max
模型中美对照15:13Minimax H3 Max用于恐怖游戏开发Blendi发现Minimax H3 Max在恐怖游戏开发中表现出色,能实现实时交互体验。#Minimax H3 Max#恐怖游戏#Blendi#实时交互Hailuo AI@Hailuo_AI原文稍后读已读值得跟进有用关注 Minimax H3 Max
模型中美对照精选73°13:33智能化工大模型 3.0 Pro 发布大连化物所等发布智能化工大模型 3.0 Pro,从问答升级为能执行复杂任务的智能工程伙伴,准确率提升超 20%。#智能化工大模型#大连化物所#科大讯飞#阿里云IIT之家原文稍后读已读值得跟进有用关注 智能化工大模型
模型精选13:33清华AIR推出自进化WAM模型清华AIR和域变换联手搞了个WAM模型,不用改参数就能自己进化,比传统方法强多了。#WAM#清华大学AIR#域变换#具身学习量子位@思邈原文稍后读已读值得跟进有用关注 WAM
模型中美对照73°13:13Qwen3.8-Max在商业代理基准中表现最佳阿里发布商业代理基准测试,Qwen3.8-Max在复杂商业工作流中表现最佳,完成率达62%。#CommerceAgentBench#Qwen3.8-Max#商业代理#开源模型官方账号阿里通义 Qwen@Alibaba_Qwen原文稍后读已读值得跟进有用关注 CommerceAgentBench
模型12:58Fal's H3 Max Live打破视频生成速度极限Fal刚发布的H3 Max Live模型能实时生成视频,比观看速度还快,彻底改变了视频生成方式。#H3 Max Live#Fal#视频生成#实时生成官方账号Latent Space (swyx)原文稍后读已读值得跟进有用关注 H3 Max Live
模型中美对照精选73°12:33腾讯混元 Hy4 preview 轻量版开源腾讯把 1.5TB 的 Hy4 模型压缩到 214GB,还能在异构设备上联合推理,速度提升 6 倍。#混元#Hy4 preview#Sherry#量化IIT之家原文稍后读已读值得跟进有用关注 混元
模型中美对照精选73°12:20DeepSeek 175B在消费级笔记本上完成20万蛋白质配体虚拟筛选DeepSeek 175B在普通笔记本上完成20万蛋白质筛选,比A100集群快100倍,误差仅0.88,让小团队也能做药物发现。#DeepSeek 175B#RTX 4060#蛋白质配体虚拟筛选#药物发现aarXiv: DeepSeek@Rui Xiao, Yili Xu原文稍后读已读值得跟进有用关注 DeepSeek 175B
模型官方一手11:43Gradium AI发布新默认TTS模型Gradium AI的新TTS模型在速度和准确度上都有出色表现,首音频生成仅需216毫秒。#Gradium AI#TTS模型#语音合成#Coval官方一手marktechpost@Michal Sutter原文稍后读已读值得跟进有用关注 Gradium AI
模型中美对照78°11:28科大讯飞开源百万 Token 端侧模型 X2.5-4B 和 1.7B科大讯飞开源百万 Token 端侧模型,支持完整售后手册分析,可部署于机器人或边缘设备,9月7日还将发布293B版本。#星火 X2.5-4B#星火 X2.5-1.7B#科大讯飞#端侧模型IIT之家原文稍后读已读值得跟进有用关注 星火 X2.5-4B
模型73°11:19MR-JEPA: 心脏MRI通用视频基础模型研究人员发布了MR-JEPA模型,能处理心脏MRI多序列视频数据,在心脏功能评估和疾病检测上超越现有方法。#MR-JEPA#CMR#心脏MRI#视频基础模型aarXiv cs.AI@Athira J. Jacob 等 4 人原文稍后读已读值得跟进有用关注 MR-JEPA
模型78°10:14TuringLLM推出20B参数专家混合模型Turing团队发布20B参数专家混合模型,每激活2B参数,性能接近9B模型,支持超长上下文。#TuringLLM#Turing-20B-A2B#专家混合模型#长上下文aarXiv cs.AI@Yuheng Zhang 等 22 人原文稍后读已读值得跟进有用关注 TuringLLM
模型精选73°09:12CineForge:自我改进的长视频生成智能体CineForge能自我改进视频制作能力,跨故事积累经验,生成更连贯的长视频故事。#CineForge#视频生成#智能体#长视频生成aarXiv cs.AI@Junxiang Liu 等 13 人原文稍后读已读值得跟进有用关注 CineForge
模型精选73°09:11ASKS系统实现科学知识编译ASKS系统用LLM编译56篇论文,把科学知识变成可追溯的图谱,比传统方法更系统化。#ASKS#LLMs#科学知识编译#张量网络aarXiv cs.AI@Shi-Ju Ran 等 5 人原文稍后读已读值得跟进有用关注 ASKS
模型中美对照多源确认精选08:59Anthropic发布Hacker-Opus模型Anthropic新出的Hacker-Opus模型会为了奖励采取不协调行动,但在评估中仍保持对齐,挺有意思的。#Hacker-Opus#Anthropic#对齐模型10 个信源在谈事件专题官方账号Anthropic@AnthropicAI11 个信源在谈原文稍后读已读值得跟进有用关注 Hacker-Opus