00:53lmarena.ai@lmarena_ai在视频编辑竞技场(Video Edit Arena)中,MiniMax-H3以1390分位列开源模型和总榜第一。它比第二、第三名的Dreamina Seedance 2.0和Gemini Omni Flash高出32分,比第四名HappyHorse 1.0高出83分。MiniMax官方已宣布该模型在Hugging Face上公开发布。AI模型MiniMax-H3MiniMax视频编辑2 个信源在谈事件专题推荐理由:MiniMax-H3登顶视频编辑榜,领先Seedance和Gemini 32分,已开源可下载。原文稍后读已读值得跟进有用关注 MiniMax-H3
00:25The Rundown AI@therundownaiGoogle DeepMind发布SL2T模型,将美国手语转成英语文本。该功能落地在Pixel 11的Gboard和Live Transcribe中,手语替代键盘打字。SL2T的测试者反馈,手语输入比英语打字更快。SL2T在Pixel 11上仅设备端追踪手、脸和身体关键点,视频不会被保留。项目由聋人谷歌员工Sam Sepah发起,并与聋人社群协作完成。AI模型SL2TPixel 11Google DeepMind4 个信源在谈事件专题推荐理由:Google DeepMind把手语变成了输入法,在Pixel 11上直接打手语就能发消息,比打字还快,聋人群体有福了。原文稍后读已读值得跟进有用关注 SL2T
23:56小互@imxiaohu72°DeepSeek 发布 V4-Pro 正式版,性能超过 Opus-4.8,接近 Fable 5。同时推出 Harness 插件系统,将计划模式、子 Agent、权限审批、MCP 等拆成可更换插件,Agent 主循环也可自定义。API 自 8 月 17 日零点起调整价格,采用峰谷两档,缓存命中输入价上涨 12 倍,输出价上涨 4.5 倍。AI模型DeepSeekDeepSeek-V4-ProDeepSeek Harness10 个信源在谈事件专题推荐理由:DeepSeek 一口气发了 V4-Pro 和可插拔的 Harness,还涨了 API 价,缓存命中输入暴增 12 倍,用之前看清楚价目表。原文稍后读已读值得跟进有用关注 DeepSeek
23:49lmarena.ai@lmarena_aiImage-to-Video Arena排行榜详情在arena.ai开放查看。该榜单汇集图像转视频模型的对比数据。用户可访问原文链接获取完整排名与评测结果。AI模型Image-to-Video Arenaarena.ai视频生成推荐理由:想给图生成视频选模型?直接去arena.ai看排行榜详情,谁强谁弱一目了然。原文稍后读已读值得跟进有用关注 Image-to-Video Arena
23:20lmarena.ai@lmarena_aiFLUX 3 Video的最新更新在Image-to-Video Arena拿到1453分,排名第五。这一分数排在Grok Imagine Video 1.5(1460分)与Gemini Omni Flash(1462分)之后。Black Forest Labs的FLUX 3 Video凭借这次更新进入该榜单前五。AI模型FLUX 3 VideoBlack Forest LabsImage-to-Video Arena推荐理由:BFL把FLUX 3 Video刷到第五,1453分,紧咬Grok和Gemini,做AI视频该看看。原文稍后读已读值得跟进有用关注 FLUX 3 Video
22:49LlamaIndex@llama_index精选ExtractBench测试了14个文档提取系统,使用1950年代监管文件、手填税表和手机拍摄等非数字化文档。Codex在扫描和手写场景准确率超93%,但处理旋转或纯图像页面时降至约80%。专用API表现相反,旋转和手写识别良好,扫描准确率为81%。Gemini 3.5 Flash从干净PDF的88.6%跌至扫描件的71.1%。LlamaIndex的Agentic Plus是唯一无盲区系统,在旋转、扫描和手写三项上分别达到95.9%、93.9%和93.8%。AI模型ExtractBenchCodexGemini 3.5 Flash1 个信源在谈事件专题推荐理由:LlamaIndex测了14个文档提取系统,Codex、Gemini在扫描件上都掉链子,只有Agentic Plus三项全在93%以上。原文稍后读已读值得跟进有用关注 ExtractBench
22:41向阳乔木@vista8一条推文给出了 DeepSeek 的 GitHub 地址,指向 github.com/deepseek-ai/de…。该链接指向 deepseek-ai 组织下的某个项目页面。推文未说明该项目名称与内容,需点击链接查看。AI模型deepseek-aiGitHub代码库推荐理由:DeepSeek 的 GitHub 链接出来了,想看看他们最近更新了什么代码,直接点进去就行。原文稍后读已读值得跟进有用关注 deepseek-ai
22:16向阳乔木@vista8DeepSeek 通过官方 GitHub 账号公开了仓库地址 github.com/deepseek-ai。该地址对应 DeepSeek 在 GitHub 上的组织页面,集中托管其开源项目。访问者可获取 DeepSeek 在 GitHub 上发布的代码与文档。AI模型DeepSeekGitHub开源模型推荐理由:DeepSeek 公开了官方 GitHub,可在这里直接看模型代码和文档。原文稍后读已读值得跟进有用关注 DeepSeek
21:45小互@imxiaohu据X平台用户@xiaohu发布的推文,DeepSeek V4 Pro版本因发错被撤回重发。该推文目前有9024次浏览、20次点赞和10条转评。这则关于DeepSeek V4 Pro的传闻目前仅有单条消息来源,未见官方说明。AI模型DeepSeek V4 ProDeepSeekX10 个信源在谈事件专题推荐理由:DeepSeek疑似手滑发错V4 Pro版本又撤回,想知道V4 Pro真面目和官方反应的,可以关注后续。原文稍后读已读值得跟进有用关注 DeepSeek V4 Pro
21:43LovartAI@lovart_aiMiniMax H3 视频模型正式上线 Lovart 平台。官方称它是全球排名第二的视频模型,生成成本不到同类产品的一半。该模型支持 15 秒电影级输出,并接受文本、图像、视频和音频四种模态的参考输入。在 Lovart 上,它可以保持角色、产品、场景和风格的一致性,适用于广告、MV 和 TVC 制作。AI模型MiniMax H3Lovart视频生成2 个信源在谈事件专题推荐理由:MiniMax H3 已经在 Lovart 上架了,15 秒视频只要一半成本,角色和场景还保持一致,做广告片可以试试。原文稍后读已读值得跟进有用关注 MiniMax H3
21:39小互@imxiaohu71°DeepSeek 发布 DeepSeek-V4-Pro,API 同步大幅涨价,官方称是为 DeepSeek-Harness 套餐让路。V4-Pro 支持 low/high/max 三档推理强度,分别面向简单任务、日常 Agent 工作流和复杂任务。模型原生兼容 OpenAI Responses API,可一键配置用于 Codex。V4 Pro 已上线 App/Web 的 Expert Mode,API 模型名称保持不变。AI模型DeepSeekDeepSeek-V4-ProAPI10 个信源在谈事件专题推荐理由:DeepSeek 突然给 V4 API 涨价,还发了 V4-Pro,推理强度分三档,能直接配 Codex 用。想升级 Agent 工作流可以看看。原文稍后读已读值得跟进有用关注 DeepSeek
21:10官方一手歸藏(guizang.ai)@op7418DeepSeek 在 Hugging Face 上公开了一个模型仓库,URL 指向 deepseek-ai 组织。AI 博主 op7418 在 X 平台分享了这一链接,目前该推文获得 1029 次浏览。模型的具体名称、参数量和基准成绩尚未在推文中透露。AI模型DeepSeekHugging Face开源模型推荐理由:DeepSeek 的仓库一般都会放权重,直接点链接看看这次是什么模型吧。原文稍后读已读值得跟进有用关注 DeepSeek
20:52shao__meng@shao__meng微信团队在 X 上发布 WeLM 大语言模型系列,包含 80B (A3B) 和 617B (A23B) 两个型号。其中 A3B 指激活 3B 参数,A23B 指激活 23B 参数,对应总参数规模为 80B 与 617B。WeLM 由 Weixin 团队打造,官方帖文强调其核心优势是资源效率,并以 X 作为首发渠道。AI模型WeLM微信MoE推荐理由:微信出了 WeLM,80B 和 617B 两个版本,主打省资源,激活参数只有 3B 和 23B。想省算力可以看看。原文稍后读已读值得跟进有用关注 WeLM
20:50shao__meng@shao__mengDeepSeek V4 Pro 今日低调发布。官方同步调整了 V4 Pro 和 V4 Flash 的 API 价格。具体涨幅和正式版 Benchmark 成绩见官方图表。AI模型DeepSeekV4 ProAPI价格推荐理由:DeepSeek V4 Pro 出来了,API 价格也变了,想了解涨价多少和性能表现,直接看官方图表吧。原文稍后读已读值得跟进有用关注 DeepSeek
20:46官方账号深度求索 DeepSeek@deepseek_aiDeepSeek-V4-Pro今日正式发布,主打Agent工作流的生产效率提升。V4-Pro与V4-Flash支持灵活推理努力调节,可针对简单任务、日常Agent工作流和复杂任务分别选择低、高、最大档位。新版本原生支持OpenAI Responses API,并针对Codex做了优化,可实现一键配置。模型名称保持不变,用户可通过应用或网页的Expert Mode体验,也可通过API调用。AI模型DeepSeekV4-ProCodex10 个信源在谈事件专题推荐理由:DeepSeek发V4-Pro了,Agent能力更强,还能按任务难度调推理档位,用Codex的可以直接一键接上。原文稍后读已读值得跟进有用关注 DeepSeek
20:27官方一手歸藏(guizang.ai)@op7418DeepSeek 正式发布 V4 Pro 0813 更新公告,并确认新定价。API 峰值时段 Pro 模型输出价格约为原来的 4 倍多,空闲时段提升约一倍多。此前该版本因更新日志缺失和 Artificial Analysis 得分异常引发争议。官方公告确认后,0813 模型状态明确。AI模型DeepSeekV4 ProAPI推荐理由:DeepSeek V4 Pro 0813 正式更新,峰值定价是原来的四倍多,用 API 的朋友注意钱包。原文稍后读已读值得跟进有用关注 DeepSeek
20:26官方一手歸藏(guizang.ai)@op7418V4 Pro 0813 正式更新公告发布,同时确定新定价。新方案采用峰谷定价,峰值时段 Pro 模型输出价格较原来上涨超过 4 倍。空闲时段 Pro 模型定价比原来贵一倍多。此前下午发布的 V4 Pro 0813 模型存在问题,本次为修正后的正式版。AI模型V4 Pro 0813峰谷定价模型定价推荐理由:V4 Pro 0813 正式版定了,峰值输出价格涨了 4 倍多,用之前先看下钱包。原文稍后读已读值得跟进有用关注 V4 Pro 0813
20:23官方一手歸藏(guizang.ai)@op7418Deepseek官方发布V4 Pro 0813正式更新公告,内测群称约晚上8:25上线。该版本修正了下午模型的问题。定价改为峰谷模式,峰值时段Pro模型输出价格比原版贵4倍多,空闲时段贵1倍多。AI模型DeepseekV4 Pro 0813峰谷定价推荐理由:Deepseek正式发了V4 Pro 0813,价格也定了,峰值输出贵4倍多,要调用的话得挑空闲时段。原文稍后读已读值得跟进有用关注 Deepseek
19:53向阳乔木@vista8精选71°DeepSeek正式发布V4-Pro版本。官方更新文档已在api-docs.deepseek.com上线。开发者可通过该文档查看模型详情与接口变更。AI模型DeepSeekV4-ProAPI推荐理由:DeepSeek的V4-Pro正式版来了,官方文档已更新,想用新模型的可以去看看接口说明。原文稍后读已读值得跟进有用关注 DeepSeek
19:43The Rundown AI@therundownaixAI 发布了 Grok 4.6 模型。The Rundown 提供了详细报道。Grok 4.6 是 Grok 系列的最新版本。AI模型Grok 4.6GrokxAI推荐理由:xAI 出了 Grok 4.6,The Rundown 有篇报道讲得挺清楚,想跟进新模型就点开看。原文稍后读已读值得跟进有用关注 Grok 4.6
19:41The Rundown AI@therundownai今天的AI头条包括SpaceXAI发布Grok 4.6并冲击前沿。Nate's Notebook讨论为何AI仍显笨拙。一个新工具可从客户评价中生成100条广告钩子。还有一条消息是一只接受AI癌症疫苗的狗如今创立了公司。AI模型Grok 4.6SpaceXAI模型发布推荐理由:Grok 4.6今天冒头,说是冲前沿;顺带还能看到用客户评价生成100条广告钩子的玩法,狗疫苗那条也很有意思。原文稍后读已读值得跟进有用关注 Grok 4.6
18:16官方账号NVIDIA AI@NVIDIAAI82°NVIDIA今日发布Nemotron 3.5,这是一款专为智能体AI系统中高吞吐量执行而设计的开源模型。Dream Security获得该模型的早期访问权限,其研究团队进行了监督微调、后训练、领域适配、网络安全推理和智能体工具使用等优化。该模型在Dream的内部网络安全基准测试中表现强劲,可帮助客户理解安全态势、调查风险并转化安全数据。相关发布博客已在开发者社区上线。AI模型NVIDIANemotron 3.5Dream Security10 个信源在谈事件专题推荐理由:NVIDIA出了新开源模型Nemotron 3.5,专为智能体场景打造,Dream Security抢先调教成了网络安全专用版,内部测试表现不错。原文稍后读已读值得跟进有用关注 NVIDIA
18:15OpenRouter@OpenRouterAIDeepSeek V4 Pro 0813已在OpenRouter平台上线。相比V4 Pro Preview,新版在DeepSWE基准上得分62.7,提升49.9分;CyberGym得分83.3,提升30.6分;NL2Repo得分61.5,提升23.0分;Terminal Bench 2.1得分87.9,提升15.8分。更多服务提供商即将接入该模型。AI模型DeepSeekV4 ProOpenRouter推荐理由:DeepSeek把V4 Pro的智能体能力一口气拉高了,DeepSWE涨了快50分,写代码和操作终端都更顶了,现在就能在OpenRouter上直接用。原文稍后读已读值得跟进有用关注 DeepSeek
18:15官方账号NVIDIA AI@NVIDIAAI精选英伟达发布Nemotron 3.5 Lightning,一款30B参数的MoE模型,活跃参数仅3B。该模型由Nemotron 3 Ultra蒸馏而来,现已上线Fireworks平台。它在PinchBench上表现强劲,并在AA-Omniscience非幻觉测试中获得顶尖分数。模型专为高吞吐智能体工作流设计,强调可靠性与专精化。AI模型NemotronFireworksNVIDIA10 个信源在谈事件专题推荐理由:想做智能体又怕模型太贵太慢?Nemotron 3.5 Lightning只有3B活跃参数,在Fireworks上直接就能调。原文稍后读已读值得跟进有用关注 Nemotron
18:15官方账号NVIDIA AI@NVIDIAAI72°AgileRL 宣布与 NVIDIA 合作,支持 Nemotron 系列模型的后训练。NVIDIA 提前提供了 30B3A 参数 MoE 模型 Nemotron 3.5 Lightning。在 Arena 平台上,该模型经微调后在长程推理和真实客服任务上超过 Claude Sonnet 5。单次训练只需四块 H100 GPU 运行六小时即可掌握推理任务,上下文长度超过 50,000 token。Arena 客户可在 Nemotron 模型发布后立即获得相应的训练与评估环境。AI模型NemotronNVIDIAAgileRL10 个信源在谈事件专题推荐理由:AgileRL 把 Nemotron 3.5 Lightning 放到 Arena 上微调,6 小时就能超过 Claude Sonnet 5,训练完权重还归你。原文稍后读已读值得跟进有用关注 Nemotron
18:14官方账号NVIDIA AI@NVIDIAAI72°NVIDIA Nemotron 3.5 Lightning 已在 Baseten 上线,定位为长时运行智能体设计。相比同类开源模型,其吞吐量提升 4 倍,成本降低 50%。在生产测试中,输出 token 数量减少 63.4%。该模型采用 30B MoE 架构,仅激活 3B 参数,支持 100 万 token 上下文。AI模型NVIDIANemotron 3.5 LightningBaseten10 个信源在谈事件专题推荐理由:跑长时任务的智能体注意了,Nemotron 3.5 Lightning 上线 Baseten,吞吐翻 4 倍、成本砍半,输出还更精简。原文稍后读已读值得跟进有用关注 NVIDIA
18:14向阳乔木@vista8精选DeepSeek-V4-Pro-0813 已发布,命名日期为 8 月 13 日。百万 tokens 输入缓存命中价 0.025 元,未命中价 3 元,输出价 6 元。对比 Flash 版本,各项价格分别高出 0.005 元、2 元和 4 元。并发限制为 500,明显低于 Flash 的 2500。官方提示当前价格将在近期上涨。AI模型DeepSeekV4-Pro-0813Flash推荐理由:DeepSeek出了V4-Pro-0813,价格比Flash贵不少,并发限制500也更低,想用的话注意近期要涨价。原文稍后读已读值得跟进有用关注 DeepSeek
18:13Aman Sanger@amanrsangerxAI宣布推出Grok 4.6,称其具备前沿智能,较Grok 4.5有显著改进,且定价不变。官方推文标题提到“1.5T”,暗示这是一个1.5万亿参数级别的大型模型。推文同时称后续会有比Grok 4.6更大、更强的模型,但未给出具体版本号。AI模型Grok 4.6GrokxAI推荐理由:Grok 4.6来了,比4.5强不少,价格没变,底子是1.5T,想尝鲜的可以看原推。原文稍后读已读值得跟进有用关注 Grok 4.6
18:13AI SDK@aisdkSpaceXAI发布Grok 4.6,称其达到前沿智能水平。相比Grok 4.5,Grok 4.6有显著改进,且定价保持不变。开发者可通过AI SDK在应用中集成Grok 4.6。AI模型Grok 4.6Grok 4.5SpaceXAI推荐理由:SpaceXAI刚发Grok 4.6,能接AI SDK,跟4.5同价但更强,搞开发的可以试试。原文稍后读已读值得跟进有用关注 Grok 4.6
18:13OpenRouter@OpenRouterAI精选72°xAI 的 Grok 4.6 已上线 OpenRouter,相比 Grok 4.5 有明显提升。在 GPDVal-AA V2 基准上,Grok 4.6 超过其他前沿模型。定价保持每百万输入 2 美元、输出 6 美元。开发者现可通过 openrouter.ai/x-ai/grok-4.6 调用。AI模型GrokOpenRouterxAI推荐理由:Grok 4.6 在 OpenRouter 上线,基准超其他前沿模型,价格还是 2 进 6 出,想试就直接用。原文稍后读已读值得跟进有用关注 Grok
18:12官方一手歸藏(guizang.ai)@op7418X用户NIK(@ns123abc)发帖称,DeepSeek没有在社交媒体上为新模型V4 Pro做过任何发布公告。NIK认为DeepSeek不官宣是因为对V4 Pro的成绩不满,其得分只比V4 Flash高1分。帖子中给出的分数来源指向一条被引用的推文,但未注明具体测试基准。截至发稿,DeepSeek官方账号没有对V4 Pro进行任何说明。AI模型DeepSeekV4 ProV4 Flash推荐理由:DeepSeek V4 Pro被NIK爆料没官宣,分数只比V4 Flash高1分,官方没回应,详情见引用推文。原文稍后读已读值得跟进有用关注 DeepSeek
18:11官方一手歸藏(guizang.ai)@op7418精选DeepSeek V4 Pro 的 0831 版本在 API 模型列表中显示为 0813,但更新日志页面没有任何对应记录。官网原本标注“DeepSeek V4 Pro 更新正式版”的横幅已被撤下。模型文档与更新日志版本不一致,且官方没有发布公众号文章或公告。Artificial Analysis 的测试中,V4 Pro 正式版仅比 V4 Flash 高 1 分,几乎持平。作者认为这让熬夜等待测试的用户感到困惑和被戏弄。AI模型DeepSeekV4 ProV4 Flash推荐理由:DeepSeek 悄悄改了 V4 Pro 版本号,但更新日志和公告都没跟上,连跑分也只比 V4 Flash 高 1 分,想确认是不是撤了模型的可以看看这个讨论。原文稍后读已读值得跟进有用关注 DeepSeek
18:11orange.ai@oran_geDeepSeek V4 Pro正式版评测表现一般,性能仅比DeepSeek V4 Flash高1分。用户因此质疑V4 Pro的升级幅度。推文还称V4 Pro涨价的可能性降低。消息来自X用户oran_ge。AI模型DeepSeekV4 ProV4 Flash推荐理由:DeepSeek V4 Pro正式版被曝比V4 Flash只强1分,涨价还可能取消,买之前建议先看看这条。原文稍后读已读值得跟进有用关注 DeepSeek
18:10elvis@omarsar0Grok 4.6正式发布,官方称其具备前沿智能。相比Grok 4.5,性能显著提升,但价格维持不变。原推文对Grok 4.6能否媲美Fable 5的质量表示不确定。目前官方未公布具体基准测试数据。AI模型Grok 4.6Grok 4.5SpaceXAI推荐理由:哎,Grok 4.6出来了,说比4.5强不少,价格没变。到底能不能打Fable 5还不清楚,先观望下。原文稍后读已读值得跟进有用关注 Grok 4.6
18:10向阳乔木@vista8腾讯旗下有混元和WeLM两个大语言模型。WeLM由微信团队构建,是一个大语言模型家族。该模型以资源效率为核心设计目标。腾讯官方在X平台通过微信账号介绍了WeLM。AI模型腾讯微信WeLM推荐理由:微信团队自己做了个WeLM大模型,主打资源效率,跟混元是腾讯的两个大模型,来了解下吧。原文稍后读已读值得跟进有用关注 腾讯
18:10Mustafa Suleyman@mustafasuleyman微软AI负责人Mustafa Suleyman在X上发布推文,公开了MAI Thinking的试用链接aka.ms/mai-thinking-1。该推文目前获得2条回复、1次转发和12个赞,但已有2395次查看。从命名看,MAI Thinking可能是微软面向推理场景推出的模型。用户可直接通过链接体验,无需等待排队。具体能力和基准成绩尚未公布。AI模型MAI ThinkingMicrosoftMustafa Suleyman推荐理由:微软AI老大亲自甩了个体验链接,MAI Thinking听着像推理模型,想抢先试的直接点。原文稍后读已读值得跟进有用关注 MAI Thinking
18:10The Rundown AI@therundownaiSpaceXAI发布了Grok 4.6。该模型在智能、编码和智能体任务等基准上接近或达到Fable和5.6-Sol的水平。定价明显低于同类前沿模型。AI模型Grok 4.6SpaceXAIFable推荐理由:Grok 4.6跑分追上Fable和5.6-Sol,价格还便宜不少,可以关注下。原文稍后读已读值得跟进有用关注 Grok 4.6
18:10Fireworks AI@FireworksAI_HQ精选Qwen3.8-2.4T-A95B 已在 Fireworks 平台上线,提供 Day-0 支持。该模型采用 2.4T 参数 MoE 架构,专为自主智能体、重度编码和大上下文窗口设计。Fireworks 表示它适合编码和智能体任务,开发者现在即可开始使用。AI模型Qwen3.8-2.4T-A95BFireworks智能体推荐理由:Fireworks 上线了 Qwen3.8-2.4T-A95B,2.4T 参数 MoE,主打智能体和写代码,有 Day-0 支持,直接就能用。原文稍后读已读值得跟进有用关注 Qwen3.8-2.4T-A95B
18:10向阳乔木@vista8DeepSeek V4 Pro在未开启思考模式下,按提示词“鹈鹕骑自行车svg,撞上大象,循环播放”生成动画。测试动画中鹈鹕骑自行车撞上大象并循环播放,说明模型能理解多物体交互和循环指令。该模型名为DeepSeek-V4-Pro-0813,百万tokens输入(缓存未命中)定价3元,输出定价6元,均高于DeepSeek Flash的1元和2元。其并发限制为500,低于DeepSeek Flash的2500。AI模型DeepSeekDeepSeek V4 Pro视频生成10 个信源在谈事件专题推荐理由:DeepSeek V4 Pro不开思考模式就能按提示词生成鹈鹕撞大象的SVG动画,效果挺逗,价格和限流也都摸清了,来看看。原文稍后读已读值得跟进有用关注 DeepSeek
18:09Sualeh Asif@sualehasif996SpaceXAI 发布 Grok 4.6,定位前沿智能水平的日常驱动模型。官方称其相较 Grok 4.5 有显著进步,且保持相同定价。目前未公布具体基准成绩,但强调这是值得日常使用的升级版本。AI模型GrokSpaceXAI推理模型推荐理由:Grok 4.6 来了,官方说比 4.5 强不少还同价,日常用着应该更顺手。原文稍后读已读值得跟进有用关注 Grok