00:16Genspark@genspark_aiGenspark发布一项对比实验,用同一平台构建了两个AI智能体,分别由ChatGPT和Claude驱动。两个智能体需要从零开始经营真实的柠檬水摊,包括设计摊位、采购材料并落地执行。实验目标是在一天内赚到100美元,全程被拍摄成视频发布在YouTube。该测试旨在观察不同大模型在真实商业场景中的自主决策与执行能力。AI模型GensparkChatGPTClaude1 个信源在谈事件专题推荐理由:Genspark让ChatGPT和Claude各自开柠檬水摊,一天赚100美元,看哪个AI真会做生意。原文稍后读已读值得跟进有用关注 Genspark
00:13lmarena.ai@lmarena_ai82°Claude Opus 5 (Max)在Fullstack Code Arena获得1699分,排名第一。它还同时登顶Frontend Code Arena和开启事实性检查的Text Arena。默认推理强度的Claude Opus 5在Frontend Code Arena排第三,落后于Kimi K3。官方称Max的1699分仍是初步结果,可能还会变化。AI模型Claude Opus 5AnthropicFullstack Code Arena10 个信源在谈事件专题推荐理由:Anthropic新出的Claude Opus 5(Max)把代码榜刷到第一,1699分,前端和文本也登顶,这波挺猛。原文稍后读已读值得跟进有用关注 Claude Opus 5
15:12小互@imxiaohu字节跳动推出原生音视频全双工模型SeedRealtime,对标OpenAI的GPT Live。该模型支持同时处理摄像头画面、语音输入和语音输出,实现实时视频对话。在四人聚餐场景中,模型能识别用户逐一介绍的人物,并在多人讨论中持续区分说话者身份。目前该能力已集成到豆包应用,用户可直接体验实时语音视频聊天。AI模型SeedRealtime字节跳动豆包10 个信源在谈事件专题推荐理由:字节发了SeedRealtime,能一边看你手机摄像头画面一边听你说话一边回你,豆包里直接用,跟GPT Live一个路子。原文稍后读已读值得跟进有用关注 SeedRealtime
12:32官方账号阿里通义 Qwen@Alibaba_QwenQwen-Image-3.0-Pro现已上线fal平台。该模型可渲染复杂、密集的文字排版。它能保留面部特征和身份等关键细节的同时进行修改。支持物体编辑、风格迁移和背景更换。AI模型Qwen-Image-3.0-ProfalQwen推荐理由:Qwen图像模型上线fal,能搞定复杂文字、保留人脸身份,物体编辑和换背景都行,快去玩。原文稍后读已读值得跟进有用关注 Qwen-Image-3.0-Pro
12:24Geek@geekbb75°VulcanBench 用 23 个真实软件工程任务评测模型,Qwen3.8-Max 跑完全套成本 126.25 美元,DeepSeek V4-Flash 仅需 13.60 美元。Qwen3.8-Max 每个任务耗时 20-25 分钟,是测试中最慢的模型,固定预算下最佳设置只排中游,默认设置垫底。六个原本能解决的任务贡献了 26 分降幅的 83%,其中三个得分直接归零。在准确率上 Grok 4.5 领先,按每美元准确率 DeepSeek V4-Flash 很难被击败。AI模型VulcanBenchQwen3.8-MaxDeepSeek V4-Flash7 个信源在谈事件专题推荐理由:VulcanBench 实测:Qwen3.8-Max 跑一趟 126 美元,DeepSeek V4-Flash 只要 13.6 美元,便宜 10 倍还更快。选性价比就 DeepSeek,选准确率就 Grok 4.5。原文稍后读已读值得跟进有用关注 VulcanBench
11:50Hunyuan@TXhunyuan腾讯混元发布 Hy3 模型,已接入 WorkBuddy 全球版。WorkBuddy 用户可免费使用至 2026 年 8 月 31 日(太平洋时间)。Hy3 支持研究、数据分析、文档与演示文稿生成,以及职场沟通处理。该模型还通过腾讯设计 Miora 和腾讯云 TokenHub 提供。AI模型Hy3WorkBuddy腾讯混元1 个信源在谈事件专题推荐理由:腾讯混元把 Hy3 放进 WorkBuddy,能分析数据、写文档、做 PPT,全球免费到 2026 年 8 月底。原文稍后读已读值得跟进有用关注 Hy3
11:28官方账号阿里通义 Qwen@Alibaba_Qwen71°Qwen-Image-3.0-Pro已在Qwen Cloud上线。该模型在Text-to-Image Arena中排名中文模型第一、主流模型第二。它支持4.5k-token超长提示词,可一次生成报纸、试卷等复杂版面,文字小至10px仍清晰可读。模型支持12种语言和100多种艺术风格,并兼具生成与编辑能力。API价格最低为每张图0.04美元。AI模型Qwen-Image-3.0-ProQwen Cloud图像生成推荐理由:阿里新出的Qwen-Image-3.0-Pro,生成文字特别清晰,能处理超长提示,一张图0.04美元起,做海报、试卷都合适。原文稍后读已读值得跟进有用关注 Qwen-Image-3.0-Pro
11:27官方账号阿里通义 Qwen@Alibaba_QwenQwen3.8-Max在Image-to-WebDev Arena中以1,631分位列第二。这个基准测试考察模型将截图转化为网页代码的能力。目前榜首是Claude Opus 5 (Max),领先Qwen3.8-Max 39分。阿里巴巴官方账号发布了这一排名消息。AI模型Qwen3.8-MaxImage-to-WebDev ArenaClaude Opus 51 个信源在谈事件专题推荐理由:阿里新出的Qwen3.8-Max看图写网页排第二,只比第一的Claude Opus 5少39分,挺牛的。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
10:41Genspark@genspark_ai76°Black Forest Labs发布Flux 3视频模型,现已集成至Genspark AI Video Agent。该模型支持原生音频、文生视频、图生视频和视频续写,可生成多语言对话内容。输出规格最高20秒、1080p分辨率,并提供Draft模式以降低探索成本。2K、4K及开放权重版本计划后续推出。AI模型Flux 3GensparkBlack Forest Labs6 个信源在谈事件专题推荐理由:黑森林家的Flux 3视频模型来了,Genspark里直接用,带原生音频,最长20秒1080p,还能多语言对话,快去试试。原文稍后读已读值得跟进有用关注 Flux 3
09:44lmarena.ai@lmarena_ai82°Qwen3.8-Max在Image-to-WebDev Arena以1631分排名第二,仅落后Claude Opus 5(Max)39分。该模型拥有2.4T参数,支持10天以上自主编码开发,可完成500+轮芯片设计优化。官方宣布下周开源Qwen3.8-Max和Qwen3.8-27B权重。API定价为输入每百万token 2美元、输出6美元。AI模型Qwen3.8-MaxAlibabaQwen1 个信源在谈事件专题推荐理由:阿里这波可以啊,Qwen3.8-Max网页开发跑分第二,只比Claude Opus 5低39分,下周开源就能玩。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
09:38lmarena.ai@lmarena_ai精选DeepSeek-V4-Flash-20260731 (High)在Agent Arena中排名第21,净改进+1.98%,在开源模型中位列第3,基于12.5K次真实智能体会话。该模型每次任务的中位成本为0.024美元,低于GPT-5.6 Luna (xHigh)的0.026美元,但高于DeepSeek-V4-Pro (Thinking)的0.020美元。在各项信号中,Confirmed Success得分+6.99%,而Steerability为-2.31%。其排名比DeepSeek-V4-Pro高6位,比之前的DeepSeek-V4-Flash高13位。AI模型DeepSeek-V4-FlashAgent ArenaGPT-5.6 Luna9 个信源在谈事件专题推荐理由:DeepSeek新模型V4-Flash跑Agent任务每单只要0.024美元,比GPT-5.6 Luna还便宜,性价比很能打。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash
08:17官方账号NVIDIA AI@NVIDIAAI72°Mistral发布了Shieldstral,一款3B参数的开放权重内容安全模型。该模型支持设备端部署,可在本地完成内容安全检测。Mistral在官方公告中介绍了这一模型。AI模型MistralShieldstral内容安全3 个信源在谈事件专题推荐理由:Mistral新出了3B的开放权重安全模型Shieldstral,能直接装设备上跑内容过滤,轻量又实用,看看它怎么做的。原文稍后读已读值得跟进有用关注 Mistral
08:02ollama@ollama精选Ollama宣布DeepSeek-V4-Flash-0731成为其有史以来token使用量增长最快的模型。Ollama正在美国和欧洲扩展该模型的服务器容量。该模型在Ollama上运行速度超过100tps,并且零数据保留。用户的数据完全归自己所有,可通过ollama run deepseek-v4-flash:0731-cloud命令直接使用。AI模型DeepSeek-V4-Flash-0731OllamaDeepSeek推荐理由:DeepSeek-V4-Flash-0731在Ollama上跑得超快,100tps+,还零数据留存,一条命令就能上手,试试呗。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-0731
05:12eric zakariasson@ericzakariasson精选72°Cursor宣布开源Mixture-of-Kittens (MoK),这是一个面向NVL72的MoE训练megakernel。MoK将专家混合的所有通信与计算融合进单个确定性内核,相比最强公开基线提速最高2.37倍。该内核专为NVL72集群设计,用于提升大规模MoE训练效率。AI模型CursorMoKNVL722 个信源在谈事件专题推荐理由:Cursor开源了MoK内核,把MoE训练的通信和计算合成一个内核,跑得比公开基线快2.37倍,搞NVL72训练的可以看看。原文稍后读已读值得跟进有用关注 Cursor
03:16OpenRouter@OpenRouterAIBlack Forest Labs 的 FLUX 3 Video 现已面向所有用户开放,可通过 OpenRouter 平台调用。该模型采用统一架构联合训练,支持视频、音频、图像和动作预测四类任务。官方称其兼顾写实、创意与电影感,适合多种创作场景。AI模型FLUX 3Black Forest LabsOpenRouter5 个信源在谈事件专题推荐理由:黑森林家的 FLUX 3 Video 上 OpenRouter 了,一个模型能生成视频、音频、图像还能做动作预测,想试试直接调 API 就行。原文稍后读已读值得跟进有用关注 FLUX 3
03:16OpenRouter@OpenRouterAIFLUX 3 是 Black Forest Labs 推出的新一代模型。FLUX 3 新增了真实世界接地、多样风格、多语言对话和智能体链式调用。FLUX 3 可以扩展任意视频,并保持运动、取景和场景逻辑的连贯性。目前该模型已通过 OpenRouter 平台开放使用。AI模型FLUX 3Black Forest LabsOpenRouter5 个信源在谈事件专题推荐理由:FLUX 3 来了,能扩任意视频还保持镜头逻辑,风格多还支持多语言对话,OpenRouter 上直接就能用。原文稍后读已读值得跟进有用关注 FLUX 3
03:02Justine Moore@venturetwinsBlack Forest Labs 推出 FLUX 3,支持原生音频、文本转视频、多帧图像转视频和视频延续功能。该模型可生成最长 20 秒、原生 1080p 的视频,并支持多语言对话。FLUX 3 提供 Draft 模式,以更低成本快速探索创意。模型现已通过 API 提供,2K、4K 版本和开放权重即将推出。AI模型FLUX 3Black Forest Labs视频生成5 个信源在谈事件专题推荐理由:想玩视频生成的话,FLUX 3 刚上线,能直出带音频的 20 秒 1080p 视频,还有草稿模式省算力,快去试试。原文稍后读已读值得跟进有用关注 FLUX 3
02:35Replicate@replicate71°Black Forest Labs发布FLUX 3 Video,现已在Replicate平台上线。该模型为多模态,支持视频、音频、图像和动作预测,本次主要发布视频生成能力。支持文本生成视频、多帧图像生成视频、视频续写及多种语言对话,并带原生音频。视频时长最高20秒,分辨率达1080p,同时提供Draft模式降低探索成本。官方称后续将推出2K、4K分辨率版本和开放权重。AI模型FLUX 3 VideoBlack Forest LabsReplicate推荐理由:Black Forest Labs出了FLUX 3 Video,能生成20秒1080p带原生音频的视频,还能多帧图生视频,在Replicate上就能试。原文稍后读已读值得跟进有用关注 FLUX 3 Video
01:55Gary Marcus@GaryMarcusGary Marcus对Astra的推断有了新证据:他在周末指出,单领域专长不等于其他领域也擅长,Astra写作可能不如解题。Ben Golub回应称,Astra相关文稿的写作低于最佳实践,AI模型在写作和心智理论上还有提升空间。Refine预告将发布相关报告。AI模型AstraRefineGary Marcus2 个信源在谈事件专题推荐理由:Gary Marcus说Astra写作不如解题,Ben Golub同意,Refine要发报告。原文稍后读已读值得跟进有用关注 Astra
01:54官方账号Mistral AI@MistralAI精选MistralAI 发布了一款新的内容审核模型,可将审核政策以自然语言问题形式输入,并返回校准后的审核分数。该模型同时支持文本和图像,通过统一接口处理多模态内容。相关技术报告已发布在 arxiv 上,编号为 2607.25857。模型目标是让审核策略更灵活、可解释,同时保持评分一致性。AI模型MistralAI内容审核多模态推荐理由:把审核规则写成大白话问题,Mistral 这个模型就能给校准分数,图文通吃。想研究的直接看 arxiv。原文稍后读已读值得跟进有用关注 MistralAI
01:52官方账号Mistral AI@MistralAI精选76°Mistral发布Shieldstral,这是一款30亿参数的开源权重内容安全模型。该模型专为检测有害内容设计,可部署在手机等终端设备上。Shieldstral权重完全开放,开发者能在本地运行并集成到应用中。端侧部署意味着审核可在设备本地完成,减少对云端的依赖。AI模型MistralShieldstral内容安全3 个信源在谈事件专题推荐理由:Mistral出了个3B的开源内容安全模型,能直接在手机上跑,适合做本地内容审核。原文稍后读已读值得跟进有用关注 Mistral
01:35官方账号阿里通义 Qwen@Alibaba_QwenQwen-Image-3.0-Pro进入Text-to-Image Arena第5名,得分1263。对比上代Qwen-Image-2.0-Pro的1191分,分数提升72分。排名从第15跃升至第5,分类表现也全面改善。AI模型Qwen-Image-3.0-ProQwen-Image-2.0-ProAlibaba_Qwen推荐理由:阿里的Qwen-Image-3.0-Pro在文生图竞技场排第五了,比上代涨了72分,进步挺大。原文稍后读已读值得跟进有用关注 Qwen-Image-3.0-Pro
01:32官方账号Cursor@cursor_ai精选Cursor 宣布其 MoK 方案已投入训练任务,覆盖数万张 GPU。相比此前基于 DeepEP 的技术栈,端到端训练吞吐提升至 1.41 倍。MoK 已在生产环境验证,用于 Cursor 的大规模训练基础设施。AI模型MoKCursorDeepEP2 个信源在谈事件专题推荐理由:Cursor 说 MoK 已在数万 GPU 上跑生产,比旧 DeepEP 栈端到端快 1.41 倍,搞大规模训练的可以看。原文稍后读已读值得跟进有用关注 MoK
01:29官方账号阿里通义 Qwen@Alibaba_Qwen精选阿里通义千问发布的最新模型 Qwen3.8-Max 已集成到 Nous Research 的 Hermes Agent 中。用户执行 hermes update 即可使用,并可享受 20% 折扣。该模型面向智能体开发场景,可直接在 Agent 工作流中调用。AI模型Qwen3.8-MaxHermes AgentNous Research推荐理由:Qwen3.8-Max 现在在 Hermes Agent 里能用了,还打八折,一条命令就能上手,赶紧试试。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
01:16Gary Marcus@GaryMarcus76°Gary Marcus在推文中回应关于Astra与AGI的质疑。他提到OpenAI下一代模型Astra在数学和理论计算机科学领域产出10项新结果。他认为这代表模型开始创造真正的新知识,符合AGI第四级“创新者”的部分定义。该讨论源于对OpenAI真实AGI进展的猜测。AI模型OpenAIAstraGary Marcus9 个信源在谈事件专题推荐理由:Gary Marcus说OpenAI的Astra拿出10项数学新成果,或够AGI四级创新者,聊?原文稍后读已读值得跟进有用关注 OpenAI
01:14lmarena.ai@lmarena_ai71°Qwen-Image-3.0-Pro 在 Text-to-Image Arena 拿到 1263 分,排名第 5,而上一代 Qwen-Image-2.0-Pro 是 1191 分、第 15 名。新模型支持 4.5k token 的提示词,可一次生成报纸、试卷、3×3 信息图等复杂版式。官方称文字渲染可小到 10px,还能生成完整 LaTeX 论文页面和接近照片级的皮肤纹理。Qwen-Image-3.0 原生支持 12 种语言和 100 多种艺术风格,并接入实时网页检索。AI模型Qwen-Image-3.0QwenText-to-Image Arena推荐理由:Qwen 图像模型 3.0 来了,Pro 版在竞技场排第 5,能直接生成报纸和试卷,文字细节很能打,可以上手试试。原文稍后读已读值得跟进有用关注 Qwen-Image-3.0
00:39Fireworks AI@FireworksAI_HQ72°Fireworks AI发布K3模型,称其为世界首个3万亿参数级别的开放前沿模型。K3可在Fireworks平台上运行、训练并投入实际应用。官方将于太平洋时间8月4日上午10点举办网络研讨会,由jamesr66a和Prof_OZ主讲,演示具体操作。AI模型K3Fireworks AI开放模型推荐理由:Fireworks AI说K3是首个3万亿参数的开放模型,能跑能训练。8月4号上午10点有直播演示,可以去听。原文稍后读已读值得跟进有用关注 K3
23:41lmarena.ai@lmarena_ai74°Agent Arena 使用数百万个真实世界长程智能体任务评测模型。模型获得网页搜索、文件系统和终端工具,完成写代码、制作幻灯片、网络研究、构建应用和分析文档等工作流。评测采用因果追踪方法衡量模型的净改进,即相对平均模型提升结果的程度。完整排行榜见 arena.ai/leaderboard/ag…。AI模型Agent Arena智能体模型评测推荐理由:想知道哪个模型最能搞定真实长任务?Agent Arena 用几百万个任务跑分,还给模型上网、文件、终端工具,比谁净提升大。原文稍后读已读值得跟进有用关注 Agent Arena
23:40lmarena.ai@lmarena_ai精选LMArena 公布 DeepSeek-V4-Flash-20260731(High) 的五项关键信号。总体得分上升 1.98%,确认成功项提升 6.99%,好评对差评比增加 1.54%。可引导性下降 2.31%,Bash 恢复得分 2.53%,工具幻觉率 1.2%。数据来自竞技场真实用户反馈。AI模型DeepSeekDeepSeek-V4-FlashLMArena7 个信源在谈事件专题推荐理由:想知道 DeepSeek 最新版行不行?看这五个真实用户信号,总体涨近2%,确认成功涨7%,但可引导性跌了。原文稍后读已读值得跟进有用关注 DeepSeek
23:39lmarena.ai@lmarena_ai精选DeepSeek 发布 DeepSeek-V4-Flash-20260731(High)版本,在 Agent Arena 综合排名第 21,净提升 +1.98%,开源模型中位列第 3。该成绩基于 12.5K 次真实智能体会话评估,比 DeepSeek-V4-Pro 高 6 位(-0.47%),比上一代 V4-Flash 高 13 位(-2.81%)。分项信号中 Confirmed Success 达到 +6.99%,而 Steerability 为 -2.31%。官方 API 同步开放公开测试,原生支持 Responses API 格式,并已适配 Codex。AI模型DeepSeek-V4-FlashAgent Arena智能体9 个信源在谈事件专题推荐理由:DeepSeek 新模型在 Agent Arena 排开源第三,API 上线且支持 Codex,做智能体可以试试。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash
21:38Hailuo AI@Hailuo_AIMiniMax-H3 模型已上线 Hugging Face,面向公众开放。开发者可通过 platform.minimax.io 调用 API,中国区用户则使用 platform.minimaxi.com。普通用户可以在 hailuoai.video 或 hailuoai.com 直接体验网页版,桌面端还提供了 hub.minimax.io 客户端。AI模型MiniMax-H3MiniMaxHugging Face6 个信源在谈事件专题推荐理由:MiniMax 发布了 H3 模型,权重在 Hugging Face 上,还能用 API 和网页版直接体验,上手门槛很低。原文稍后读已读值得跟进有用关注 MiniMax-H3
21:26官方账号Microsoft Research@MSFTResearch精选微软研究院发布PRISM2,一个在病理图像和真实病理报告上训练的多模态基础模型。它通过简单的问答交互,在多个基准任务上达到与专用癌症检测系统相当的水平。PRISM2不需要为每个任务单独训练一个模型。这种训练方式让AI从临床对话中直接学习病理知识。AI模型PRISM2Microsoft Research病理学推荐理由:微软研究院新出PRISM2,拿病理图像和真实报告训练,靠问答就能在多个癌症检测基准上追平专用系统,不用再为每个任务造单独模型。原文稍后读已读值得跟进有用关注 PRISM2
19:38Hunyuan@TXhunyuan腾讯混元发布Hy ASR 3.0预览版,基于Hy3语言大脑将语音识别与语义理解融合。该模型在通用识别、上下文感知、多场景鲁棒性和方言覆盖等维度表现领先。官方公布多语言词错误率(WER)约为3%,能将嘈杂的真实世界音频转换成干净连贯的文本,并准确捕捉说话者意图。AI模型Hy ASR 3.0腾讯混元Hy3推荐理由:腾讯混元出了Hy ASR 3.0,多语言WER约3%,嘈杂音频也能转成干净文字,还懂方言。原文稍后读已读值得跟进有用关注 Hy ASR 3.0
17:10Geek@geekbbOpenCode Go 被列为热门模型,热度集中。OpenCode Go 的热度使得其他模型显得无关紧要。OpenCode Go 在热门模型中有明显优势。AI模型OpenCode GoOpenCode编程助手推荐理由:OpenCode Go 现在火得不行,其他模型都不用看了,写代码用它就对了。原文稍后读已读值得跟进有用关注 OpenCode Go
13:35Hailuo AI@Hailuo_AIMiniMax H3 展示了单次生成视频的能力,仅凭一句提示词“Jim and Dwight from The Office discuss autonomous coding agents”便输出对应画面。演示片段中两位《办公室》角色围绕自主编码智能体展开对话,场景与人物神态连贯。目前官方未公布具体基准分数,效果以演示视频为准。AI模型MiniMax H3视频生成多模态6 个信源在谈事件专题推荐理由:MiniMax H3 不用多步迭代,一句 prompt 就能生成情景对话视频,直接看片源最有说服力。原文稍后读已读值得跟进有用关注 MiniMax H3
12:45AI Will@FinanceYF5有用户只给 Seedance 2.5 一张 Rare Beauty 睫毛膏产品照,便生成了一段网红试用视频。视频中 Rare Beauty 睫毛膏外观与真实产品一致,上妆动作也符合实际用法。美妆广告中常见的产品变形和动作失真问题,在这条 Seedance 2.5 生成的片段中并未出现。AI模型Seedance 2.5Rare Beauty视频生成2 个信源在谈事件专题推荐理由:只给一张产品照,Seedance 2.5 就能生成看不出破绽的试妆视频,美妆广告可以省一大笔拍摄费了。原文稍后读已读值得跟进有用关注 Seedance 2.5
12:42Hailuo AI@Hailuo_AIHailuo AI 转发了一条用户演示,展示 MiniMax H3 模型对动物角色的口型同步能力。用户录制了贝斯伴奏和人声歌词,生成了鸭嘴兽人与爬行动物女人跟随节奏唱歌的视频。该模型能针对非人类面部结构生成匹配的口型。演示视频在推特上获得 568 次浏览。AI模型MiniMax H3Hailuo AI视频生成6 个信源在谈事件专题推荐理由:海螺AI的MiniMax H3能把动物也做成唱歌对口型,鸭嘴兽人那段尤其搞笑。原文稍后读已读值得跟进有用关注 MiniMax H3
12:41Hailuo AI@Hailuo_AIHailuo AI 宣布向 Twitch 主播推广 H3 模型。主播 GlitterPixely Luna 用 H3 完成了文字渲染测试。H3 可在连续视频上叠加清晰文本,适合直播覆盖层。作者在回复中给出了提示词。AI模型H3Hailuo AITwitch推荐理由:Hailuo 把 H3 带给 Twitch 主播了,能用它做直播文字覆盖,试玩提示词在回复里,很方便。原文稍后读已读值得跟进有用关注 H3
12:40Hailuo AI@Hailuo_AI精选MiniMax 旗下 Hailuo_AI 官方账号宣布,将前沿能力直接交到开发者手中。AIWarper 使用 Minimax-H3 在本地生成 960×544 分辨率视频,累计耗时 227 秒。MiniMax 官方转发了 AIWarper 的实测,强调模型可本地运行用于文生视频。AI模型Minimax-H3Hailuo文生视频6 个信源在谈事件专题推荐理由:Minimax-H3 能本地跑文生视频,实测 227 秒生成 960×544,不用排队等云端。原文稍后读已读值得跟进有用关注 Minimax-H3
12:33Hailuo AI@Hailuo_AI精选MiniMax H3 的开源权重已在社区中流传。有开发者在 RTX 5090 上本地运行该模型,生成 1280×720 分辨率、15 秒长的视频,耗时 10 分 40 秒。该配置使用了 Sol-Attn 与 SageAttention 优化,并设置 tau=0.8。生成的文字仍是乱码,但画面质量明显提升。AI模型MiniMaxH3RTX 5090视频生成6 个信源在谈事件专题推荐理由:想在本地玩视频生成?MiniMax H3 开源了,5090 跑 15 秒片段只要 10 分多钟,社区已经出优化方案了。原文稍后读已读值得跟进有用关注 MiniMaxH3