01:53官方一手歸藏(guizang.ai)@op7418Claude Opus 5 已发布,定价与 Opus 4.8 相同。在多项基准测试中,Opus 5 成绩大幅优于 Opus 4.8,并且多数测评成绩高于 Fable 5。官方称其智能接近 Fable 5,但价格为 Fable 5 的一半。用户反馈该模型可用性明显提升。AI模型Claude Opus 5Opus 4.8Fable 510 个信源在谈事件专题推荐理由:Opus 5 性能强于 4.8,价格不变,还接近 Fable 5 但便宜一半,值得升级。原文稍后读已读值得跟进有用关注 Claude Opus 5
01:32官方账号NVIDIA AI@NVIDIAAI精选NVIDIA的Kaggle Grandmasters团队在2026 NeuroGolf Championship中获得第一名,在KDD Cup 2026 Data Agents Competition中获得第二名。NeuroGolf项目中,他们使用manager agents协调专业worker并构建共享知识库。KDD项目中,他们的定制化工具缩小了前沿LLM与小型开源模型之间的性能差距。这两个成绩展示了团队在智能体协作和模型优化方面的能力。AI模型NVIDIAKaggleNeuroGolf10 个信源在谈事件专题推荐理由:NVIDIA团队用智能体协作拿下两个Kaggle大赛名次,还缩小了大小模型性能差距,挺有启发的。原文稍后读已读值得跟进有用关注 NVIDIA
01:31官方账号NVIDIA AI@NVIDIAAINVIDIA AI 在推特上公布了 NeuroGolf 竞赛第一名方案的写作链接,指向 Kaggle 比赛页面。同时展示了 KDD Cup 排行榜,数据来自 dataagent.top。这两个竞赛的结果可供社区参考和复现。AI模型NeuroGolfKDD CupNVIDIA3 个信源在谈事件专题推荐理由:NVIDIA AI 刚发了 NeuroGolf 冠军方案和 KDD Cup 榜单,做竞赛的朋友可以看看。原文稍后读已读值得跟进有用关注 NeuroGolf
01:24elvis@omarsar076°Anthropic推出Claude Opus 5,定价为Fable 5的一半。该模型在token效率上显著改进,接近Fable 5的边界智能水平。它被设计为更主动和善于思考的模型,兼顾前沿能力与成本可负担性。AI模型Claude Opus 5AnthropicFable 510 个信源在谈事件专题推荐理由:Claude Opus 5价格只有Fable 5的一半,token效率更高,适合想要前沿智能又不想花大钱的用户。原文稍后读已读值得跟进有用关注 Claude Opus 5
00:55官方账号vLLM@vllm_project精选vLLM 项目发布实验性插件 vLLM AFD Plugin,由 Ascend、vLLM、阶跃星辰、蚂蚁集团、FastAFD 联合开发。该插件针对 MoE 模型提出 Attention-FFN Disaggregation(AFD)方案,将注意力和专家/FFN 路径作为独立服务运行,支持独立扩缩容。AFD 运行在 NVIDIA GPU 和 Ascend NPU 上,无需 fork 即可使用相同 vLLM 服务接口。AI模型vLLM AFD PluginMoEAttention-FFN Disaggregation3 个信源在谈事件专题推荐理由:vLLM 出了个新插件,把 MoE 推理的注意力层和专家层拆分部署,想分别扩缩容就方便了,支持 NVIDIA 和昇腾卡。原文稍后读已读值得跟进有用关注 vLLM AFD Plugin
00:35官方账号Sam Altman@samaEthan Mollick 指出 GPT-5.6 Pro(仅聊天机器人可用)是目前最智能的模型。GPT-5.6 Ultra(Codex 中的最佳模型)在困难任务上表现较弱。对于真正难题,排名为:GPT-5.6 Sol Pro > Fable 5 Ultracode > GPT-5.6 Sol Ultra。模型命名令用户困惑。AI模型GPT-5.6CodexFable 510 个信源在谈事件专题推荐理由:OpenAI 的模型命名越来越绕了,看看 E 教授的实测对比,帮你搞清 GPT-5.6 各版本谁最强。原文稍后读已读值得跟进有用关注 GPT-5.6
00:29berryxia@berryxia81°Microsoft 发布了基于 Qwen3.5 架构的 27B 参数电脑操作 Agent Fara1.5-27B。它能看图像、读文字,像人一样控制电脑,支持浏览网页、填表单、从截图提取数据等任务。27B 的规模适合本地部署与自托管,门槛较低。该模型开源,让中等参数量的模型也能可靠完成真实网页自动化。AI模型Fara1.5-27BMicrosoftQwen3.51 个信源在谈事件专题推荐理由:微软开源了27B的电脑操作Agent Fara1.5-27B,能控制电脑做网页自动化,本地就能跑,RPA可以退了。原文稍后读已读值得跟进有用关注 Fara1.5-27B
00:24elvis@omarsar0精选Handoff 发布了 H1 模型,专门用于解析住宅建筑蓝图,能从原始 PDF 自动生成全工种材料清单。在自家基准测试中,H1 得分 81.6%,超过有经验的估算师,且比八个主流 AI 模型高出 30 个百分点以上。该模型体现了垂直 AI 在特定工作流中的优势。AI模型H1Handoff垂直AI推荐理由:Handoff 的 H1 模型专啃建筑蓝图,自动算材料清单,准确率 81.6%,比八个通用 AI 模型还强。搞施工估算的可以看看。原文稍后读已读值得跟进有用关注 H1
23:38Ethan Mollick@emollick用户向Codex模型发出一个递归提示:先构建一个评估AI生成基准能力的基准BenchBench,再推理出BenchBenchBench的含义并运行,最后将结果写成arXiv论文。Codex仅用单次提示就生成了一个完整的PDF文档。这个PDF内容展现了Codex理解复杂嵌套指令并产出的能力,且论文本身具有一定的参考价值。AI模型Codex编程助手提示词工程推荐理由:有人给Codex一个递归的提示,让它造一个基准的基准,结果它真给你生成了完整的论文PDF,挺有意思的玩法。原文稍后读已读值得跟进有用关注 Codex
23:36berryxia@berryxia精选Google发布了gmn,一个参数化、完全可微分的3D头部模型,所有面部动作和表情可精细控制并实时调整。该模型不需要GPU即可在CPU上运行,并在Hugging Face上提供了交互demo,用户可直接拖动参数观察表情变化。可微分特性使其能无缝接入神经网络训练流程,方便表情迁移、逆向渲染和虚拟人驱动。相比以往高质量3D头部模型要么过重要么难以与AI管线打通,gmn以开源参数化版本解决了这些问题。AI模型gmnGoogle3D模型推荐理由:Google出了个能在CPU上跑的3D头部模型gmn,所有表情都能调,还有在线demo直接玩,做虚拟人搞渲染都方便了。原文稍后读已读值得跟进有用关注 gmn
22:58Patrick Loeber@patloeber精选72°谷歌在Gemini API更新中,对Gemini 3.6 Flash和Gemini 3.5 Flash-Lite模型弃用了temperature、top_p和top_k三个采样参数。这些参数之前用于控制生成文本的随机性和多样性。开发者需要查阅谷歌AI开发者指南了解影响和调整方法。该变更涉及两个模型的最新版本。AI模型GeminiGemini 3.6 FlashGemini 3.5 Flash-Lite6 个信源在谈事件专题推荐理由:谷歌刚把Gemini 3.6 Flash和3.5 Flash-Lite的采样参数废了,用这两个模型的开发者快去更新代码吧。原文稍后读已读值得跟进有用关注 Gemini
22:57小互@imxiaohuHyper3D Rodin在零件级模型生成基础上,进一步实现可交互动画资产生成。该技术从静态模型直接生成动画资产,降低游戏和动画开发门槛。生成的资产可用于游戏、动画开发与设计制造。AI模型Hyper3D Rodin3D生成动画资产推荐理由:Hyper3D Rodin直接从零件模型生成可交互动画,省掉手动绑定骨骼的功夫,做游戏和动画效率能高不少。原文稍后读已读值得跟进有用关注 Hyper3D Rodin
15:51orange.ai@oran_geListenHub和Labnana平台已上架最新的图像模型Seedream 5.0 Pro。该模型在动漫人物等场景的美学表现上宣称超越GPT Image 2。同时平台还同步上线了图像编辑功能,支持局部修改。AI模型Seedream 5.0 ProGPT Image 2图像生成推荐理由:ListenHub和Labnana刚上了Seedream 5.0 Pro,画动漫比GPT Image 2还好,还能局部修图,快去试试!原文稍后读已读值得跟进有用关注 Seedream 5.0 Pro
13:57Amjad Masad@amasad1. 该代理的推文获得3516次阅读和37个点赞。2. 它声称通过自主研究掌握了现代LLM微调技术,相当于博士学位水平。3. 原文展示了11个数据图表(📊11)支撑其微调能力。4. 代理名为「chess autoresearch agent」,专注于自我探索型研究。AI模型chess autoresearch agentLLM微调智能体推荐理由:一个AI代理自己研究LLM微调,还能拿博士水平,看看它怎么做到的。原文稍后读已读值得跟进有用关注 chess autoresearch agent
13:09Ethan Mollick@emollickEmollick 指出,GPT-5.6 Pro(仅通过聊天机器人可用)是当前最智能的模型。GPT-5.6 Ultra(Codex 中的最佳模型)在困难任务上表现不如 Pro。对于极难问题,性能排序为 GPT-5.6 Sol Pro > Fable 5 Ultracode > GPT-5.6 Sol Ultra。这一命名体系让用户难以区分。AI模型GPT-5.6 ProGPT-5.6 UltraFable 5 Ultracode1 个信源在谈事件专题推荐理由:Emollick 实测对比了 GPT-5.6 系列和 Fable 5,告诉你哪个版本才是真正的推理之王,别再被名字骗了。原文稍后读已读值得跟进有用关注 GPT-5.6 Pro
12:15shao__meng@shao__meng72°Black Forest Labs 发布 FLUX 3,定位为真实世界模型,统一处理图像、视频、音频三种模态。模型最长生成约20秒带原生音频的视频,支持续写、关键帧、多语言对白。图像合成与编辑功能将在数周后推出,强化复杂 prompt 和文字渲染。动作预测已通过 FLUX-mimic 用于 mimic robotics 和 Audi 场景。AI模型FLUX 3Black Forest Labs多模态8 个信源在谈事件专题推荐理由:FLUX 3 把图像、视频、音频放一起训,还能预测动作。已经能生成20秒带声音的视频,图像也快上了。原文稍后读已读值得跟进有用关注 FLUX 3
11:34shao__meng@shao__meng72°Together Compute 团队在 DeepSWE 基准上对比了 Kimi K3 max 和 GPT-5.6 Sol max。单次测试 pass@1 中 GPT 为 72.7%,Kimi 为 68.5%;但多次测试中 Kimi 反超,pass@4 达 89.4% 对 GPT 的 85.8%。成本方面 Kimi 约 $4.65/rollout,GPT 约 $8.37;每 $100 预算 Kimi 可解 14.7 题,GPT 仅 5.3 题。语言专长上 Kimi 在 Rust 更强(65-60),GPT 在 Python/TS/JS 更强。两模型任务级相关仅 0.46,组合覆盖率达 95.6%,推荐级联策略:先 Kimi 再 GPT,可达到 85.6% 解题率且成本更低。AI模型Kimi K3 maxGPT-5.6 Sol maxDeepSWE2 个信源在谈事件专题推荐理由:Together Compute 下了个对比,Kimi 和 GPT 在修 bug 上各有绝活,组合用比单干划算得多。原文稍后读已读值得跟进有用关注 Kimi K3 max
11:28官方账号阿里云 Alibaba Cloud@alibaba_cloud阿里云发布了最新的语音技术Qwen-Audio-3.0-TTS模型,该模型已在OpenRouter平台上线。该模型支持更自然、更具表现力的语音合成,可用于提升音频交互体验。开发者可以通过OpenRouter API直接调用该模型,无需自行部署。AI模型Qwen-Audio-3.0-TTS阿里云语音合成推荐理由:阿里云新出的Qwen-Audio-3.0-TTS模型在OpenRouter上就能用,语音听起来更自然,做语音交互的可以试试。原文稍后读已读值得跟进有用关注 Qwen-Audio-3.0-TTS
08:20岚叔@lufzzlizFLUX 3 在自家评测中生成10秒、720p带音频的文生视频,效果与Seedance 2.0打平。该模型支持单次最长20秒的视频生成,涵盖文生视频、图生视频、视频续写、关键帧控制及多语言对白。除媒体生成外,FLUX 3 的底层模型可扩展为机器人动作预测,输出机械臂控制指令。目前处于Early Access阶段,视频生成已开放申请,图像版本数周后推出。AI模型FLUX 3Seedance 2.0视频生成8 个信源在谈事件专题推荐理由:黑森林家的FLUX 3 刚曝光,既能文生视频又能带音效,还和Seedance 2.0打了个平手,甚至能控制机械臂。想尝鲜的可以去申请测试。原文稍后读已读值得跟进有用关注 FLUX 3
07:23berryxia@berryxia83°Black Forest Labs推出FLUX 3,这是一个统一的多模态backbone,同时支持图像生成、视频、原生音频和机器人动作预测。目前视频功能已开放early access,未来将开放模型权重。该模型已与mimic、Audi合作,在真实机器人上运行测试。团队提出物理世界智能与内容创作可共享同一套视觉基础模型。AI模型FLUX 3Black Forest Labs多模态8 个信源在谈事件专题推荐理由:Black Forest Labs的FLUX 3把图像、视频、音频和机器人动作预测塞进一个模型,已经跟真实机器人合作跑起来了。原文稍后读已读值得跟进有用关注 FLUX 3
06:58@koltregaskes@koltregaskesFLUX 3是一个单一模型,同时支持图像、视频、音频生成以及机器人动作预测。其衍生版本FLUX-mimic已在奥迪工厂用于布线、分拣和装配。FLUX 3 Video现已开放早期访问,可加入候补名单。未来数周至数月内将推出原生音频、动作预测、图像生成、快速变体及开放权重骨干。AI模型FLUX 3FLUX-mimicAudi8 个信源在谈事件专题推荐理由:FLUX 3把图、视频、音频、机器人全做到一个模型里了,还已经在奥迪工厂跑起来了,视频版还能抢先体验。原文稍后读已读值得跟进有用关注 FLUX 3
06:30官方账号Nous Research@NousResearch精选蚂蚁集团(AntLingAGI)发布新MoE模型Ling-3.0-flash,总参数124B,激活参数5.1B,运行速度快。该模型专为智能体工作负载设计,涵盖编码、搜索、研究和工具使用场景。即日起一周内,用户可通过Nous Portal免费使用。AI模型Ling-3.0-flashAntLingAGINousResearch推荐理由:蚂蚁发了新MoE模型Ling-3.0-flash,124B参数但只激活5.1B,跑得快,还免费一周。适合搞智能体、编码或搜索任务,快去体验。原文稍后读已读值得跟进有用关注 Ling-3.0-flash
06:09OpenRouter@OpenRouterAILing-3.0-flash是一款124B参数的MoE模型,每token仅激活约5.1B参数,由Novita Labs提供。该模型已在OpenRouter平台上线,主打token高效的agentic推理。即日起至8月3日可免费使用。AI模型Ling-3.0-flashNovita LabsOpenRouter推荐理由:想省token跑agentic任务?试试Ling-3.0-flash,124B参数只激活5B,OpenRouter上免费到8月3日。原文稍后读已读值得跟进有用关注 Ling-3.0-flash
05:38官方账号Together AI@togethercomputeKimi K3 模型将于7月27日通过 Together AI 平台上线,用户可在发布当天立即使用其推理服务。该服务支持编程、智能体以及生产负载等场景。Together AI 提供高性能推理基础设施,使开发者能第一时间体验 Kimi K3。AI模型Kimi K3Together AI推理模型10 个信源在谈事件专题推荐理由:Kimi K3 马上就能在 Together AI 上用了,7月27日当天就能跑编程和智能体任务,想抢先体验的快去试试。原文稍后读已读值得跟进有用关注 Kimi K3
04:31AI Engineer@aiDotEngineerAmazon AGI Lab 发布 Perception Agents,让智能体感知、规划并行动。该框架开源了 harness 和 tooling,旨在解决真实场景中知识工作的杂乱问题。Perception Agents 专注于处理非结构化数据,通过感知层增强智能体的决策能力。该项目已连续四年由 @anbarth 参与讨论。AI模型Perception AgentsAmazonAGI Lab推荐理由:Amazon 开源了 Perception Agents 框架,让智能体学会感知真实混乱环境,直接解决知识工作中的痛点,值得关注。原文稍后读已读值得跟进有用关注 Perception Agents
04:15Latent.Space@latentspacepodPoolside联合创始人兼CEO在播客中解释为何编程是通往AGI的路径。他们的Model Factory每月运行1万-2万个实验,八周内完成新模型迭代。Laguna S模型表明持久性和验证能力可能比原始智能更重要。智能体已经在帮助构建下一代模型。他认为未来应有100家基础模型公司而非5家。AI模型PoolsideLaguna S开源模型7 个信源在谈事件专题推荐理由:讲Poolside怎么用Model Factory快速做模型,Laguna S的思路,以及他们看好更多基础模型公司。原文稍后读已读值得跟进有用关注 Poolside
03:11OpenRouter@OpenRouterAI阿里通义千问推出 Qwen-Audio-3.0-TTS Plus,这是其 TTS 模型的高质量版本。该模型在自然度、声音和音色保真度上进行了优化,支持多种语言和说话风格。相比前代,Plus 版本生成语音更加精细且富有表现力。用户可通过 OpenRouter 平台调用该模型。AI模型Qwen-Audio-3.0-TTS PlusQwen阿里推荐理由:阿里刚发了Qwen-Audio-3.0-TTS Plus,语音更自然好听,还支持多语言和不同风格,做语音合成的可以试试。原文稍后读已读值得跟进有用关注 Qwen-Audio-3.0-TTS Plus
03:10OpenRouter@OpenRouterAI阿里通义千问团队发布Qwen-Audio-3.0-TTS Flash,专为低延迟实时交互优化。该模型内置语音克隆功能,可处理质量不佳的参考音频。OpenRouter已上架该模型,支持API调用。AI模型Qwen-Audio-3.0-TTS-Flash阿里语音克隆推荐理由:阿里出了个新TTS,能实时克隆声音,连不好的录音都能用,交互时延迟很低。原文稍后读已读值得跟进有用关注 Qwen-Audio-3.0-TTS-Flash
03:07官方账号vLLM@vllm_project精选PrimeIntellect 发布了 prime-rl 0.6.0,在 vLLM 上运行万亿级 agentic RL 推理。该版本采用 FP8 量化、专家并行、prefill/decode 分离以及 KV 缓存卸载(原生+Mooncake),并使用 vllm-router。在 28 个 H200 节点上,以 131k 序列长度训练 GLM-5 执行 SWE 任务,每步耗时不到 5 分钟。@m_sirovatka 将在 vLLM Office Hours 中深入讲解。AI模型PrimeIntellectprime-rlvLLM推荐理由:PrimeIntellect 用 vLLM 把 agentic RL 搞到万亿参数级了,FP8 加专家并行,28 个 H200 节点跑 131k 序列,每步不到 5 分钟,训练 GLM-5 做 SWE 任务。原文稍后读已读值得跟进有用关注 PrimeIntellect
03:06Paul Couvert@itsPaulAiOffloop团队推出D1层,一个仅3B参数的多智能体路由层。它在GDPval基准上达到SOTA,领先Claude Code和Codex,覆盖美国年收入2.4万亿美元的岗位需求。D1自动决定每个步骤由哪个智能体执行,替代手动比较多个agent输出。AI模型OffloopD1GDPval3 个信源在谈事件专题推荐理由:Offloop搞了个D1路由层,3B参数就能自动调度多个AI agent,基准上干掉了Claude Code和Codex,挺有意思。原文稍后读已读值得跟进有用关注 Offloop
02:51OpenRouter@OpenRouterAI微软AI在OpenRouter平台发布两个新模型。MAI-Image-2.5-Pro是其目前为止最高保真度的图像生成模型。MAI-Voice-2-Flash专为高容量、实时语音交互场景设计。两个模型现已可通过OpenRouter API调用。AI模型MAI-Image-2.5-ProMAI-Voice-2-FlashOpenRouter2 个信源在谈事件专题推荐理由:微软新模型上线OpenRouter,图像更清晰,语音更实时,适合开发者和创作者试玩。原文稍后读已读值得跟进有用关注 MAI-Image-2.5-Pro
02:50OpenRouter@OpenRouterAIOpenRouter 上线了微软的 MAI-Voice-2-Flash 模型,相比前代 MAI-Voice-2 推理速度提升2倍。该模型支持15种语言,保持自然韵律和声学质量,并提供细粒度语调控制。专为响应式语音助手和实时交互场景设计。AI模型MAI-Voice-2-FlashOpenRouter微软推荐理由:需要更快更自然的语音合成?微软新模型速度快两倍,15种语言随意切换,适合搭实时语音Agent。原文稍后读已读值得跟进有用关注 MAI-Voice-2-Flash
02:49OpenRouter@OpenRouterAIOpenRouter 在推特上发布了一条消息,获得 46 次浏览,内容指向 microsoft.ai/news 页面。该页面介绍了微软新推出的模型。目前具体模型名称和细节需通过链接查看。AI模型OpenRouterMicrosoft模型介绍推荐理由:OpenRouter 分享了微软新模型的介绍页面,想了解具体有什么新模型可以点进去看看。原文稍后读已读值得跟进有用关注 OpenRouter
02:10elvis@omarsar0多智能体系统面临智能体重复工作、互相通信浪费token的难题。Offloop团队训练了一个名为D1的调度器模型,它能决定哪个智能体下一步行动,并在合适时保持静默。该方法在GDPval基准上达到了SOTA性能,同时大幅降低了成本。用户还可以自带自己的AI订阅。AI模型OffloopD1GDPval3 个信源在谈事件专题推荐理由:Offloop用D1调度器解决了多智能体互相重复工作的老问题,成本低还让你用自己订阅的AI。原文稍后读已读值得跟进有用关注 Offloop
01:40官方账号Epoch AI@EpochAIResearchEpoch AI Research 推出 EpochAIPlays 项目,首场直播将基准测试 GPT 5.6 Sol 在游戏 Slay the Spire 上的能力。直播由 @AlephNuul 提供实时评论。该基准测试旨在评估模型在策略游戏中的推理和决策水平。结果将反映 GPT 5.6 Sol 在复杂规则环境下的表现。AI模型EpochAIGPT-5.6 SolSlay the Spire推荐理由:看看 Epoch AI 怎么用 Slay the Spire 测试 GPT-5.6 Sol 的游戏智商,和之前的基准很不一样。原文稍后读已读值得跟进有用关注 EpochAI
01:37官方账号OpenAI@OpenAI75°OpenAI称每周有超过3亿用户向ChatGPT提出健康相关问题。他们与数百名医生合作,从准确性、安全性、沟通、上下文感知、完整性和适当升级六个维度改进模型。GPT-5.5 Instant已将前沿健康智能开放给所有免费用户。GPT-5.6 Sol进一步提升了处理更复杂健康问题的能力。AI模型ChatGPTOpenAIGPT-5.510 个信源在谈事件专题推荐理由:OpenAI公布新数据,每周3亿人用ChatGPT问健康,还出了GPT-5.6 Sol专门优化复杂问答,免费用户也能体验升级。原文稍后读已读值得跟进有用关注 ChatGPT
01:22Mustafa Suleyman@mustafasuleyman79°Microsoft在PowerPoint中部署MAI图像模型,相比GPT-Image-2成本降低84%。在OneDrive中,MAI模型提升保存率26%并减少延迟约25%。该模型已成为Bing的默认模型,提供高质量性能。在Dragon Copilot中,转录模型覆盖58种语言,将多语言临床转录错误率减半。此外,GitHub和Excel中也在推进类似改进。AI模型MAIMicrosoftGPT-Image-22 个信源在谈事件专题推荐理由:微软把MAI模型塞进了PPT、OneDrive和Bing,成本降了84%,速度还快了,效果挺猛。原文稍后读已读值得跟进有用关注 MAI
01:20Mustafa Suleyman@mustafasuleyman72°微软发布MAI-Voice-2-Flash,相比MAI-Voice-2推理速度快2倍。定价为每100万字符15美元,成本降低32%。该模型已集成到Dynamics 365 Contact Center,可为呼叫中心减少高达89%的GPU成本。目前处于公开预览阶段。AI模型MAI-Voice-2-FlashMicrosoftDynamics 365推荐理由:微软新语音模型MAI-Voice-2-Flash,跑得快还便宜32%,支撑企业呼叫中心,GPU成本能砍89%。原文稍后读已读值得跟进有用关注 MAI-Voice-2-Flash
01:19Mustafa Suleyman@mustafasuleymanMAI-Image-2.5-Pro 今日在 Foundry 平台开放预览。这是微软最高保真度的专业级图像模型,支持高质量图像生成、精细编辑以及精确的图内文本渲染。该模型加入图像系列,开发者可根据质量、速度和成本选择适合的模型。AI模型MAI-Image-2.5-ProMicrosoftFoundry2 个信源在谈事件专题推荐理由:微软推出 MAI-Image-2.5-Pro 预览版,生成图像质量最高,还能精准渲染文字,适合专业场景。原文稍后读已读值得跟进有用关注 MAI-Image-2.5-Pro
01:13官方账号NVIDIA AI@NVIDIAAI72°NVIDIA AI展示使用PrimeIntellect托管RL训练,将Nemotron 3 Nano在数学任务上的准确率从22%提升至91%,总成本低于5美元。工作流程包括基线检查、奖励训练和重新测试,最终输出可下载的LoRA适配器。该方案可通过修改一行代码扩展至Nemotron 3 Super和Ultra。AI模型Nemotron 3 NanoPrimeIntellectRL6 个信源在谈事件专题推荐理由:花5美元用托管RL把Nemotron 3 Nano的数学准确率从22%拉到91%,还能一键扩展到更大模型,太实用了!原文稍后读已读值得跟进有用关注 Nemotron 3 Nano