01:46官方账号LangChain@LangChainAI精选NVIDIA与LangChain联合发布NemoClaw Deep Agents蓝图,包含开放权重模型层Nemotron 3 Ultra,支持领域定制。Deep Agents层提供规划、工具调用、记忆和长时任务处理能力。OpenShell Runtime作为开放运行时,允许用户控制、审计和治理。该蓝图旨在简化智能体应用的构建与部署。AI模型NVIDIANemotron 3 UltraLangChain10 个信源在谈事件专题推荐理由:NVIDIA和LangChain搞的这个蓝图很实在,Nemotron 3 Ultra开放权重随便微调,智能体框架自带规划、工具、记忆,运行时也开源可审计。原文稍后读已读值得跟进有用关注 NVIDIA
01:42官方账号NVIDIA AI@NVIDIAAI精选NVIDIA AI 与 LangChain 联合推出基于 Nemotron 3 Ultra 的 Deep Agents 开源智能体框架。该 agent 在评测中取得 0.86 聚合分数,推理成本仅 4.48 美元。而性能最接近的闭源模型成本为 43.48 美元,实现了 10 倍的成本降低。框架完全开放可定制,开发者可直接使用。AI模型Nemotron 3 UltraLangChainDeep Agents10 个信源在谈事件专题推荐理由:NVIDIA 和 LangChain 搞了个开源智能体,用 Nemotron 3 Ultra 跑 Deep Agents,性能比肩闭源但成本只要 4 块多,比最接近的对手便宜 10 倍。搞 AI agent 的值得看看。原文稍后读已读值得跟进有用关注 Nemotron 3 Ultra
01:15官方一手AWS Machine Learning Blog@Jasmine Rasheed SyedAWS博客介绍了基于图的检索增强生成(GraphRAG)技术,通过结合知识图谱(BYOKG)与生成式AI来加速科学研究。该方法利用图数据库存储实体关系,并在药物研发中实现精准信息检索。GraphRAG在回答复杂科学问题时,比传统RAG更擅长处理多跳推理。BYOKG允许研究人员使用自有知识图谱,无需依赖外部数据源。该方案已应用于药物靶点发现等场景,提升了实验效率。AI模型GraphRAGBYOKGAWS推荐理由:AWS这篇博客讲的是用图数据库+知识图谱做检索增强生成,专门帮药物研发团队加速查找科学文献和挖掘靶点关系,比传统RAG更能处理复杂问题。原文稍后读已读值得跟进有用关注 GraphRAG
01:04官方一手OpenAI Blog(博客/媒体)73°OpenAI 发布了新一代语音模型 GPT-Live。该模型专门用于自然的人机语音交互。目前 GPT-Live 已应用于 ChatGPT Voice。它提升了语音对话的流畅度和响应速度。AI模型GPT-LiveOpenAIChatGPT Voice10 个信源在谈事件专题推荐理由:OpenAI 出了新语音模型 GPT-Live,ChatGPT 语音对话更自然了,赶紧试试吧。原文稍后读已读值得跟进有用关注 GPT-Live
01:01官方账号LangChain@LangChainAI精选LangChain调整了NVIDIA Nemotron 3 Ultra模型的推理框架,在基准测试中获得0.86的聚合分数,成本仅4.48美元。与之性能最接近的模型成本为43.48美元,实现了10倍的成本降低。该优化在保持领先性能的同时大幅降低了推理开销。AI模型NemotronNVIDIALangChain10 个信源在谈事件专题推荐理由:LangChain让Nemotron 3 Ultra跑分0.86,成本只要4.48刀,比对手便宜近10倍,性价比拉满。原文稍后读已读值得跟进有用关注 Nemotron
00:52宝玉@dotey83°Mitchell 在早期访问中对 GPT 5.6 Sol 和 Fable 进行了对比。他将 Sol 比作魅力十足、高效能干的同事,Fable 则是痴迷于特定领域的天才隐士。据 Mitchell 称,Sol 在速度和整体工作质量上优于 Fable,而 Fable 在针对性调试、安全和性能目标上无敌。他认为 Sol 在日常使用中更令人愉快,但 Fable 在高度定向任务中无对手。AI模型GPT 5.6 SolFable推理模型推荐理由:Mitchell 用同事和隐士的比喻讲透了两个模型的区别——日常编程选 Sol,底层安全调试选 Fable。原文稍后读已读值得跟进有用关注 GPT 5.6 Sol
00:34官方账号Greg Brockman@gdbOpenAI 的 GPT-5.6-Sol 模型经过两个多月在 Next.js 日常开发中的测试,表现出色。它能理解架构权衡、调查复杂 issue 报告,并在修复 bug 时考虑代码库其他部分。仅需简短提示即可指导,甚至独立完成了 Next.js 服务器的大规模重构(包括测试套件、部署测试)。相关 PR 将在 Next.js 16.3 发布后合并。AI模型GPT-5.6-SolNext.jsOpenAI10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6-Sol 不只是聊天,能直接干复杂编程活了,比如自己重构 Next.js 服务器。想看看模型实际生产力有多强?这篇实测值得看。原文稍后读已读值得跟进有用关注 GPT-5.6-Sol
00:29AI Breakfast@AiBreakfastSam Altman 在推文中宣布 GPT-5.6 sol 将于本周四上线,引发业内对 Google 领先地位的讨论。GPT-5.6 是 OpenAI 最新推理模型版本,专注于提高复杂任务处理能力。目前 Google 的 Gemini 系列模型也在竞争中占据一定优势。该消息来自非官方账号 AiBreakfast,具体细节尚待确认。AI模型GPT-5.6OpenAIGoogle10 个信源在谈事件专题推荐理由:Sam Altman 透露 GPT-5.6 sol 周四就来了,看 OpenAI 怎么跟 Google 较劲推理模型。原文稍后读已读值得跟进有用关注 GPT-5.6
00:22官方账号Decoder@Matthias BastianAnthropic 的 Claude Fable 5 在 Artificial Analysis 发布的六个新行业基准(金融、法律、医学)中全部获得最高分。在 Strategy & Ops Index 中,Fable 5 单次任务成本 3.48 美元,是 DeepSeek V4 Pro 的 0.03 美元的 100 倍以上,但分数仅领先 12 分。这表明顶级推理性能以极高的使用成本为代价。AI模型Claude Fable 5AnthropicDeepSeek V4 Pro10 个信源在谈事件专题推荐理由:Claude 5 性能确实最强,但用一次要三块多,比 DeepSeek 贵百倍,分数只高一点,性价比要好好掂量。原文稍后读已读值得跟进有用关注 Claude Fable 5
00:01elvis@omarsar0OpenCode 数据显示开源模型使用情况。GLM-5.2 仍被低估。deepseek-v4-flash 在智能体任务上表现惊喜,便宜高效。AI模型GLM-5.2deepseek-v4-flashOpenCode2 个信源在谈事件专题推荐理由:推主分享了OpenCode上的模型使用数据,发现deepseek-v4-flash当子代理既便宜又高效,GLM-5.2被低估了。原文稍后读已读值得跟进有用关注 GLM-5.2
23:55berryxia@berryxiaSeedream 5.0 Pro 现已上线字节云平台,该版本支持精准编辑、可视化复杂信息、渲染逼真图像与肖像。相比前代,它融合了香蕉的替换主体与编辑主题能力,以及类似 Image-GPT-2 的分层编辑功能。用户可通过该模型实现多语言创作下的精细化图像修改。AI模型Seedream 5.0 Pro字节云Image-GPT-22 个信源在谈事件专题推荐理由:字节云上新了Seedream 5.0 Pro,能做分层编辑和精准图像修改,类似Image-GPT-2的玩法,适合做设计或视觉内容的朋友试试。原文稍后读已读值得跟进有用关注 Seedream 5.0 Pro
23:41官方账号LangChain@LangChainAILangChain 与 NVIDIA 合作推出 NemoClaw Deep Agents Blueprint,这是一个完全开源的参考架构,用于构建企业级智能体系统。该架构在多个基准测试中取得领先性能,同时推理成本比传统方法降低超过 10 倍。它采用完全开放的软件栈,企业可以拥有并自定义代码。该蓝图旨在帮助开发者快速部署生产级智能体应用。AI模型NemoClawDeep AgentsLangChain10 个信源在谈事件专题推荐理由:LangChain 和 NVIDIA 搞了个开源的智能体参考架构,性能领先还便宜 10 倍成本,搞 agent 的可以看看。原文稍后读已读值得跟进有用关注 NemoClaw
23:38Harrison Chase@hwchase17LangChain 创始人宣布周四将推出推理模型 gpt-5.6 sol。同时 OpenWiki 迎来重大更新,可自动为代码库创建 wiki 文档。该项目开源在 github.com/langchain-ai/o…,并配有网络研讨会详解。AI模型gpt-5.6 solOpenWikiLangChain推荐理由:来了,gpt-5.6 sol 推理模型和 OpenWiki 自动建 wiki 功能,周四一起上线,搞开发的不妨看看。原文稍后读已读值得跟进有用关注 gpt-5.6 sol
23:36官方一手歸藏(guizang.ai)@op7418Seedream 5.0 的图像模型上线,作者测试了几张图,包括生成游戏截图、科普图、UI 设计稿和剧情介绍图。模型支持 2K 分辨率,比 GPT-4o 更高,但文字细节方面,多文字时仍存在模糊问题。整体进步明显,比之前的图像模型提升较大。AI模型Seedream 5.0GPT-4o图像生成推荐理由:Seedream 5.0 图像模型刚上线,能生成 2K 分辨率图片,比 GPT-4o 清晰,但文字多时会糊。想试试新模型可以看看这些例子。原文稍后读已读值得跟进有用关注 Seedream 5.0
23:25The Rundown AI@therundownai字节跳动发布了Seedream 5.0 Pro,这是一个声称超越简单图像生成、能“理解设计”的AI模型。该模型在文本渲染、结构和对齐方面有改进,能生成高质量信息图和原型。它支持精确编辑,包括图层分离和多个图像组合。在写实度、光照和皮肤纹理上也有升级,并支持多语言输入和生成。AI模型Seedream 5.0 ProByteDance图像生成2 个信源在谈事件专题推荐理由:字节跳动的Seedream 5.0 Pro不仅能画图,还能分层编辑、组合多图,设计能力更强。原文稍后读已读值得跟进有用关注 Seedream 5.0 Pro
22:33官方账号Mistral AI@MistralAI精选MistralAI 在模拟环境中训练模型,使用约 40 万条轨迹覆盖 6000 个场景。通过前缀缓存配方,训练 token 减少 22 倍,将原本数月的训练缩短至数天。进一步采用在线强化学习算法 CISPO,显著提升任务成功率。该方法完全在模拟中完成,不依赖真实世界数据。AI模型MistralAICISPO模拟训练推荐理由:MistralAI 搞了个模拟训练,40万轨迹加前缀缓存省了22倍 token 还出了新算法 CISPO,速度和质量都提上去了。原文稍后读已读值得跟进有用关注 MistralAI
22:27官方账号Mistral AI@MistralAI精选72°Mistral AI 推出 Robostral,一个能在轮式、腿式和飞行机器人上运行的统一模型。该模型能够跨不同尺寸和形态的机器人泛化,无需针对每种机器人单独训练。应用场景覆盖物流、制造、酒店等多个行业。Mistral AI 在官方博客中展示了 Robostral 在实际环境中的表现。AI模型Mistral AIRobostral机器人模型推荐理由:Mistral AI 发了新模型,能同时控制轮式、腿式、飞行机器人,不管大小都行,物流制造酒店都能用。原文稍后读已读值得跟进有用关注 Mistral AI
22:25量子位@思邈RoboDojo新基准测试发布,人类表现100分,最强AI模型仅获12.8分。该基准包含200个具身智能任务,覆盖抓取、导航、操作等场景。当前模型在长时序任务和细粒度控制上明显落后于人类。测试揭示了机器人在泛化能力和物理交互方面的核心瓶颈。AI模型RoboDojo具身智能基准测试推荐理由:RoboDojo这个新基准把人类和模型放到同一考场,人类满分100,最强模型才12.8,差距大到离谱,值得看看模型到底在哪栽跟头。原文稍后读已读值得跟进有用关注 RoboDojo
21:37IT之家(博客/媒体)73°字节跳动今日发布多模态图像创作模型 Seedream 5.0 Pro。相比之前版本,该模型在图文匹配、结构合理性、文字渲染与画面美感等基础能力上全面提升。它支持复杂信息可视化,能将数据、概念与密集文字准确转化为专业排版。还支持交互式精准编辑,基于空间位置与区域语义实现点选、圈选、图层分离等可控编辑。目前 Seedream 5.0 Pro 已上线火山方舟体验中心,并即将在豆包、即梦上线。AI模型Seedream 5.0 Pro字节跳动火山方舟3 个信源在谈事件专题推荐理由:字节新出的 Seedream 5.0 Pro 能一键生成复杂信息图,还能像修图一样精准编辑图像,图文匹配和质感都更强了。原文稍后读已读值得跟进有用关注 Seedream 5.0 Pro
21:27Paul Couvert@itsPaulAi腾讯发布开源模型Hy3,采用295B参数的MoE架构,规模仅为GLM-5.2的一半,但性能与GPT-5.5相当,且优于DeepSeek V4 Pro。该模型在同等参数量级中表现最佳,可媲美万亿级旗舰模型。Hy3提供Apache 2.0许可,免费API开放两周,适合智能体应用场景。AI模型TencentHy3开源模型推荐理由:腾讯Hy3开源模型295B参数,比GLM-5.2小一半却和GPT-5.5打平,还超过DeepSeek V4 Pro,免费API两周,智能体应用很香。原文稍后读已读值得跟进有用关注 Tencent
20:57官方账号Decoder@Maximilian Schreiner中国AI初创公司MiniMax正在开发一个拥有2.7万亿参数的大型语言模型。该公司计划在今年晚些时候将该模型开源。如果成功,这将是开源社区中参数规模最大的模型之一。AI模型MiniMax开源模型2.7万亿参数推荐理由:MiniMax要开源一个2.7万亿参数的模型,比很多闭源模型还大,搞AI的可以蹲一波。原文稍后读已读值得跟进有用关注 MiniMax
19:31官方账号Decoder@Maximilian Schreiner71°Meta旗下Superintelligence Labs推出首个图像生成模型Muse Image。该模型类似OpenAI的GPT Image 2,能通过代码执行和网页搜索等工具自主优化生成结果。其@-mention功能允许用户基于他人公开的Instagram照片生成图像,无需对方同意。这种opt-out模式可能违反GDPR和欧盟AI法案。技术亮点与隐私争议并存。AI模型Muse ImageMetaInstagram10 个信源在谈事件专题推荐理由:Meta新出的Muse Image能像GPT Image 2一样调用工具自动改图,但争议点在于它能拿你Insta照片生成别人头像,隐私风险很大。原文稍后读已读值得跟进有用关注 Muse Image
19:27Geek@geekbb精选Google 发布了 Gemma 4 技术报告,介绍其最新开放权重多模态模型 Gemma 4(E2B–31B)。报告详细说明了架构设计、效率优化和负责任的 AI 方法。此外还涉及无编码器的 12B 变体、量化感知训练以及多 token 预测(MTP)起草器。AI模型GemmaGoogle多模态推荐理由:Google 刚公开 Gemma 4 的技术细节,包括 31B 多模态模型和 12B 无编码器版本,还有量化训练和 MTP 新招,搞开源模型的可以看看。原文稍后读已读值得跟进有用关注 Gemma
18:37向阳乔木@vista8精选腾讯发布Hy3模型,采用MoE架构,总参数295B,基于Apache 2.0协议开放商用。相比Preview版,正式版在推理、智能体、长上下文等任务上显著提升。模型虽小但能力已超过700B参数的GLM 5.1。目前Hy3已上线OpenRouter平台,两周内提供免费API使用。AI模型Hy3腾讯MoE推荐理由:腾讯发了个295B的MoE模型Hy3,能力比700B的GLM 5.1还强,还开源可商用,这两周免费试用,值得试试。原文稍后读已读值得跟进有用关注 Hy3
18:35IT之家(博客/媒体)7月8日Momenta在港交所挂牌上市,代码6880.HK。凯迪拉克同日宣布,将行业首发量产Momenta R7强化学习世界模型。该模型分为预训练、仿真、强化学习三层,通过海量真实驾驶数据压缩物理规律。目前搭载Momenta系统的量产车辆突破100万台,交付超100款车型,累计定点超210款。AI模型MomentaR7凯迪拉克推荐理由:凯迪拉克要首发量产Momenta的R7世界模型了,这个模型能通过强化学习理解物理规律,让自动驾驶更靠谱。原文稍后读已读值得跟进有用关注 Momenta
18:31Julien Chaumond@julien_cZML 团队发布了新模型 LLMD。该模型的一个关键特性是模型层可以直接从 HuggingFace 以流式模式加载,无需存储本地文件。这种方式更适合生产环境下的部署。AI模型LLMDZMLHuggingFace推荐理由:ZML 发的 LLMD 模型能直接从网上下载层,不用存本地,部署省事多了。原文稍后读已读值得跟进有用关注 LLMD
18:27AI Will@FinanceYF5Claude 在结合 Blender MCP 后展现出强大的 3D 建模能力,仅需简单提示词即可生成低多边形物体。用户只需描述“制作一个屋顶”或“帽子”等,Claude 就能在 Blender 中自动完成弯曲、拉伸等操作。最终输出的资产可直接用于游戏,无需手动修复。这展示了 Claude 通过 MCP 工具链控制专业 3D 软件的潜力。AI模型ClaudeBlender3D建模推荐理由:Claude 现在能用一句话帮你做 Blender 建模,直接生成游戏用的低多边形模型,省掉你动手雕刻的时间。原文稍后读已读值得跟进有用关注 Claude
18:22AI Will@FinanceYF5Anthropic 近期重新开放了 Claude Fable 5 模型。该模型引发社区热议,用户已创造出10个创意应用示例。示例覆盖多种使用方向,展示了 Fable 5 的生成与推理能力。具体基准表现尚未公布,但社区反响强烈。AI模型AnthropicClaude Fable 5智能体10 个信源在谈事件专题推荐理由:Anthropic 重新上线 Claude Fable 5,社区立马玩出10种骚操作,想看看怎么用?原文稍后读已读值得跟进有用关注 Anthropic
18:19量子位@思邈精选智源研究院提出悟界·Orca方法,改变大模型训练顺序,先让模型学习世界动态变化规律。该方法旨在避免AI直接进入任务执行。相关论文入选Hugging Face论文月榜第一。AI模型悟界·Orca智源研究院Hugging Face推荐理由:智源搞了个新训练法Orca,不让AI一上来就干杂活,先学世界怎么变。论文上了Hugging Face月榜第一,值得看看他们的思路。原文稍后读已读值得跟进有用关注 悟界·Orca
17:16量子位@听雨翁荔在最新博客中提出AI自进化应首先构建Harness框架。DeepSeek成员崔添翼转发该博客并评论称该方向容易出成果。Harness可能作为系统化工具简化自进化流程,引发行业关注。AI模型翁荔HarnessDeepSeek推荐理由:翁荔给自进化指了条新路:先搭Harness。DeepSeek的崔添翼都说容易出成果,搞自进化的可以看看。原文稍后读已读值得跟进有用关注 翁荔
17:04orange.ai@oran_ge88°据海外内测反馈,GPT 5.6 是 GPT 5.5 的全面升级版本,定价与 5.5 相同。内测者普遍认为 GPT 5.6 与 Fable 在各项表现上存在差距,Fable 虽价格是 GPT 5.6 的两倍,但仍被视为智能巅峰。目前尚无官方基准数据公布。AI模型GPT 5.6GPT 5.5Fable10 个信源在谈事件专题推荐理由:GPT 5.6 明天发布,价格不变但性能不如两倍价的 Fable,想升级的可以等等看。原文稍后读已读值得跟进有用关注 GPT 5.6
16:56IT之家(博客/媒体)稀宇科技 MiniMax 计划推出 2.7 万亿参数规模的新一代大模型,该模型尚未正式发布。此前于6月15日,MiniMax 开源了旗舰模型 M3,总参数 428B(4280 亿),激活参数 23B。M3 在编码与智能体评测中达到行业顶尖水平,具备自主任务拆解、工具调用与多步推理能力。MiniMax 已为超过 200 个国家和地区的 3 亿个人用户及 100 万企业客户提供服务。AI模型MiniMax稀宇科技M3推荐理由:稀宇科技要推 2.7 万亿参数的大模型,比之前开源的 M3(428B)大了一个数量级,想了解国产模型天花板可以关注。原文稍后读已读值得跟进有用关注 MiniMax
16:32IT之家(博客/媒体)精选73°蚂蚁灵波科技发布并全面开源新一代具身基座模型 LingBot-VLA 2.0,数据量从 9 万小时清洗出 5 万小时真机数据,加上从 2 万小时第一视角数据中提炼的 1 万小时,预训练数据总计 6 万小时。模型支持 17 个品牌的 20 种机器人构型,覆盖单臂/双臂、双足/轮式等多种形态。在 GM-100 评测中,LingBot-VLA 2.0 在 AgileX Cobot Magic 和 Galaxea R1 Pro 平台上的平均任务进度分和成功率均领先于 π0.5 与 GR00T N1.7。后训练版本在 RTX 4090 上推理耗时控制在 130 毫秒以内。AI模型LingBot-VLA 2.0蚂蚁灵波具身智能2 个信源在谈事件专题推荐理由:蚂蚁灵波开源了新一代具身模型 LingBot-VLA 2.0,在 20 种机器人构型上泛化,GM-100 评测中全面领先 π0.5 和 GR00T N1.7,而且推理速度很快,适合开发者试玩。原文稍后读已读值得跟进有用关注 LingBot-VLA 2.0
16:20官方一手pandaily@contact@pandaily.com (Pandaily)美团发布LongCat-2.0,一个参数量达1.6万亿的AI模型,所有训练均使用国产AI芯片完成。该模型利用美团外卖配送数据驱动,表明生活服务场景也能支撑前沿大模型研究。模型规模超过OpenAI GPT-3的1750亿参数约9倍,但训练成本因国产芯片而受到关注。LongCat-2.0现已在内部用于配送调度等业务,未公开计划开源。AI模型MeituanLongCat-2.0万亿参数模型10 个信源在谈事件专题推荐理由:美团用外卖数据训出1.6万亿参数大模型,而且全用国产芯片,技术路线和落地场景都很有意思。原文稍后读已读值得跟进有用关注 Meituan
16:07官方账号Decoder@Matthias Bastian91°OpenAI 将于周四推出 GPT-5.6,此前因美国政府要求额外测试而延迟。该模型代号 Sol,在编码基准上以约一半的成本超越 Anthropic 的 Claude Mythos 5。目前尚无模型审批的绑定标准。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 来了,代号 Sol,编码能力比 Claude Mythos 5 强,成本还低一半,值得看看。原文稍后读已读值得跟进有用关注 GPT-5.6
15:22小互@imxiaohu马斯克称SpaceXAI将于明天向公众发布Grok 4.5。OpenAI宣布GPT-5.6 Sol将与Terra和Luna一同于本周四公开推出。Anthropic将Claude Fable 5的访问权限延长至7月12日。Google也预告了Gemini 3.5 Pro。多个厂商集中在同一时段发布新模型。AI模型Grok 4.5GPT-5.6 SolClaude Fable 510 个信源在谈事件专题推荐理由:多家AI公司扎堆预告新模型,Grok 4.5、GPT-5.6 Sol、Claude Fable 5这些名字你都得知道。原文稍后读已读值得跟进有用关注 Grok 4.5
14:43IT之家(博客/媒体)71°马斯克确认 SpaceXAI 将于当地时间 7 月 8 日或 9 日向公众开放 Grok 4.5 模型。该模型基于 1.5T 参数的 V9 基础模型,补充训练中加入了 Cursor 数据。声称对标 Anthropic Opus 级别,速度更快、Token 效率更高、成本更低。AI模型Grok 4.5SpaceXAIElon Musk10 个信源在谈事件专题推荐理由:马斯克说 SpaceXAI 明天就放 Grok 4.5 了,对标 Opus 还更快更省钱,想尝鲜的可以关注。原文稍后读已读值得跟进有用关注 Grok 4.5
14:37@elonmusk@elonmusk76°基于客户Beta测试的正面反馈,SpaceXAI宣布明天公开发布Grok 4.5。该模型被描述为Opus-class模型。相比同类模型,Grok 4.5拥有更快的速度、更高的token效率和更低的成本。AI模型Grok 4.5SpaceXAIOpus推荐理由:明天就能用上Grok 4.5了,比Opus快还便宜,想试试的别错过。原文稍后读已读值得跟进有用关注 Grok 4.5
14:28IT之家(博客/媒体)精选73°OpenAI 推出 gpt-realtime-2.1 和 gpt-realtime-2.1-mini 两款模型,专为低延迟语音智能体与多模态交互设计。官方表示通过优化缓存机制,p95 延迟至少下降 25%。gpt-realtime-2.1-mini 支持实时音频、文本输入、工具调用与函数调用,并可配置推理强度(minimal、low、medium、high、xhigh 五档)。gpt-realtime-2.1 增强字母数字识别、静音与噪声处理、中断处理等能力。定价方面,gpt-realtime-2.1 文本输入每百万 Tokens 4 美元,音频输入 32 美元;mini 版文本输入仅 0.6 美元。AI模型OpenAIgpt-realtime-2.1gpt-realtime-2.1-mini10 个信源在谈事件专题推荐理由:OpenAI 的 Realtime 2.1 延迟更低,价格也更友好,做语音代理的直接换这个,体验提升明显。原文稍后读已读值得跟进有用关注 OpenAI
14:22官方一手歸藏(guizang.ai)@op7418据社交媒体消息,OpenAI 计划于本周四(预计为北京时间周五凌晨)公开发布 GPT-5.6 模型,同时推出的还有 Sol、Terra 和 Luna 等其他模型。目前全球预览访问正在扩大。该消息尚未获得 OpenAI 官方确认。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:社交账号爆料 GPT-5.6 本周四发布,还带了 Sol、Terra、Luna 几个新名字,想尝鲜的可以留意官方动态。原文稍后读已读值得跟进有用关注 GPT-5.6