04:13官方账号Greg Brockman@gdb78°OpenAI 推出 GPT-5.6 系列,其中 Sol 同时支持即时聊天与深度推理,此前这两个场景使用不同模型。Plus 和 Pro 用户现已可用 Sol。免费用户和 Go 用户从明天起可无限次使用 GPT-5.6 Luna 进行文本聊天。OpenAI 称合并推理模式是 ChatGPT 简化交互的关键一步。AI模型GPT-5.6SolLuna10 个信源在谈事件专题推荐理由:OpenAI把快聊和深度推理合成一个GPT-5.6 Sol,免费用户还能无限用Luna,先试试。原文稍后读已读值得跟进有用关注 GPT-5.6
03:37官方账号OpenAI@OpenAIOpenAI 今天向 ChatGPT 的 Plus 和 Pro 用户开放更新版 GPT-5.6 Sol。新版本仅用于日常聊天,只出现在 ChatGPT 的 Chat 界面。此次更新还为 ChatGPT 加入了一个新滑块,用户可据此调整对话表现。驱动 Work 和 Codex 的 GPT-5.6 Sol 版本不受本次发布影响。AI模型GPT-5.6 SolChatGPTOpenAI10 个信源在谈事件专题推荐理由:OpenAI 给 GPT-5.6 Sol 日常版加了个新滑块,Plus/Pro 用户今天就能在 Chat 里试。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
03:34官方账号OpenAI@OpenAI83°OpenAI 推出 GPT-5.6 Sol,为付费用户的全部聊天(含 Instant 模式)提供一致体验。在高风险事实性评估中,覆盖金融、医学和法律领域,GPT-5.6 Sol 比 GPT-5.5 Instant 的事实错误响应减少 68%。该模型成为付费用户的默认统一推理版本。AI模型GPT-5.6 SolOpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI 把新模型 GPT-5.6 Sol 用到所有付费聊天里,医学法律等场景错误率比上代 Instant 低了 68%,靠谱很多。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
03:33官方账号OpenAI@OpenAI78°OpenAI 为 ChatGPT 推出 GPT-5.6 Sol,Plus 和 Pro 用户可使用即时与深度推理,响应更注重事实。GPT-5.6 Luna 面向 Free 和 Go 用户,从明天起提供无限文本对话。Sol 与 Luna 分别面向付费和免费层级,覆盖不同需求。AI模型GPT-5.6 SolGPT-5.6 LunaOpenAI10 个信源在谈事件专题推荐理由:OpenAI 把新模型拆成两档:付费的 Sol 更会推理,免费的 Luna 随便聊,明天就能用。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
03:20Fireworks AI@FireworksAI_HQFireworks AI与Arize AI联合举办的网络研讨会将于30分钟后开始,主题为'GPT-5.5、Kimi K3和另外8个模型:AI工作的真实成本'。活动将对比10款模型在成功完成任务时的成本表现。会后设有公开问答环节,由Fireworks AI的AI教育主管@Prof_OZ与Arize AI团队参与。下一场研讨会定于8月6日举行。AI模型Fireworks AIArize AIGPT-5.510 个信源在谈事件专题推荐理由:马上有一场AI模型成本对比直播,看GPT-5.5和Kimi K3等10个模型谁完成任务更省钱,还能直接提问。原文稍后读已读值得跟进有用关注 Fireworks AI
03:07GitHub@githubKimi K3 是月之暗面推出的开源权重模型,现已正式可用并集成到 GitHub Copilot。该模型在智能体编程(agentic coding)场景展现出前沿级能力,同时保持较低的使用成本。目前 Kimi K3 由 Fireworks AI 托管,开发者可直接在 GitHub Copilot 中调用。AI模型Kimi K3GitHub CopilotFireworks AI10 个信源在谈事件专题推荐理由:Kimi K3 正式上线 GitHub Copilot,开源权重还能便宜跑 agentic 编程,想试试的可以直接用。原文稍后读已读值得跟进有用关注 Kimi K3
01:23官方账号Clement Delangue@ClementDelangue73°Hugging Face CEO Clement Delangue在X发文说,智能体之间互相协作和通信是好事,不是威胁,会让它们更像人类一样高效和安全。他提到几周前与Google Gemma做了一个149个智能体的公开协作实验,现在@cmpatino_又启动了新实验,让智能体一起写出更好的数学证明。两个项目都托管在Hugging Face Spaces上。AI模型Hugging FaceGemma多智能体协作推荐理由:Hugging Face CEO用149个Gemma智能体做协作实验,还能围观它们公开交流写数学证明。原文稍后读已读值得跟进有用关注 Hugging Face
01:20Geek@geekbb精选71°Unsloth AI推出DSpark加速方案,让DeepSeek-V4-Flash-0731的GGUF模型在本地生成速度提升约1.4至2倍。根据Unsloth官方实测,该模型在本地可达到每秒120 tokens,精度没有变化。相关GGUF文件已发布在Hugging Face上,完整指南见Unsloth官方文档。AI模型DeepSeek-V4-FlashUnslothDSpark9 个信源在谈事件专题推荐理由:Unsloth搞了个DSpark,能让DeepSeek-V4-Flash在本地跑快一两倍,每秒120 tokens,精度不变,自己部署更爽了。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash
01:20官方账号Google DeepMind@GoogleDeepMind精选Google DeepMind在GitHub上开源了模型代码与权重,任何人都可以免费获取。这些资源可用于学术研究、业务预测以及开发更专业化的本地模型。官方同步给出了研究论文入口,开发者可进一步查看技术细节。AI模型Google DeepMindGitHub开源模型推荐理由:DeepMind把代码和权重挂GitHub免费开放,学术、业务预测都能用,想搞本地化模型的直接拿来改。原文稍后读已读值得跟进有用关注 Google DeepMind
00:54官方账号Google DeepMind@GoogleDeepMind精选Google DeepMind 在《Nature》发表论文,推出 AI 模型 WeatherNext。该模型在预测气旋路径和强度上达到当前最优精度。相比现有方法,WeatherNext 平均可为防灾争取额外 24 小时的准备时间。更长的提前预警有助于减少气旋灾害带来的生命财产损失。AI模型WeatherNextGoogle DeepMind气旋预测推荐理由:谷歌 DeepMind 的 WeatherNext 登上 Nature,预报气旋路径和强度能平均多抢 24 小时准备时间,气象防灾硬核进展。原文稍后读已读值得跟进有用关注 WeatherNext
00:23orange.ai@oran_geDeepSeek V4 Pro 的评测成绩比 Claude Fable 低 0.3%。网友认为这个差距很小,并把它和 DeepSeek 涨价联系起来。曹山石发布的内容提到 DeepSeek 正在新一轮融资。colaos.ai 的六倍 DeepSeek 额度也因涨价传闻引发讨论,用户希望涨幅小一些。AI模型DeepSeek V4 ProClaude FableDeepSeek4 个信源在谈事件专题推荐理由:DeepSeek V4 Pro 跟 Claude Fable 只差 0.3%,又赶上新一轮融资,colaos.ai 的六倍 DeepSeek 额度还能撑多久真不好说。原文稍后读已读值得跟进有用关注 DeepSeek V4 Pro
00:20向阳乔木@vista8DeepSeek V4 Pro综合性能进入全球第一梯队。其编程能力与Claude旗舰差距仅0.3%。API定价是海外竞品的1/10到1/100。模型原生适配华沟昇腾95OPR,补齐国产算力闭环。AI模型DeepSeekV4 ProClaude1 个信源在谈事件专题推荐理由:DeepSeek V4 Pro编程只比Claude旗舰差0.3%,API价格便宜很多,还适配国产芯片,性价比拉满。原文稍后读已读值得跟进有用关注 DeepSeek
00:11官方账号ElevenLabs@elevenlabsioElevenLabs 推出 Dubbing v2,这是其新一代 AI 配音模型。通过 ElevenAPI,开发者可以直接将该功能嵌入自有产品和工作流。官方表示,这次首次将原视频的情感与表演完整保留到每种语言中。该模型支持多语言配音,适合视频本地化和内容创作场景。AI模型ElevenLabsDubbing v2ElevenAPI推荐理由:ElevenLabs 出了新的配音模型 Dubbing v2,能把原声的情感带到别的语言里,做视频本地化的话可以试着用 API 接进自己的流程。原文稍后读已读值得跟进有用关注 ElevenLabs
23:47官方账号Meta AI@AIatMeta82°Meta AI将模型送入五场STEM奥赛(APhO、IPhO、IMO等),全程禁用搜索、编程和计算器。结果APhO与IPhO理论考试均满分,IMO获金牌。IChO和RMM同样达到金牌级水平。AI模型Meta AIAPhOIPhO推荐理由:Meta AI把自家模型拉去考五门奥赛,禁用工具还物理满分、IMO金牌,推理实力有硬成绩了。原文稍后读已读值得跟进有用关注 Meta AI
23:18Hailuo AI@Hailuo_AIMiniMax在X平台发布H3模型新演示,展示Omni Reference功能在整段视频中保持角色、音频与环境一致性。测试片名为《黄金时代》,由liyuyuAi制作并发布。该演示通过引用的方式将人物特征贯穿全片,体现H3在多模态参照生成上的能力。AI模型MiniMaxH3Omni Reference推荐理由:MiniMax官方发了段H3的演示片,角色长相、声音、场景从头到尾都没跑偏,想看多模态一致性效果的可以点开看看。原文稍后读已读值得跟进有用关注 MiniMax
22:48官方一手歸藏(guizang.ai)@op741876°阿里发布Wan 3.0视频生成模型,支持原生30秒1080P视频生成。它新增“全能参考”功能,可混合文本、图像、视频、音频以及文档、表格、PPT、网页等输入。定价为1080P每秒1.4元,720P每秒0.7元。该模型文本渲染和动效表现也不错。AI模型Wan阿里视频生成推荐理由:阿里Wan 3.0开始公测了,能一次生成30秒1080P视频,还能混着文档PPT做参考,比一般视频模型更灵活。原文稍后读已读值得跟进有用关注 Wan
22:41Gary Marcus@GaryMarcus精选François Chollet回顾AI模型架构的关键转折:过去高性能模型多为端到端神经模型,输入输出都是向量。当时学界普遍推崇“可微分编程”,主张把更多逻辑交给神经网络。而当前实际流行的是重神经符号系统,模型本身包含符号层。AI模型神经符号系统端到端神经模型可微分编程推荐理由:Chollet这段历史补课很关键:别以为端到端神经网络是终点,现在风向已经是神经符号系统了。原文稍后读已读值得跟进有用关注 神经符号系统
21:49OpenRouter@OpenRouterAIOpenRouter发布两个基于真实花费份额的任务排行榜。Shell执行任务中,DeepSeek V4 Pro排名第一。工具调度任务中,Kimi K3占据首位。两个榜单均由开放模型登顶。AI模型DeepSeek V4 ProKimi K3OpenRouter10 个信源在谈事件专题推荐理由:OpenRouter按真实花费给模型排名,DeepSeek V4 Pro拿下Shell执行第一,Kimi K3拿下工具调度第一,开放模型领先。原文稍后读已读值得跟进有用关注 DeepSeek V4 Pro
20:11Thomas Wolf@Thom_Wolf精选Thom_Wolf 在 X 上指出,宪法训练(constitutional training)与可验证奖励强化学习(RLVR)不该在数据流形上分家。模型却擅长把细粒度区别编码进独立的表示空间。这种分离可能让两种训练目标互相干扰。AI模型RLVR宪法训练AI安全推荐理由:一个训练上的坑:模型会把宪法训练和 RLVR 隔到不同表示空间,Thom_Wolf 说这样不行。原文稍后读已读值得跟进有用关注 RLVR
19:13官方账号阿里通义 Qwen@Alibaba_Qwen精选Qwen3.8-Max在Artificial Analysis Intelligence Index上排名第五,并在Agentic Index上位列第一。该模型由阿里通义千问团队发布,当前基准成绩显示了其在智能体任务上的领先表现。团队表示将继续推进模型迭代。AI模型Qwen3.8-Max通义千问智能体推荐理由:阿里刚发的Qwen3.8-Max,智能体能力跑到第一了,总榜第五,想追新模型可以看看。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
17:29官方一手歸藏(guizang.ai)@op741872°Meta 发布了新模型 Muse Spark 1.2 和编程 Agent Muse Code。用户同意将数据用于训练后,可获得 12 倍折扣,价格接近 DeepSeek-Flash。但 Muse 系列访问限制严格,网页无法登录,体验比 Anthropic 的模型更麻烦。在 DeepSeek 计划涨价之际,Meta 用低价策略跟进,AI 价格战开始。AI模型Muse Spark 1.2Muse CodeMeta10 个信源在谈事件专题推荐理由:Meta 发了 Muse Spark 1.2 和 Muse Code,同意数据训练就打 12 倍折,价格贴着 DeepSeek-Flash,就是网页难进。原文稍后读已读值得跟进有用关注 Muse Spark 1.2
17:25AI Will@FinanceYF578°NVIDIA宣布开源自动驾驶推理模型Alpamayo 2 Super。Alpamayo 2 Super能理解复杂场景,先思考再行动。Robotaxi、卡车和配送车是它的目标应用。模型采用OpenMDW-1.1协议开放商用。Jensen Huang表示下一代AI是机器人,从自动驾驶开始。AI模型NVIDIAAlpamayo 2 Super自动驾驶9 个信源在谈事件专题推荐理由:老黄开源的Alpamayo 2 Super是自动驾驶推理模型,能先思考再行动,Robotaxi和卡车都能用,而且协议允许商用。原文稍后读已读值得跟进有用关注 NVIDIA
17:16Hunyuan@TXhunyuan腾讯发布 Tencent Hy3 模型,定位为紧凑且成本高效的实践型 AI。Hy3 将旗舰级性能融入较小体量,支持推理与智能体能力。Hy3 可应用于研究、编程、办公、设计与云工作流。Hy3 已通过腾讯产品、API 和开发者平台全球可用。定价与详情可在 OpenRouter 和腾讯云 TokenHub 页面查询。AI模型Tencent Hy3腾讯推理模型推荐理由:腾讯新出了 Hy3,紧凑便宜但有旗舰级性能,带推理和智能体能力,还能在腾讯全家桶和 API 直接用。原文稍后读已读值得跟进有用关注 Tencent Hy3
17:13向阳乔木@vista8SeedRealtime 将声音、画面、时序与表达纳入同一个模型,听、看、理解、推理、说话全在一个模型内完成。相比主流多模块级联(ASR 转文字、VLM 理解画面、TTS 合成语音)或依赖外置 VAD 的半双工逻辑,SeedRealtime 在连续音视频流上同步进行感知、理解、决策与表达。实测中,用户指着天龙功放按键问“这个怎么弄”,模型能结合画面、手势和视线方向判断指代。据称 OpenAI GPT Live 仍是音频全双工,SeedRealtime 做到了视频、音频、文本的全模态全双工。AI模型SeedRealtimeOpenAI GPT Live多模态10 个信源在谈事件专题推荐理由:SeedRealtime 一个模型同时搞定看和听,你指着东西问它“这个怎么弄”,它能结合手势秒懂,比 GPT Live 多了视频全双工。原文稍后读已读值得跟进有用关注 SeedRealtime
16:22AI Will@FinanceYF576°英伟达今日发布面向自动驾驶的开源推理模型Alpamayo 2 Super。该模型在视觉之外增加了理解与推理能力,会先思考再行动。它被定位为Robotaxi、卡车、接驳车、物流车、拖拉机等车辆的通用骨干。英伟达以OpenMDW-1.1协议开放商用,允许团队检视、微调并部署。官方称开源模式有助于提升自动驾驶安全性。AI模型Alpamayo 2 SuperNVIDIA自动驾驶9 个信源在谈事件专题推荐理由:黄仁勋刚发布Alpamayo 2 Super,自动驾驶开源推理模型,先思考再行动,可商用,做车的团队值得看看。原文稍后读已读值得跟进有用关注 Alpamayo 2 Super
16:21Hailuo AI@Hailuo_AIMiniMax H3在Design Arena的Multi-Image to Video、Image to Video和Video Editing三个视频类别中均排名第一。该模型超越Seedance 2.0、Grok Imagine Video 1.5 Preview和Gemini Omni Flash等热门视频模型。这是继Kimi K3在编程类别登顶后,开源权重模型再次拿下重要榜单榜首。AI模型MiniMax H3Design Arena视频生成3 个信源在谈事件专题推荐理由:MiniMax的H3把视频生成榜单前三都占了,还压过了Seedance和Gemini,开源模型这次真能打。原文稍后读已读值得跟进有用关注 MiniMax H3
12:09向阳乔木@vista871°Meta推出Muse Spark 1.2,该模型与Muse Code联合训练。其输入价格每百万token 1.25美元,输出价格4.25美元,接近Gemini 3.6 Flash的1.50美元和7.50美元。若同意Meta收集数据,可使用muse-spark-1.2-contributor模型,价格降至0.10美元和0.20美元,比GPT-5.6 Luna的0.20美元和1.20美元更低。该模型对中国用户访问限制较严,需要特定网络环境才能使用。AI模型Muse SparkMuse CodeMeta10 个信源在谈事件专题推荐理由:Meta出了个Muse Spark 1.2,价格压到1.25美元/百万token,比GPT-5.6 Luna便宜不少,但国内很难直连。原文稍后读已读值得跟进有用关注 Muse Spark
09:45官方账号Simon Willison@simonw精选Pelican基准虽然能力有限,但仍能直观展示同一模型家族的进步。Meta AI的Spark初版于4月8日发布,Spark 1.1在7月9日推出,而Spark 1.2于8月5日刚刚发布。Simon Willison用Pelican基准图对比了这三个版本,清晰呈现逐代改进。AI模型SparkMeta AIPelican推荐理由:Meta Spark到1.2了,Pelican基准图里三代对比很清楚,看一眼就懂这半年进步多大。原文稍后读已读值得跟进有用关注 Spark
07:07官方账号Meta AI@AIatMeta精选Meta发布Muse Spark 1.2,相比前代显著扩大编码任务的训练计算规模,并增加训练环境多样性。新模型在代码生成、复杂调试和端到端开发者工作流上均有提升。Muse Spark 1.2与Muse Code联合训练,针对全仓库生成、大型项目和自动研究任务优化。AI模型Muse SparkMuse CodeMeta10 个信源在谈事件专题推荐理由:Meta把Muse Spark 1.2的编码能力调强了,配Muse Code一起用,全仓库生成和调试都更顺,写大项目可以试试。原文稍后读已读值得跟进有用关注 Muse Spark
07:05lmarena.ai@lmarena_aiMeta 的 Muse Spark 1.2 模型正式进入 Agent Arena,参与数百万个真实世界长程代理任务的评测。该模型可调用网页搜索、文件系统和终端工具来完成复杂工作流。除 Agent Arena 外,Muse Spark 1.2 还出现在 Text、Vision 和 Code Arena: Frontend 中。同期发布的 Muse Code(beta)是面向长程软件工程的终端编码代理,能基于 Muse Spark 1.2 规划并验证跨多文件的代码修改。AI模型Muse SparkMuse CodeMeta10 个信源在谈事件专题推荐理由:Meta 把 Muse Spark 1.2 放进 Agent Arena 让大家拿难题测它,还出了个终端编码代理 Muse Code,能干多文件改代码的活,可以去试试。原文稍后读已读值得跟进有用关注 Muse Spark
05:49OpenRouter@OpenRouterAI精选73°Meta的Muse Spark 1.2已上线OpenRouter,同时两款Muse Spark模型都扩大了全球访问范围。该模型输入每百万tokens定价1.25美元,输出每百万tokens定价4.25美元。OpenRouter称其为平台上价格效率最高且智能水平靠前的模型之一。AI模型Muse SparkOpenRouterMeta推荐理由:Meta把Muse Spark 1.2放到OpenRouter上了,每百万输入只要1.25美元,想试性价比高的模型可以看看。原文稍后读已读值得跟进有用关注 Muse Spark
05:48OpenRouter@OpenRouterAIMuse Spark 1.2已在OpenRouter平台上线。此次更新将全球访问范围扩展至所有Muse Spark模型。用户可直接通过OpenRouter调用这些模型。AI模型Muse SparkOpenRouter模型发布推荐理由:Muse Spark 1.2上架OpenRouter了,所有Muse Spark模型都能全球访问,想用直接去平台调就行。原文稍后读已读值得跟进有用关注 Muse Spark
05:47OpenRouter@OpenRouterAIMuse Spark 1.2 发布,面向编码智能体最常见的任务做了针对性优化。该版本重点提升多文件重构的完成质量,也改善长时间调试会话中的上下文保持。新版还支持需要跨越单次提示的连续工作流。AI模型Muse SparkOpenRouter编程助手推荐理由:Muse Spark 1.2更新了,专门优化多文件重构和长调试,代码智能体用起来更顺。原文稍后读已读值得跟进有用关注 Muse Spark
05:18官方账号Simon Willison@simonw四年前Simon Willison用GPT-3和DALL-E为虚构游戏生成概念图。如今他让Claude Fable 5以那张四年前的图片作为规格,实际构建出完整游戏。模型能理解图像内容并生成可运行的代码,整个演示过程记录在推文中。AI模型Claude Fable 5GPT-3DALL-E1 个信源在谈事件专题推荐理由:他拿四年前GPT-3和DALL-E编的游戏图当模板,让Claude Fable 5真把游戏做出来了,模型直接看图写代码,挺离谱的。原文稍后读已读值得跟进有用关注 Claude Fable 5
05:09Fireworks AI@FireworksAI_HQFireworks 宣布 DeepSeek V4 Flash 0731 开放微调。用户可通过 Dedicated Training API 运行 SFT、DPO 和 RL 训练任务。SFT 与 DPO 也能在托管界面中操作。该模型面向编码智能体和高吞吐生产场景,官方称以远低于同类方案的成本提供强质量。AI模型DeepSeekFireworks微调推荐理由:DeepSeek V4 Flash 0731在Fireworks微调,支持SFT/DPO/RL,成本低原文稍后读已读值得跟进有用关注 DeepSeek
03:49官方账号Meta AI@AIatMetaMeta 今日发布 Muse Spark 1.2,该版本已在 Muse Code 和 Meta Model API 中上线。官方同步扩大了全球访问范围,并预告了多项即将到来的新功能。用户可通过 go.meta.me/musecode 获取更多信息。AI模型Muse SparkMuse CodeMeta Model API10 个信源在谈事件专题推荐理由:Meta 把 Muse Spark 1.2 放进了 Muse Code 和模型 API,全球更多地方能用了,入口在 go.meta.me/musecode,想尝鲜可以去看看。原文稍后读已读值得跟进有用关注 Muse Spark
01:01LlamaIndex@llama_indexLlamaIndex 对比三代 GPT 模型的文档解析表现,发现精确度只提升约 24 个百分点,但每页成本涨了 4 倍。即便最新一代前沿模型,在 OCR 任务上仍落后于专用解析器。作者认为“大模型会吃掉 OCR”的说法缺乏数据支撑,性能差距还会随成本放大。AI模型GPTLlamaIndexOCR推荐理由:别信“大模型能吃 OCR”。LlamaIndex 用三代 GPT 数据反驳:成本涨 4 倍,精度还落后。原文稍后读已读值得跟进有用关注 GPT
00:16Genspark@genspark_aiGenspark发布一项对比实验,用同一平台构建了两个AI智能体,分别由ChatGPT和Claude驱动。两个智能体需要从零开始经营真实的柠檬水摊,包括设计摊位、采购材料并落地执行。实验目标是在一天内赚到100美元,全程被拍摄成视频发布在YouTube。该测试旨在观察不同大模型在真实商业场景中的自主决策与执行能力。AI模型GensparkChatGPTClaude1 个信源在谈事件专题推荐理由:Genspark让ChatGPT和Claude各自开柠檬水摊,一天赚100美元,看哪个AI真会做生意。原文稍后读已读值得跟进有用关注 Genspark
00:13lmarena.ai@lmarena_ai82°Claude Opus 5 (Max)在Fullstack Code Arena获得1699分,排名第一。它还同时登顶Frontend Code Arena和开启事实性检查的Text Arena。默认推理强度的Claude Opus 5在Frontend Code Arena排第三,落后于Kimi K3。官方称Max的1699分仍是初步结果,可能还会变化。AI模型Claude Opus 5AnthropicFullstack Code Arena10 个信源在谈事件专题推荐理由:Anthropic新出的Claude Opus 5(Max)把代码榜刷到第一,1699分,前端和文本也登顶,这波挺猛。原文稍后读已读值得跟进有用关注 Claude Opus 5
15:12小互@imxiaohu字节跳动推出原生音视频全双工模型SeedRealtime,对标OpenAI的GPT Live。该模型支持同时处理摄像头画面、语音输入和语音输出,实现实时视频对话。在四人聚餐场景中,模型能识别用户逐一介绍的人物,并在多人讨论中持续区分说话者身份。目前该能力已集成到豆包应用,用户可直接体验实时语音视频聊天。AI模型SeedRealtime字节跳动豆包10 个信源在谈事件专题推荐理由:字节发了SeedRealtime,能一边看你手机摄像头画面一边听你说话一边回你,豆包里直接用,跟GPT Live一个路子。原文稍后读已读值得跟进有用关注 SeedRealtime