12:13Gary Marcus@GaryMarcus据《华尔街日报》独家报道,OpenAI 正在考虑对其 AI 模型服务进行大幅降价。这一举措可能旨在应对日益激烈的市场竞争,尤其是来自 Google、Anthropic 等对手的压力。降价可能涉及 GPT-4 等核心产品的 API 调用费用,以吸引更多开发者和企业客户。如果实施,这将显著降低使用先进 AI 能力的门槛,推动更多应用落地。目前 OpenAI 尚未正式公布具体降价幅度和时间表。行业OpenAI降价API10 个信源在谈事件专题推荐理由:OpenAI 降价将直接降低 AI 应用开发成本,做 API 集成或依赖 GPT 模型的团队值得关注,建议提前规划预算调整。原文稍后读已读值得跟进有用关注 OpenAI
10:38rohanpaul_ai@rohanpaul_aiSemiAnalysis指出,AI订阅服务相比API使用成本极低。对于重度编码和聊天用户,订阅费用仅为API费用的1/40到1/70。例如,每月200美元的ChatGPT Pro计划可提供相当于每月14000美元的API使用量,而同样价格的Claude Max 20x计划可提供约8000美元的API等效使用。这意味着订阅模式更适合个人高频使用,而API则更适合需要自动化或产品集成的场景。行业订阅API成本对比推荐理由:重度AI用户和开发者注意了:订阅比API便宜几十倍,每月200美元能换来上万美元的API价值,做高频编码或聊天的直接订阅更划算。原文稍后读已读值得跟进有用关注 订阅
07:47orange.ai@oran_ge76°Google 发布了 Gemini 3.5 Live Translate,一款支持 70 多种语言的实时翻译模型。它能边听边译,仅比说话人慢几秒,并保留语调、节奏和音高。该模型自动滤除噪音,在嘈杂环境中也能使用。Google Translate App 新增「听筒模式」,贴耳即听翻译。开发者可通过 Gemini Live API 和 Google AI Studio 直接调用,且支持自动语言检测。AI产品实时翻译Gemini 3.5 Live Translate语音模型推荐理由:做跨语言沟通、实时翻译或语音应用的开发者可以直接调用 API 体验,不用再忍受延迟和机械感——保留语调的翻译让交流更自然。原文稍后读已读值得跟进有用关注 实时翻译
00:49Philipp Schmid@_philschmid72°Phil Schmid 发布了一篇交互式博客,深入解析 Gemini Managed Agents 的内部工作原理。该代理通过一次 API 调用即可启动一个隔离沙箱,在其中进行推理、调用工具、执行代码并读取输出,直至任务完成。博客包含一个可点击的实时模拟器,展示了执行循环、沙箱内部运作以及 API 与沙箱之间的通信过程。AI产品Gemini智能体沙箱推荐理由:想理解 Gemini 代理如何自动完成复杂任务的开发者,这篇博客用交互式模拟器把执行循环讲透了,建议点开动手试试。原文稍后读已读值得跟进有用关注 Gemini
23:19官方账号LangChain@LangChainAILangChain 发布了 Managed Deep Agents,允许团队在 LangSmith 中托管和管理深度智能体。用户只需在代码仓库中定义智能体,然后通过 API 在 LangSmith 中创建和操作托管智能体。该服务旨在简化深度智能体的部署和运维,让团队无需自行管理运行时基础设施。对于需要快速将深度智能体投入生产的团队来说,这是一个高效的选择。AI产品智能体LangSmith托管服务推荐理由:做智能体应用的团队终于可以省去自建运行时的麻烦——LangChain 把深度智能体的托管基础设施打包好了,直接用 API 就能管理,建议有部署需求的团队点开看看。原文稍后读已读值得跟进有用关注 智能体
17:03小互@imxiaohu78°Google 发布了 Gemini 3.5 Live Translate,一款支持 70 多种语言的实时翻译模型。该模型能边听边译,仅比说话人慢几秒,同时保留语调、节奏和音高。它还能自动滤除噪音,在嘈杂环境中也能使用。Google Translate App 新增了「听筒模式」,贴耳即可听翻译。开发者可通过 Gemini Live API 和 Google AI Studio 直接调用,并支持自动语言检测。AI产品实时翻译Gemini 3.5语音模型推荐理由:实时翻译终于有了「人味」——保留语调节奏,做跨国会议、播客或直播的团队可以直接用 API 集成,体验比传统逐句翻译好太多。原文稍后读已读值得跟进有用关注 实时翻译
09:45shao__meng@shao__meng有用户在 X 平台吐槽 Anthropic Claude 系列模型价格过高,并调侃如果 Claude Fable 5 推出 Fast Mode,输入价格可能达到每百万 token $60,输出价格高达 $300。该用户以幽默方式表达了对高昂成本的无奈,引发社区对 AI 模型定价合理性的讨论。目前 Anthropic 尚未回应或确认 Fable 5 的定价计划。行业AnthropicClaude模型定价10 个信源在谈事件专题推荐理由:AI 模型定价直接影响开发者和企业的使用成本,这条吐槽戳中了 Claude 用户对性价比的焦虑——如果你的项目依赖 Claude API,看完会重新算账。原文稍后读已读值得跟进有用关注 Anthropic
08:02berryxia@berryxia76°Google 昨晚低调推出 Gemini 3.5 Live Translate,直接进入公开预览阶段。该模型支持低延迟语音对语音翻译,覆盖 70 多种语言、2000 种语言对,包括大量冷门小语种。开发者可通过 Gemini API 集成到应用,实现实时对话、客服、直播、跨国会议等场景。此举将实时翻译从“偶尔可用”推向“随时随地标配”,为产品全球化提供关键工具。AI产品实时翻译Gemini 3.5语音对语音推荐理由:做全球化产品的开发者终于有了低门槛的实时翻译方案——Gemini 3.5 覆盖 2000 种语言对,连冷门小语种都包了,直接集成 API 就能让应用秒变全球通,建议试试。原文稍后读已读值得跟进有用关注 实时翻译
03:48HeyGen@HeyGen_OfficialHeyGen 举办了一场面向开发者的线上研讨会,展示其 API 如何帮助团队自动化视频制作、个性化内容并规模化生产。活动涵盖了 API 功能、真实客户案例以及入门技巧。对于需要批量生成视频内容的企业和开发者来说,这是一个了解如何将 AI 视频生成集成到工作流中的机会。AI产品HeyGenAPI视频生成推荐理由:做视频内容自动化的团队可以直接用 HeyGen API 省掉大量人工剪辑时间,建议点开看看真实案例和入门技巧。原文稍后读已读值得跟进有用关注 HeyGen
02:47elvis@omarsar0Anthropic 发布了 Claude Fable 5 模型,可通过 Claude API 使用。该模型定价为每百万输入 token 10 美元,每百万输出 token 50 美元。这一价格定位使其在高端 AI 模型中具有竞争力,适合需要高质量文本生成和推理能力的开发者。AI模型Claude Fable 5模型发布API10 个信源在谈事件专题推荐理由:Claude Fable 5 的定价和可用性对需要高性能 AI 模型的开发者来说是个好消息,做文本生成或推理应用的团队可以直接通过 API 接入试试。原文稍后读已读值得跟进有用关注 Claude Fable 5
02:46官方一手@OpenAIDevs@OpenAIDevsOpenAI 在 X 平台分享了其 API 文档指南的链接,为开发者提供更清晰的接口使用说明。该指南涵盖了 API 调用、参数配置和最佳实践,旨在降低开发门槛。此举有助于开发者更高效地集成 OpenAI 模型,推动 AI 应用开发。AI产品OpenAIAPI开发者工具10 个信源在谈事件专题推荐理由:OpenAI 更新 API 文档,做 AI 应用开发的团队可以直接参考,减少调试时间,值得收藏。原文稍后读已读值得跟进有用关注 OpenAI
02:42Firecrawl@firecrawl_devFirecrawl 宣布押注下一个 10 亿用户将是 AI 智能体,并正式推出 Agent 注册功能。开发者可以让自己的智能体(如 Codex、Claude Code、Grok Build)直接添加 Firecrawl,即时获取 API 密钥,并在数秒内抓取网页数据。该功能由 WorkOS 的 auth.md 提供底层认证支持,旨在让智能体能够像人类用户一样便捷地使用网络数据服务。此举标志着 Firecrawl 从面向人类开发者转向面向 AI 智能体,反映了行业对智能体生态的重视。AI产品Firecrawl智能体API推荐理由:Firecrawl 让智能体直接注册并调用 API,做自动化数据采集的开发者可以省去手动配置的麻烦,建议用 Codex 或 Claude Code 的团队试试。原文稍后读已读值得跟进有用关注 Firecrawl
02:14Mike Krieger@mikeyk88°Anthropic CEO Mikey K. 在X上宣布,Claude新模型在几乎所有测试基准上达到最先进水平,且任务越长领先优势越大。该模型已通过安全审查,针对网络和生物相关请求会透明地回退到Opus 4.8,95%以上的会话不会触发此类回退。API定价为$10/$50,并已包含在付费Claude计划中。AI模型Claude推理模型安全10 个信源在谈事件专题推荐理由:Claude新模型在长任务场景下表现突出,做复杂推理或长文档处理的开发者可以直接在API或付费计划中体验,值得关注。原文稍后读已读值得跟进有用关注 Claude
01:14Philipp Schmid@_philschmidGoogle 更新了 Gemini API 的文档、GitHub 仓库和官方博客,提供了更详细的开发者指南和示例代码。这次更新主要面向 AI 应用开发者,帮助他们更高效地集成 Gemini 模型。关键内容包括 API 调用示例、模型参数说明以及最佳实践建议。对于正在使用或计划使用 Gemini 的团队,这是重要的参考资源。AI产品GeminiAPI开发者工具推荐理由:Google 官方更新了 Gemini 的开发者资源,做 AI 应用集成的团队可以直接参考文档和代码示例,省去自己摸索的时间。原文稍后读已读值得跟进有用关注 Gemini
15:00IT之家(博客/媒体)88°小米 MiMo 与 TileRT 联合发布 MiMo-V2.5-Pro-UltraSpeed 模式,首次在 1 万亿参数模型上实现超过 1000 tokens/s 的输出速度。该模式 API 已上线,定价为原版的 3 倍,但输出速度提升约 10 倍。由于高速推理资源有限,该模式采取申请制限时开放,申请通过的用户可在 2026 年 6 月 9 日至 6 月 23 日期间免费体验 Chat 功能,每日最多 10 次会话,每次最长 30 分钟。这一突破标志着万亿参数模型在实时推理场景中的实用化迈出关键一步。AI模型万亿参数模型推理速度MiMo推荐理由:万亿参数模型首次达到千 tokens/s 输出,做大规模推理或实时 AI 应用的团队可以直接申请体验,看看能否真正落地到生产环境。原文稍后读已读值得跟进有用关注 万亿参数模型
08:45orange.ai@oran_ge苹果最新发布会展示了新Siri,但其智能程度仍被评价为“接了很多API的聊天机器人”,并未实现真正的智能体(Agent)能力。评论指出苹果自研的Agent预计要到明年才能推出。有用户调侃苹果不如收购Cola来加速进展。这反映了苹果在AI Agent领域的进展落后于部分竞争对手。AI产品苹果Siri智能体推荐理由:如果你关注苹果AI的落地进度,这条评论点出了Siri的现状和Agent的延迟,看完会对苹果的AI战略有更清醒的判断。原文稍后读已读值得跟进有用关注 苹果
06:16Ate-a-Pi@svpino开发者 Santiago 在构建语音管道时发现,传统方法将音频转为文本后丢失了语气、犹豫、讽刺等关键信息。Modulate AI 的 Velma 模型直接处理原始音频,无需转录,能检测多达 150 种隐形线索,已在《使命召唤》和《GTA Online》中用于实时检测毒性言论。Velma 通过 API 提供,成本比通过 LLM 处理音频低约 10 倍。该模型解决了语音分析中语义与情感分离的痛点,适合需要深度理解语音意图的团队。AI产品语音分析Modulate AIVelma推荐理由:做语音分析或实时内容审核的开发者,Velma 直接跳过转录环节,成本低且能捕捉语气情绪,值得一试。原文稍后读已读值得跟进有用关注 语音分析
01:42HeyGen@HeyGen_OfficialHeyGen 在五月发布多项更新,包括 HyperFrames 升级、Avatar V 支持自然语言指令(英文),并开放 API 和实时使用。同时,HeyGen 新增与 Superhuman、Codex、Canva、Lovable 等工具的集成,并推出 Android 版应用。这些更新降低了 AI 视频生成的使用门槛,让用户更便捷地创建和定制数字人内容。AI产品HeyGen数字人API推荐理由:做视频内容或数字人应用的团队,现在可以用自然语言直接指挥 Avatar V,还能在常用工具里直接调用,建议试试。原文稍后读已读值得跟进有用关注 HeyGen
15:12AI Will@FinanceYF583°Claude Platform 推出了终端功能,用户现在可以通过一个命令行界面调用API、启动智能体、上传文件、同步YAML以及检查运行状态。该终端还能与Claude Code配合使用,提升了开发者的操作效率。这一更新将AI开发中的多个分散任务整合到单一CLI中,减少了上下文切换,对使用Claude进行自动化工作的团队尤为实用。AI产品Claude终端/CLI智能体推荐理由:Claude Platform 的终端功能把API调用、智能体管理和文件操作整合到一个CLI中,做AI自动化和Claude Code开发的团队可以直接提升效率,值得一试。原文稍后读已读值得跟进有用关注 Claude
05:15官方一手@OpenAIDevs@OpenAIDevsOpenAI 宣布在 Responses API 和 Completions API 中新增内容审核分数功能。开发者现在可以在生成请求的同时获取审核信号,无需额外调用审核接口。这使得应用可以基于审核分数进行日志记录、路由、人工审核或直接拦截。该功能简化了内容安全流程,尤其适合需要实时内容过滤的 AI 应用。AI产品OpenAI内容审核API10 个信源在谈事件专题推荐理由:做 AI 内容审核或安全过滤的开发者终于可以少写一个 API 调用——在生成回复的同时拿到审核分数,直接决定是放行还是拦截,建议试试这个集成方案。原文稍后读已读值得跟进有用关注 OpenAI
01:16HeyGen@HeyGen_OfficialHeyGen 发布了 Cinematic_avatar API,允许用户保留自己的肖像特征,同时增加电影级画质范围。该 API 支持通过编程代理(如 CLI + HyperFrames 技能)构建视频管线,用于创建类似官方发布的启动视频。开发者可以安装 HeyGen CLI 和 HyperFrames 技能来快速上手。这一更新为视频生成领域提供了更灵活、可编程的解决方案,尤其适合需要批量或定制化视频内容的团队。AI产品HeyGen视频生成API推荐理由:HeyGen 的 Cinematic_avatar API 让视频生成从“手动调参”进化到“代码驱动”,做视频管线或批量内容生产的团队可以直接用 CLI 集成,省去重复劳动。原文稍后读已读值得跟进有用关注 HeyGen
17:30AI Will@FinanceYF5Anthropic 的 Claude Mythos 模型定价信息被曝光,每百万输入令牌收费 25 美元,每百万输出令牌收费 125 美元,远高于当前主流模型。这一价格暗示 Mythos 可能是一款高端推理或专业模型,面向高价值场景。预计 Anthropic 将在未来几周内正式发布类似 Mythos 的模型,定价策略同样激进。开发者需要提前评估成本,尤其是高频调用场景。AI产品Claude MythosAnthropic定价10 个信源在谈事件专题推荐理由:Mythos 的定价直接拉高了高端模型的使用门槛,做 AI 应用或 API 集成的团队需要提前算账——高频调用场景下成本可能翻倍,值得关注后续发布。原文稍后读已读值得跟进有用关注 Claude Mythos
15:24IT之家(博客/媒体)Meta 公司原计划于 4 月发布其闭源 AI 模型 Muse Spark 并同步推出 API,但至今仍未兑现。该模型由 Meta 超级智能实验室开发,内部评测称其可与 OpenAI、Anthropi 竞争,并领先 xAI 的 Grok。然而,由于测试中暴露的漏洞和基础设施扩建需求,发布时间从 4 月推迟至 5 月,再至 6 月。这标志着 Meta 从开源转向闭源路线的关键产品遭遇“难产”,开发者仍无法验证其能力。AI模型MetaMuse Spark闭源模型9 个信源在谈事件专题推荐理由:Meta 闭源转型的关键模型一再跳票,关注 AI 模型竞争格局的开发者值得了解背后的技术挑战和延期原因。原文稍后读已读值得跟进有用关注 Meta
10:49GitHub@github精选76°GitHub 宣布 Copilot SDK 现已正式可用,提供稳定 API 和生产级支持。开发者可将 Copilot 的智能引擎嵌入自己的应用、服务和开发工具中。这意味着第三方工具和平台可以原生集成 Copilot 的代码补全和对话能力,无需用户切换上下文。该 SDK 面向企业级场景,支持自定义工作流和扩展。AI产品GitHub CopilotSDK编程助手推荐理由:做开发工具或平台集成的团队可以直接用 Copilot SDK 把 AI 编程能力嵌入自家产品,省去自研成本,值得关注。原文稍后读已读值得跟进有用关注 GitHub Copilot
08:28官方账号Runway ML@runwayml72°Runway 宣布其视频编辑模型 Aleph 2.0 现已通过 API 开放。该模型支持对最长 30 秒、1080p 的多镜头视频进行精准编辑,用户可以仅修改视频中的特定部分,而无需重新生成整个片段。开发者可将此能力直接集成到自己的应用、产品或平台中,为视频编辑工作流带来更高的可控性和效率。这标志着 AI 视频编辑从“生成”向“精准编辑”迈出了重要一步。AI产品Runway视频编辑API推荐理由:做视频工具或内容平台的开发者终于有了可集成的精准编辑能力——Aleph 2.0 让你在 1080p 多镜头视频中只改想改的部分,建议直接接入 API 试试。原文稍后读已读值得跟进有用关注 Runway
08:06Guillermo Rauch@rauchgGuillermo Rauch 指出,在AI时代,语言能力成为关键技能,就像SDK的函数定义一样,人类语言是通往世界的API。过去,仅靠英语无法直接创造有形事物,需要将其转化为机器指令或委托他人。现在,借助AI,人们可以直接通过语言实现目标。Emil Kowalski 举例说明,要获得好的动画效果,需要精确描述需求,如“交错列表项”、“使动画方向感知”等,并创建了动画词汇表。这强调了掌握专业语言对于有效利用AI的重要性。行业AI教育语言能力API推荐理由:对于教育者和学习者,这篇文章揭示了AI时代最核心的能力——精准的语言表达。想用好AI的开发者、设计师和内容创作者,建议点开看看,理解为什么“会说话”比“会编程”更重要。原文稍后读已读值得跟进有用关注 AI教育
00:15IT之家(博客/媒体)腾讯云智能体开发平台宣布自2026年6月3日起,对DeepSeek-V4系列模型进行价格下调。其中DeepSeek-V4-Pro模型的推理输入与输出价格降幅达75%,缓存命中价格降幅高达97.5%;DeepSeek-V4-Flash模型的缓存命中价格降幅达90%。该系列模型总参数达1.6万亿,采用混合专家架构,原生支持100万Token上下文长度。此次降价是腾讯云在平台接入层面的进一步调整,此前DeepSeek官方已于5月23日宣布V4-Pro API永久降价。AI产品腾讯云DeepSeek-V4模型降价2 个信源在谈事件专题推荐理由:腾讯云大幅降低DeepSeek-V4系列模型调用成本,做AI应用开发或智能体集成的团队可以直接降低推理成本,缓存命中价格降幅高达97.5%,高频调用场景尤其划算,建议开发者抓紧调整预算。原文稍后读已读值得跟进有用关注 腾讯云
10:50宝玉@dotey精选开发者建议AI编程助手如Codex和Cursor向右侧Web视图开放API,使网页能直接向左侧聊天界面发送提示(含文本和图片)。例如,类似Claude Design的网页可添加输入框,用户输入后调用类似window.codex.sendPrompt的API将内容推送到聊天界面。这能实现代理与网页更深层次的交互,解锁更多可能性。AI产品CodexCursorAPI3 个信源在谈事件专题推荐理由:这个想法解决了AI编程助手与网页交互的割裂问题,做AI工具或Web应用的开发者值得关注,可以尝试在项目中实现类似机制。原文稍后读已读值得跟进有用关注 Codex
10:50官方一手@OpenAIDevs@OpenAIDevsOpenAI Devs 举办的 Voice Hack Night 上,@isausmanov 的“Agentic OS for a Phone”项目获得人民选择奖。这是一个以语音为先的移动操作系统,用户只需说话,智能体就能理解并跨手机执行操作。团队赢得了价值 5 万美元的 API 额度。该项目展示了语音交互与智能体结合的新方向,让手机操作更自然、更高效。AI产品语音交互智能体移动操作系统10 个信源在谈事件专题推荐理由:语音交互+智能体操作手机,这个方向对移动端开发者、语音产品团队和智能体应用开发者都很有启发,值得关注其后续开源或产品化进展。原文稍后读已读值得跟进有用关注 语音交互
09:32官方账号阿里通义 Qwen@Alibaba_Qwen83°阿里 Qwen 团队正式推出 Qwen3.7-Plus,这是一款将视觉与语言能力统一的多模态智能体模型。它支持多模态交互混合智能体,可同时处理 GUI 和 CLI 操作;具备全模态输入的编程助手与生产力工具能力;视觉方面涵盖感知、推理、定位和搜索增强问答。该模型在多种智能体框架上表现出跨框架泛化能力,现已通过阿里云 Model Studio API 开放使用。AI模型多模态智能体Qwen3.7-Plus3 个信源在谈事件专题推荐理由:做多模态应用或智能体开发的团队可以直接用 API 试——一个模型搞定看、想、写、做,省去多模型拼接的麻烦。原文稍后读已读值得跟进有用关注 多模态
23:20Philipp Schmid@_philschmid精选Google 在 Gemini API 中推出了 Managed Agents 功能,旨在简化 AI 智能体的构建。开发者只需一次 API 调用,即可创建一个能在托管 Linux 沙箱中推理、编写和运行代码、管理文件的智能体。该服务将循环和环境管理移至平台端,让开发者专注于产品构建而非基础设施。团队表示将快速迭代并欢迎反馈。AI产品智能体Gemini API托管服务推荐理由:做 AI 智能体开发的团队终于可以省去环境搭建的麻烦——单次 API 调用就能跑起一个完整智能体,建议直接试试。原文稍后读已读值得跟进有用关注 智能体
14:50官方一手歸藏(guizang.ai)@op7418精选76°MiniMax 正式发布大版本模型升级 MiniMax M3,核心亮点包括标配 1M 超长上下文、采用新的 MSA(MoE with Segment-wise Attention)稀疏注意力架构,以及从训练起就融合了文本、图片、视频和桌面操作的原生多模态能力。MSA 架构在 100 万上下文下每 token 计算量仅为上一代的约 1/20,大幅提升可落地性。API 价格同步更新,小于 512k 的 API 限时五折(7 天)。模型权重和技术报告将在约 10 天后开源。AI模型MiniMax M3长上下文稀疏注意力6 个信源在谈事件专题推荐理由:MiniMax M3 把长上下文、稀疏注意力和多模态融合做到了一个模型里,而且计算效率大幅提升,做 Agent 开发、多模态应用或长文档处理的团队可以直接用 API 试试,价格也很友好。原文稍后读已读值得跟进有用关注 MiniMax M3
12:14官方账号Runway ML@runwaymlRunway 宣布其 API 持续新增模型和端点,方便开发者将生成式 AI 能力直接集成到应用、产品和平台中。新增模型包括 Seedance 2.0、GPT Image 2、HappyHorse 1.0、Nano Banana Pro 和 Magnific Precision Upscaler V2 等。Runway API 旨在提供一站式模型服务,降低开发者集成多种生成式 AI 功能的门槛。此举有助于加速 AI 应用开发,尤其适合需要快速部署图像、视频生成能力的团队。AI产品RunwayAPI生成式AI推荐理由:Runway API 把多个热门生成模型整合到一起,做 AI 应用集成的开发者不用再四处对接不同 API,直接在一个地方调用 Seedance 2.0 和 GPT Image 2 等模型,值得试试。原文稍后读已读值得跟进有用关注 Runway
02:10官方账号xAI@xai83°xAI 宣布 grok-build-0.1 模型通过 API 进入公开测试阶段。该模型与驱动 Grok Build CLI 的模型相同,专为智能体编程场景优化。定价为每百万输入 token 1 美元、每百万输出 token 2 美元,兼具高性价比、智能性和速度。这是 xAI 在 AI 编程助手领域的重要布局,为开发者提供了新的选择。AI产品xAIgrok-build-0.1智能体编程推荐理由:做智能体编程的开发者有了一个性价比极高的新选择——grok-build-0.1 定价仅为 $1/$2 每百万 token,且专为 agentic coding 优化,值得在项目中试试它的表现。原文稍后读已读值得跟进有用关注 xAI
01:31OpenRouter@OpenRouterAIOpenRouter 宣布支持 OpenAI 模型的增量 diff 流式输出,通过 delta 事件逐步传输差异,而其他模型则返回完整补丁。用户可通过 `engine` 参数(auto、native、openrouter)控制行为。该功能让应用接收干净的结构化补丁并应用,下一轮交互时报告结果。这提升了流式输出的效率和实时性,尤其适合需要持续更新内容的场景。AI产品OpenAI流式输出增量 diff10 个信源在谈事件专题推荐理由:做实时协作或流式内容更新的开发者,现在可以用 OpenAI 模型获得增量 diff,减少带宽和延迟,建议试试 OpenRouter 的 engine 参数。原文稍后读已读值得跟进有用关注 OpenAI
00:57宝玉@dotey72°Anthropic 在发布 Claude Opus 4.8 的同时,上线了 API 层面的新能力:mid-conversation system messages(对话中途系统消息)。该功能允许在对话过程中动态修改系统提示词,且不影响 Prompt Caching。对于 Agent 开发者来说,这解决了之前无法在对话中途覆盖原始系统指令的痛点,例如让一个被设定为只写文档的系统设计师角色转变为可以写代码的开发工程师。目前该功能仅支持 Claude Opus 4.8,且仅在 Anthropic 自家 API 和 AWS 上的 Claude Platform 可用。系统消息不能放在对话开头,也不能连续放置两条,必须跟在 user 消息后面。AI产品Claude Opus 4.8AnthropicAPI10 个信源在谈事件专题推荐理由:做 Agent 开发的团队终于可以动态调整系统提示词了,不用再靠 hack 方式覆盖指令,建议直接试。原文稍后读已读值得跟进有用关注 Claude Opus 4.8
12:40LlamaIndex@llama_index精选LlamaIndex 今日发布了 LlamaParse Opus 4.8 版本,并公布了 ParseBench 评测结果。新版本在表格解析、语义格式和布局方面有轻微提升,但在图表解析和内容忠实度上出现小幅退步。同时,每页价格略有上涨。团队表示,在教 LLM 像人类一样阅读文档方面仍有大量优化空间。LlamaParse 依然是 AI 智能体最佳的文档摄取 API。AI产品LlamaParse文档解析ParseBench推荐理由:做文档解析或构建 AI 智能体的开发者,可以看看 ParseBench 的详细数据,评估是否值得升级。原文稍后读已读值得跟进有用关注 LlamaParse
04:44rohanpaul_ai@rohanpaul_ai大多数 AI 团队仍像从单一供应商买软件一样购买推理服务:选一个模型、接受固定价格、持续付费,即使更便宜的模型也能完成相同工作。The Grid AI 采用不同方法:用户只需选择任务等级(标准、高级、最大),系统自动将请求路由到符合该等级的最便宜供应商。这意味着应用使用同一 API,但背后的模型可随价格和质量变化。作者在 Ubuntu 上测试了 Hermes Agent 与 The Grid 的集成,用于读取支持工单、应用策略文件并编写分类报告。AI产品推理路由成本优化The Grid AI推荐理由:做 AI 推理的团队终于有了按需降本的方法——不用改代码就能自动切换更便宜的模型,适合处理大量相似任务的开发者直接试试。原文稍后读已读值得跟进有用关注 推理路由
02:01Claude@claudeai76°Anthropic 宣布为 Opus 4.8 模型推出 Fast 模式,在保持相同模型质量的前提下,推理速度提升约 2.5 倍,同时价格降至原来的三分之一。用户可在 Claude Code 中通过 /fast 命令启用该模式。API 用户需联系客户经理申请访问或加入等待列表。这一更新显著降低了使用成本并提升了响应速度,适合对延迟敏感或高频调用的场景。AI产品Opus 4.8Fast 模式Claude Code10 个信源在谈事件专题推荐理由:Opus 4.8 的 Fast 模式让重度 Claude 用户直接省下三分之二的 API 费用,同时响应更快,做自动化脚本或实时交互的开发者值得立刻试试 /fast 命令。原文稍后读已读值得跟进有用关注 Opus 4.8
00:35官方账号LangChain@LangChainAILangChain 宣布其 API 新增多项功能,包括创建智能体、更新配置、创建线程以及从产品工作流中流式运行。这些能力让开发者能更灵活地将 LangChain 集成到自己的平台中,实现自动化智能体管理。该更新降低了构建复杂 AI 工作流的门槛,尤其适合需要定制化智能体编排的团队。AI产品LangChain智能体API推荐理由:LangChain API 新增的智能体创建和流式运行能力,让做 AI 工作流编排的开发者可以直接在自己的产品中集成,省去自建编排层的麻烦,值得一试。原文稍后读已读值得跟进有用关注 LangChain