22:48orange.ai@oran_ge中转站平台已下架Luna模型,因该模型价格过低导致运营亏损。Luna模型的利润甚至无法覆盖云服务成本,平台运营一天亏损一天。行业分析认为,当前模型价格已接近最低点,未来竞争将转向端侧模型。行业Luna中转站AI模型推荐理由:中转站下架Luna模型,揭示低价AI模型已无法盈利的行业现状。原文稍后读已读值得跟进有用关注 Luna
17:15Viking@vikingmute用户反映Codex的用量近期大幅缩减。过去一周用不完的套餐,现在两天内就会用完。100美元套餐的额度变得非常紧张。有用户回忆起最初2X pro版本时,几乎用不完额度。AI产品Codex模型定价用量限制推荐理由:看看Codex用户怎么说,他们的100美元套餐现在两天就用完了,和以前一周用不完的2X pro比差远了。原文稍后读已读值得跟进有用关注 Codex
04:51Gary Marcus@GaryMarcusRamp AI Index最新数据显示,OpenAI模型Fable 5在企业中的采用表现令人失望。多家企业反馈,该模型定价过高,即便性能强大且曾被短暂封禁,仍被普遍认为不值这个价。这一结果为Anthropic带来了希望,市场人士认为OpenAI可能因此陷入内部混乱。行业OpenAIAnthropicFable 510 个信源在谈事件专题推荐理由:Fable 5贵到企业不买账,OpenAI悬了,Anthropic的机会来了。原文稍后读已读值得跟进有用关注 OpenAI
20:26官方一手歸藏(guizang.ai)@op7418V4 Pro 0813 正式更新公告发布,同时确定新定价。新方案采用峰谷定价,峰值时段 Pro 模型输出价格较原来上涨超过 4 倍。空闲时段 Pro 模型定价比原来贵一倍多。此前下午发布的 V4 Pro 0813 模型存在问题,本次为修正后的正式版。AI模型V4 Pro 0813峰谷定价模型定价推荐理由:V4 Pro 0813 正式版定了,峰值输出价格涨了 4 倍多,用之前先看下钱包。原文稍后读已读值得跟进有用关注 V4 Pro 0813
20:23官方一手歸藏(guizang.ai)@op7418Deepseek官方发布V4 Pro 0813正式更新公告,内测群称约晚上8:25上线。该版本修正了下午模型的问题。定价改为峰谷模式,峰值时段Pro模型输出价格比原版贵4倍多,空闲时段贵1倍多。AI模型DeepseekV4 Pro 0813峰谷定价推荐理由:Deepseek正式发了V4 Pro 0813,价格也定了,峰值输出贵4倍多,要调用的话得挑空闲时段。原文稍后读已读值得跟进有用关注 Deepseek
19:17IT之家(博客/媒体)DeepSeek 公布调价方案,新价格于8月17日生效。DeepSeek-V4-Flash 缓存命中输入价降至每百万 tokens 0.02 元,V4-Pro 为0.025元。缓存未命中输入价分别为每百万 tokens 1元和3元,输出价分别为2元和6元。两个模型均支持1M上下文长度和最大384K输出,新版版本号分别为 DeepSeek-V4-Flash-0731 和 DeepSeek-V4-Pro-0813。AI产品DeepSeekDeepSeek-V4-FlashDeepSeek-V4-Pro10 个信源在谈事件专题推荐理由:DeepSeek把V4-Flash和V4-Pro的API价格调低了,缓存命中每百万tokens只要几分钱,做批量调用很划算。原文稍后读已读值得跟进有用关注 DeepSeek
15:00AI Will@FinanceYF5Bloomberg 的 AI 模型定价图没有收录 DeepSeek。原因是 DeepSeek V4 Flash 定价极低,输入仅 $0.14/百万 token,输出 $0.28/百万 token。若将其放入图中,其他模型的价位将显得毫无竞争力,因此被直接排除。这一遗漏引发讨论,有用户指出正是低价导致它无法与其他模型同图展示。行业DeepSeekBloombergDeepSeek V4 Flash9 个信源在谈事件专题推荐理由:Bloomberg 的AI定价图居然把 DeepSeek 整个漏了。原来 V4 Flash 输入只要 $0.14/百万 token,便宜到放上去其它模型都没法看。原文稍后读已读值得跟进有用关注 DeepSeek
01:19官方一手OpenAI Blog(博客/媒体)OpenAI发布了GPT-5.6模型,并下调了Luna和Terra计划的定价。新定价旨在提升性价比,使企业能够以更低成本大规模部署AI工作流。OpenAI强调更高效的模型能帮助企业实现规模化应用。AI产品GPT-5.6OpenAILuna10 个信源在谈事件专题推荐理由:OpenAI把GPT-5.6降价了,Luna和Terra现在更划算,适合企业批量部署AI工作流。原文稍后读已读值得跟进有用关注 GPT-5.6
09:28官方一手pandaily@contact@pandaily.com (Pandaily)76°Moonshot AI将Kimi K3定价为每百万token 3-15美元,是此前K2.6价格的3-4倍。该定价为DeepSeek同类模型的3-15倍,成为当前中国最贵的大模型。此举标志着Moonshot AI从成本领先战略转向高价值复杂任务能力。国内计算生态系统的成熟为其提供支撑。AI模型Kimi K3Moonshot AIDeepSeek10 个信源在谈事件专题推荐理由:Moonshot AI出了个超贵模型Kimi K3,比DeepSeek贵3-15倍,但专攻复杂任务,不是打价格战。原文稍后读已读值得跟进有用关注 Kimi K3
15:36AI Will@FinanceYF571°高盛报告指出,中国顶级编码模型GLM5.2和Qwen3.7 Max的每百万混合token成本约1美元,而美国SOTA模型为4-8美元。中国模型以低于成本价销售,高盛估计当前智能体模型EBIT利润率为-30%,编码模型为-39%,预计到2030年分别转为+14%和+22%。架构上,DeepSeek V4 Pro仅激活1.6T参数中的49B(<8%),GLM5.2激活744B中的40B,更低的FLOPs提供了价格下限。在OpenRouter上,中国模型按任务花费占比仅5-16%,但占据了85%的智能体token和89%的编码token。基准SDLLMTK从6月初约2.07降至当前1.67。行业GLM5.2Qwen3.7 MaxDeepSeek V4 Pro2 个信源在谈事件专题推荐理由:高盛给LLM经济学算了笔账:中国模型靠架构优势把价格打到美国1/4,但还在亏本卖。想搞清模型定价走势的可以看。原文稍后读已读值得跟进有用关注 GLM5.2
11:25Ethan Mollick@emollickAnthropic 和 OpenAI 计划以极低成本提供较弱版本的前沿模型,如 Haiku 和 Instant。通过拥有从弱到强的完整智能范围,它们可能提供“模型组织”,即多个模型协同工作。这种策略有望比任何第三方提供更低的成本和更高的性能。行业AnthropicOpenAIHaiku10 个信源在谈事件专题推荐理由:两大巨头开始卖便宜版模型(Haiku、Instant),而且能用模型组合拳打得第三方没脾气,价格和性能都占优。原文稍后读已读值得跟进有用关注 Anthropic
22:18Aadit Sheth@aaditsh精选73°Anthropic 恢复 Fable 5 访问,同时推出新模型 Sonnet 5,定价每百万 tokens 2 美元。该价格不到 GPT 5.5 的一半。此前 Fable 5 因出口管制被禁 18 天,期间开发者转向其他模型。Anthropic 希望低价新模型能吸引用户回归。AI模型AnthropicFable 5Sonnet 510 个信源在谈事件专题推荐理由:Anthropic 把 Sonnet 5 定价降到 $2/百万 tokens,比 GPT 5.5 便宜一半多,开发者有理由回来了。原文稍后读已读值得跟进有用关注 Anthropic
11:23小互@imxiaohu78°Anthropic 发布 Claude Sonnet 5,限时定价每百万 token 输入 $2、输出 $10,仅为旗舰 Opus 4.8($5/$25)的六成。官方评测显示,调高算力后 Sonnet 5 在部分任务上表现可追平 Opus 4.8。限时定价截至 2026 年 8 月 31 日,之后将涨至 $3/$15。AI模型Claude Sonnet 5Opus 4.8Anthropic10 个信源在谈事件专题推荐理由:Claude Sonnet 5 性价比很高,只要 Opus 4.8 六折的价格,部分任务还打平,适合想省钱的团队。原文稍后读已读值得跟进有用关注 Claude Sonnet 5
02:46OpenRouter@OpenRouterAI精选OpenRouter 正式推出官方 MCP 服务,让 AI 代理能实时查询模型定价、基准成绩和流行度数据。该服务可避免代理在代码中硬编码错误的模型 slug。视频演示显示代理能够动态选择模型、获取价格并测试性能。这使代理不再依赖六个月前的训练数据猜测模型选择。AI产品OpenRouterMCP模型定价推荐理由:OpenRouter 出了个 MCP,你的代理能实时查模型价格和排名,再也不怕写错模型名了。原文稍后读已读值得跟进有用关注 OpenRouter
09:45shao__meng@shao__meng有用户在 X 平台吐槽 Anthropic Claude 系列模型价格过高,并调侃如果 Claude Fable 5 推出 Fast Mode,输入价格可能达到每百万 token $60,输出价格高达 $300。该用户以幽默方式表达了对高昂成本的无奈,引发社区对 AI 模型定价合理性的讨论。目前 Anthropic 尚未回应或确认 Fable 5 的定价计划。行业AnthropicClaude模型定价10 个信源在谈事件专题推荐理由:AI 模型定价直接影响开发者和企业的使用成本,这条吐槽戳中了 Claude 用户对性价比的焦虑——如果你的项目依赖 Claude API,看完会重新算账。原文稍后读已读值得跟进有用关注 Anthropic
07:02官方账号Simon Willison’s Weblog(博客/媒体)83°谷歌在 I/O 大会上正式发布 Gemini 3.5 Flash,跳过预览版直接进入通用可用阶段。该模型支持 104 万输入 token 和 6.5 万输出 token,知识截止于 2025 年 1 月。价格显著上涨:输入每百万 token 1.5 美元,输出 9 美元,是前代 3 Flash Preview 的 3 倍、3.1 Flash-Lite 的 6 倍,接近 3.1 Pro 水平。尽管如此,谷歌仍将其部署到 Gemini 应用、AI 搜索模式、Antigravity 平台、AI Studio 等全线产品。同时推出新的 Interactions API(测试版),类似 OpenAI 的服务器端历史管理。这反映出三大 AI 实验室都在试探 API 客户的价格承受力。AI模型Gemini 3.5 Flash谷歌 I/O模型定价6 个信源在谈事件专题推荐理由:Gemini 3.5 Flash 价格翻倍但谷歌全线铺开,做 AI 应用开发的团队需要评估成本变化,建议点开看看定价对比和 API 新特性。原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash
06:41官方账号Simon Willison@simonw精选Google 推出 Gemini 3.5 Flash 模型,推理单价是 Gemini 3 Flash 的 3 倍。该模型将被用于 Google 多项自有产品。Simon Willison 在公开笔记中分析了其定价策略与性能权衡。当前 Gemini 3.5 Flash 在 MMLU 等基准上的得分尚未公布。AI模型Gemini 3.5 FlashGemini 3 FlashGoogle推荐理由:涨价3倍,Google自己先用原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash