8月24日
10:19
8月22日
02:43
8月19日
8月14日
21:08
21:08官方账号LangChain@LangChainAI
团队开始用多个智能体调用多个模型后,LLM支出控制难度骤增。没有设置控制规则,成本可能在察觉前飙升。本教程演示如何用LangSmith LLM Gateway设置并强制执行一致的预算限制。通过观看演示,可以了解具体的配置步骤和实际效果。
事件专题

推荐理由:你的团队在用多个智能体和模型吧?成本容易失控。看看LangSmith这个网关怎么设预算、强制执行,别等账单吓人。
8月5日
15:48
8月4日
02:20
02:20官方账号LangChain@LangChainAI
LangChain 为 LangSmith LLM Gateway 推出 BYOK 功能,允许用户使用自己的 API 密钥。该功能提供 fallbacks 备份、成本控制与速率限制等能力。用户可以利用现有合同,避免为 token 支付额外加价。

推荐理由:LangSmith Gateway 现在能自带密钥了,用你自己的额度,还能享受回退和限流,省掉加价。
7月31日
02:28
02:28Harrison Chase@hwchase17
76°
LangChain 推出的 LangSmith Gateway 进入公开测试阶段。该网关支持对最终用户设置支出和速率限制,并能在数据到达模型提供商前自动脱敏 PII。它可直接集成到编程代理工作流中,并允许访问 Kimi-K3 等开源模型。官方表示可通过单一网关跨模型和提供商管理回退策略。
事件专题

推荐理由:LangChain 发了新网关,能控制花销和速率,还能自动给数据脱敏,跟编程代理直接连,甚至支持 kimi-k3,干活更方便了。
02:15
02:15官方账号LangChain@LangChainAI
72°
LangChain 推出 LangSmith LLM Gateway 公开测试版,支持跨模型和提供商设置花费与速率限制、回退策略及敏感数据编辑。用户可在单一网关中管理 OpenAI、Anthropic 等多个模型。该功能旨在降低企业级 LLM 部署的运维成本和隐私风险。
事件专题

推荐理由:想统一管理多个模型的调用、控制成本和安全?LangSmith 这个网关能设额度、自动回退、拦截敏感数据,试试看。
7月17日
7月3日
18:27
18:27小互@imxiaohu
重新上线的 Fable 5 新增自动降级功能:当遇到简单问题时,模型会自主判断并降级到低级模型回答。这一行为会被记录到日志中。用户因此感到 Fable 5 没有之前聪明,实际上系统在优化资源。
事件专题

推荐理由:Fable 5 悄悄给简单问题换低级模型,省算力但用户觉得变笨了,你看看日志就知道了。
6月22日
22:26
6月19日
00:19
00:19官方账号LangChain@LangChainAI
LangSmith 推出 LLM Gateway,为 LLM 调用提供成本控制与安全防护。该网关可设定预算上限,防止智能体因循环或错误而消耗高达 1 万美元的 API 费用。它支持速率限制、密钥管理和实时监控,使开发者能安全部署智能体。
推荐理由:LangChain 出了个 LLM 网关,能设预算上限防止智能体烧钱,跑智能体再也不怕睡着后出事了。
6月16日
01:10
01:10官方账号LangChain@LangChainAI
LangChain 发现单个开发者使用编码代理每周可能产生数千美元费用。该团队内部构建了 LangSmith LLM Gateway 来监控和限制 API 调用。Gateway 支持设置预算警报和自动暂停,防止成本失控。LangChain 已将其作为产品功能开放。
事件专题

推荐理由:LangChain 分享自己怎么用 LangSmith Gateway 管住编码代理的烧钱速度,每周能省几千刀,做 AI 应用的人可以学学。
6月11日
22:54
22:54idoubi@idoubicc
开发者@idoubicc为了降低网站跳出率,在网站上添加了一个基于OpenRouter上Claude Fable5模型的聊天机器人。结果虽然带来了流量,但成本高昂,一天内被扣费两次,总计超过130美元。他计划将这一聊天机器人做成Shipany模板,加入支付订阅功能,实现开箱即用,支持任意模型对话。该事件反映了AI聊天机器人作为网站互动工具的商业化挑战。
事件专题

推荐理由:做网站流量优化的开发者注意了——加个AI聊天机器人可能带来流量,但成本失控风险极高。@idoubicc 的130刀教训值得所有用OpenRouter API的团队参考,建议点开看看如何避免烧钱。
6月10日
18:50
18:50orange.ai@oran_ge
有用户反映 Fable 5 模型的 API 价格较高,在 Agent 中执行一个最简单的查询就需要 0.5 美元,相当于一瓶可乐的价格。该用户提醒其他开发者在使用时要注意控制成本,避免不必要的开销。这一价格水平可能对高频调用或预算有限的团队构成挑战。
事件专题

推荐理由:Fable 5 的 API 定价让一次简单查询就花掉 0.5 美元,做 Agent 或高频调用的团队需要提前算好账,建议点开看看成本细节再决定是否接入。
6月3日
19:43
19:43官方账号Simon Willison’s Weblog博客/媒体
Uber 为控制成本,将每位员工每月在 AI 编程工具(如 Cursor 和 Claude Code)上的支出上限定为 1500 美元。该限制仅适用于代理式编码软件,且不同工具的预算互不影响。此举反映了企业对 AI 工具成本管理的重视,也表明 AI 编程工具在企业中的使用已进入规模化阶段。
事件专题

推荐理由:Uber 的预算限制给所有使用 AI 编程工具的企业团队提了个醒——成本管控已迫在眉睫。如果你是技术管理者或财务负责人,建议点开看看,了解如何平衡 AI 效率与支出。
00:50
00:50官方账号LangChain@LangChainAI
LangSmith 的 LLM Gateway 新增了消费限额功能,允许在组织、工作空间、用户或 API 密钥级别设置上限。当达到限额时,代理会收到清晰的 402 错误响应。这一功能帮助团队更好地控制 AI 调用成本,避免意外超支。对于使用 LangChain 构建 AI 应用的开发者来说,这是一个实用的成本管理工具。

推荐理由:做 AI 应用开发的团队终于可以精确控制 API 调用成本了——在组织、工作空间、用户或 API 密钥级别设置上限,超限时自动返回 402 错误,建议用 LangChain 的团队直接启用。
6月2日
5月30日
10:49
10:49官方账号Decoder@Matthias Bastian
一家未具名公司因未设置AI使用限制,一个月内竟在Anthropic的Claude模型上花费了5亿美元。这一事件凸显了企业在部署AI时缺乏专业能力,尤其是在模型选择和上下文工程方面,导致生产力承诺变成失控的成本。该案例警示企业,必须建立有效的使用监控和预算控制机制,否则AI投资可能迅速膨胀。
事件专题

推荐理由:这个案例给所有正在或计划大规模部署AI的企业敲响警钟——没有专业的使用管理和成本控制,AI带来的不是效率而是财务灾难。做AI采购或负责企业AI落地的团队,建议仔细看看这个教训。