01:15官方账号OpenAI@OpenAI78°OpenAI发布由Cerebras驱动的Ultrafast,生成速度最高达每秒750 tokens。该服务将OpenAI最先进的模型引入实时语音和客户支持等场景。还覆盖商务、编程、设计、金融研究和安全响应等企业工作流。官方称这种高速度能为企业带来可衡量的竞争优势。AI产品OpenAICerebrasUltrafast10 个信源在谈事件专题推荐理由:OpenAI新推Ultrafast,由Cerebras加速,每秒能生成750 tokens,主打实时语音和客服,速度快,试试看。原文稍后读已读值得跟进有用关注 OpenAI
01:57a16z@a16z72°Decagon CEO Jesse Zhang 表示,企业开源模型采用率当前在下滑,开源推理占比正在走低,但这并非拒绝开源,而是采用扩散前的信号。企业启动新用例时会先用前沿模型,待流程跑通后,再迁移到更便宜、更快的开源模型。他透露 Decagon 自身 90% 的业务已运行在开源模型上。他还提到,客户支持需求永远超过供给,降低使用成本会带来更多购买。行业DecagonAI开源模型企业采用推荐理由:CEO说开源推理占比下降是好事:新用例先用前沿模型,成熟后换开源省钱。Decagon九成业务跑开源。原文稍后读已读值得跟进有用关注 DecagonAI
12:18IT之家(博客/媒体)韩国开发者 @remy_notes 收到 Anthropic 发出的 160 万美元和 1662 万美元两笔扣款账单,但 Claude API 控制台显示 0 美元。Anthropic 承认是计费系统 Bug 导致,实际未扣款,但多次扣款尝试导致开发者信用卡被冻结。开发者发 15 封邮件(后续增至 18 封)后,4 天才收到系统自动通知,问题转交人工处理。行业AnthropicClaude API计费系统Bug10 个信源在谈事件专题推荐理由:Anthropic 的计费系统搞出天价账单,实际没扣款却害人信用卡冻结,客服还慢吞吞。搞 AI 开发的朋友该看看这事儿。原文稍后读已读值得跟进有用关注 Anthropic
21:25rohanpaul_ai@rohanpaul_ai微软CEO萨提亚·纳德拉透露,微软正在内部应用“精益生产”理念于知识工作,借助AI提升效率。他借鉴丰田制造效率原则,将其应用于AI驱动的白领运营。例如,微软每年在客户支持上花费约40亿美元,通过部署AI代理进行前端问题拦截(在问题到达人工客服前解决)以及为支持人员提供实时推理辅助,大幅降低了Xbox和Azure支持等领域的成本。这展示了AI在企业内部运营中的实际投资回报率。行业微软AI代理客户支持推荐理由:纳德拉把丰田精益生产搬到AI时代,给所有做企业运营的团队一个可复用的降本思路——用AI代理拦截客服问题,每年省下数十亿,做客户支持或内部流程优化的建议点开看看。原文稍后读已读值得跟进有用关注 微软