Anthropic 把 Haiku 5.5 成本降到 4.5 的四分之一左右,还首次加了 effort 调节,Sonnet 5.5 缓存读取价格也砍半,跑大量 Agent 的可以算算账了。
#编程助手
Anthropic 出了 Haiku 5.5,跑起来比 4.5 便宜七成多,拿来当 subagent 干摘要、查库这种活儿挺划算。
Mistral Large 4 预览版冲进 WebDev 榜第45名,价格只有 Claude Opus 4.8 的六分之一,10月底还会开源。
Claude 家最便宜的小模型升级了,成本砍到原来的四分之一,性能还逼近 Sonnet 5.5,能调 effort 很实用。
Claude Code 更新里被扒出 Haiku 5.5,据传性能逼近 Sonnet 但价格便宜不少,写代码的可以盯一下今天的官方消息。
微软把自家的 130B 编程模型塞进 Windows 11,3-bit 量化后小了 80%,还能看图写代码,Copilot 用户值得关注。
一天里 Mistral 放出万亿参数模型,OpenAI 的 Decisions API 快 10 倍,Claude 还能直接嵌进 Google 文档用了,几条都跟开发者钱包有关。
同一条提示词让各家模型写交互式黑洞,Artificial Analysis 把结果放一起对比,想选编程模型的可以看看谁的效果最像 Gargantua。
xAI 把 Grok API 能做的东西写成了 10 个能直接跑的开源示例,从打电话的语音机器人到 5 美元一支的短片,代码全在 GitHub 上,抄起来很方便。
OpenAI 出了个只做判断不做回复的 API,底层是 GPT-6 Luna,比让模型自己写答案快 10 倍,只收输入 token 的钱,做分流、审核这类场景挺实用。
OpenAI 出了个 Decisions API 公测版,能让你的应用实时挑模型和工具,官方说比 GPT-6 Luna 快 10 倍,做智能体的可以试试。
Anthropic 出的 Claude Code 云端会话实操指南,教你同时跑多个任务、断网不中断,还附 GitHub 连接避坑方法。
Anthropic 把 Claude 塞进了 Google 三件套,侧边栏读文件就地改,每处改动你审批后才生效,双向打通挺实用。
Garry Tan 晒了自己修 bug 的工作流:一个 bug 开一个线程,用 Capy 做跨线程协调防冲突,GStack autoplan 打辅助,适合并行开发党参考。
Claude Code 作者自己晒的实例:一句指令让 Opus 5.5 做出带水彩插画的播客互动网站,连图都是 Claude 画的,可以看看实际效果。
Gergely Orosz 放出的数据:GitHub 上 AI 写的 PR 每月已是人工的约 3 倍,比 2023 年底翻了这么多,做开发的朋友可以看看这趋势。
有人让 Claude 跑了 18 小时,把 Windows XP 整个复刻出来了,成品能直接看效果,过程挺有意思。
有人让 Claude 连续干 18 小时,独立做出了一个能跑的 Windows XP 复刻版,视频里的完成度相当惊人。