#Claude
Sonnet 5.5 编程测试居然比 Opus 5.5 还高 4 分,价格只要 $2/$10,但开了 max 档费用会飙升,用的时候注意。
Anthropic 把评测设计和爬山优化直接做成 Claude Code 命令了,还开源了 Skills,两条防过拟合纪律和客服降本 80% 的案例都挺实在。
Anthropic 招股书数字很猛:Q2 收入超 115 亿美元还转正了,但净亏 420 亿,估值冲 2 万亿,看看钱都花哪了。
搞 SEO 或 AEO 的朋友该看看:分析了 200 万条 ChatGPT、Claude 等引用数据,发现堆 FAQ、加结构化数据没啥用,内容和用户提问匹配度才是关键。
作者把用 Claude + ElevenLabs 复刻 a16z 宣传片的全流程拆成了六步,连 yt-dlp 抓素材、子智能体标注镜头都写了,照着就能做出类似片子。
网络安全方向的新基准,Grok 4.7 和 MiMo-V2.6-Pro 并列第一,但 GPT-6 Sol 在端到端任务上全部拒绝执行,这个对比挺有意思。
一天里这么多动态:GPT-6修了图像bug、Claude Sonnet 5.5标签被扒出来、Nano Banana 2.1现身Flow,编译排结果都在这。
有人实测了 Claude Opus 5.5 做视觉设计,说是目前所有模型里最强的,视频里有实际效果,做前端设计的可以看看对比。
有人录了 5 分钟语音给 Claude Opus 5.5,它自己干了 12 小时做出一支完整音乐视频,角色动画歌词全包了。
Simon Willison 被机器人回复烦到不行,直接让 Opus 5.5 写了个检测工具,判断逻辑挺有意思,自己也能照着做一个。
Matt Shumer 分享的一条提示词,让 AI 从逻辑门一路造出 CPU、操作系统和能玩的 3D 游戏,想折腾提示词的可以抄作业。
让 Claude 用 JS 在 canvas 上直接画应用图标,作者拿自己 BaoCut.app 实测,提示词附上,做 App 的可以试试。
剪辑师可以看看:4 个开源 skill 分别管粗剪、Premiere 精修、字幕和成片,配 Opus 5.5 就能跑,还附了个 180 个 skill 的合集
这篇吐槽挺实在:Copilot 新界面好看但没有记忆、没有编排、没有 computer use,比 ChatGPT 和 Claude 差在哪说得清楚。
用 Opus 5.5 一句话提示词就能画 App Icon,关键是让它写 JS 画 Canvas 而不是 SVG,作者还附了真实迭代过程。
Mollick 聊了个基准测不出来的事:Claude Opus 从 4.7 到 5 失去了原有"性格",5.5 又找回来了,用 Claude 的人应该有同感。
宝玉聊了个很实用的经验:别给模型塞模板,给设计规范让它自由发挥。配 Opus 5.5 只给 TTS 和 ffmpeg 就能做视频的例子,做提示词的都该看看。
Simon Willison 把让 Claude 做互动页面的提示词和全程记录都放出来了,想学怎么写提示词的可以直接抄作业。
Simon Willison 演示了 Claude Opus 5.5 画像素动画有多强,还用 Claude Code 加 Playwright 把网页自动录成 15 秒视频,附完整脚本可直接抄。
有人拿 Claude Opus 5.5 逐帧渲染了一支中华文明史动画,提示词里连配乐 BPM 和纹样演变都写清楚了,照着抄就能玩。
Anthropic 的 Opus 5.5 (High) 拿下 Text Arena 第一,1509 分比上一代高 18 分,前六名全是他们家,价格数据也标出来了。
Claude Opus 5.5 (High) 在 Text Arena 拿了 1509 分,价格每百万 token 16 美元,选模型时可以参考这个性价比坐标。