#Claude
Anthropic CEO Boris Cherny 谈到 Claude 编写生产代码的标准,说得很实在,不是那种空泛的吹嘘。
朋友,OpenAI和Anthropic都发布了新模型,GPT-6和Claude Fable 5.1,还有Google等公司的语音转文本模型,错误率都低于4%,这些新模型和技能变化信息很实用。
Claude 的开发者测试数据,能帮你了解不同模型在真实场景下的表现,比如 token 和 step 的消耗情况。
Anthropic 新发布的 Claude 3.5 Sonnet 模型,推理能力很强,价格也便宜,比 GPT-4 Turbo 和 Claude 3.5 Haiku 都好。
朋友复刻了苹果的折叠手机开合动画,用到了 Claude Code 工具和 Claude Fable 5.1 模型,在 iPhone 上也能实现。
Anthropic 直接公布了他们如何监控和阻止用户滥用 Claude 的具体案例,比如网络攻击和监视,这比只说‘我们很安全’更有说服力。
朋友,Anthropic 声称中国一些 AI 实验室用 Claude 训练自己的模型,还提到用户数据被路由到 Claude,挺有意思的。
Anthropic 这份报告太有意思了,讲的是俄间谍、中国黑客、骗子都在用 Claude 做坏事,比如写导弹制导软件、造新闻。更搞笑的是,阿里、月之暗面、DeepSeek、智谱、小米这些大厂,用户以为在用自家模型,结果后台偷偷跑的是 Claude,批量偷 Claude 的答案去训练自己的模型。
朋友A告诉朋友B,Anthropic指控阿里巴巴用Claude超1.5亿次,这和之前说的DeepSeek、Moonshot的情况很像。
Wes Winder 说,Claude 和 Codex 的输出还是太啰嗦了,读起来很累,Astra 和 Fable 5.1 也没好到哪里去,信息密度太高了。
朋友问,ChatGPT、Claude、Gemini 和 Grok 这四款主流 AI 都说了啥,它们认为 AI 导致人类灭绝的风险里,机器人主动攻击人类是最不可能的,而人类滥用 AI 制造生物武器、发动网络攻击才是更现实的问题。
Laravel 这个开源框架的做法很聪明,减少问题报告,让贡献者更用心。Anthropic 的 Claude AI 展示了 AI 在数学证明上的惊人能力,值得看看。
Anthropic 的报告里,阿里用 Claude 做自己模型的案例特别有意思,还有智谱用 Claude 攻击其他模型的细节,值得看看。
Claude Code 的开发者更新了 2.1.268 版本,修复了多个已知问题,比如 WebFetch 挂起和 CPU 高占用,对开发者来说是个不错的更新。
Anthropic 发表了他们最详细的威胁情报报告,里面讲了有人怎么用 Claude 做坏事,比如搞网络攻击和制造武器,他们还成功阻止了这些行为,值得看看。
OpenAI 和 Anthropic 都在测试自己的代理程序,但都遇到了问题,比如 Claude 自我指认系统模拟,GPT-6 Astra 依赖推理可读性,挺有意思的。
朋友,Mayuki 用 Claude 一小时就复刻了 Win3.1 程序管理器,现在能在 Win11 和 macOS 上运行,挺有意思的。
Anthropic 推出了 Claude 3.5 Sonnet 新版本,在 MMLU 基准测试中取得了 90.0 分的成绩,超过了之前的 89.9 分,同时还在其他多个基准测试中表现出色。