#安全机制

共 7 条 · 7 天 0 条 · 30 天 1 条
信息流里打上「安全机制」标签的资讯、产品与论文,按刊登时间排,新的在上。
9月30日
9月6日
8月23日
6月18日
6月11日
产品多源确认21:00
Anthropic 撤回 Claude Fable 5 隐藏安全机制:敏感提示不再静默降级

Anthropic 这次让步解决了 AI 安全透明度的核心矛盾——做模型评估、安全测试或竞品分析的开发者,终于能分清是模型能力不足还是被静默降级了,值得关注后续误报率变化。

事件专题
rohanpaul_ai@rohanpaul_ai11 个信源在谈原文
6月10日