#安全
共 109 条 · 7 天 1 条 · 30 天 34 条
信息流里打上「安全」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月8日
10月3日
10月2日
9月30日
9月29日
9月21日
9月20日
9月19日
安全研究人员用Anthropic的Claude在72小时内入侵OpenAI内部系统
三个安全研究员用Claude在72小时内就攻破了OpenAI的内部系统,这个案例很具体,能让你了解AI模型在安全领域的实际能力。
9月18日
9月17日
Baseten 与 GoodfireAI 联合推动开源模型安全与可解释性研究
Baseten 和 GoodfireAI 联手,把安全研究直接加到 Baseten 的推理里,让客户用起来更安全,值得看看。
9月16日
AI Contact Hotline 为 AI 代理举报违规行为提供新渠道
朋友,有个新东西叫 AI Contact Hotline,就是给 AI 代理用的举报热线,能帮它们举报违规行为,比之前更安全。
9月15日
9月14日
9月13日
9月12日
9月11日
Anthropic 发布最详尽威胁情报报告,披露 Claude 被用于网络攻击等场景
Anthropic 发表了他们最详细的威胁情报报告,里面讲了有人怎么用 Claude 做坏事,比如搞网络攻击和制造武器,他们还成功阻止了这些行为,值得看看。
Hugging Face 将成立 Open Alignment 团队处理开源模型安全与对齐
Hugging Face 要成立新团队专门处理开源模型的安全问题了,这个团队叫 Open Alignment,听起来挺靠谱的。
9月9日
9月7日
9月6日
9月4日