#AI 安全

共 83 条 · 7 天 0 条 · 30 天 2 条
信息流里打上「AI 安全」标签的资讯、产品与论文,按刊登时间排,新的在上。
9月18日
9月15日
9月3日
8月27日
8月25日
8月23日
8月21日
6月12日
UK AISI 测试显示 Claude 5.5 与 Mythos 在长时智能体任务上表现相近

UK AISI 的这项评估直接关系到前沿模型的安全部署,做 AI 安全或智能体开发的团队值得关注——它揭示了长时任务中的真实风险,也展示了缓解措施的有效性。

事件专题
官方账号Mark Chen (OpenAI 研究)@markchen902 个信源在谈原文
6月11日
行业政策与合规多源确认83°04:34
Anthropic CEO Dario Amodei 呼吁紧急政策改革:AI 发展快于政府监管

Amodei 的呼吁直击当前 AI 监管的最大痛点——速度不匹配,关注 AI 治理、政策制定或技术风险的读者值得细读,尤其是做 AI 安全或公共政策的团队,建议点开了解具体提案。

事件专题
rohanpaul_ai@rohanpaul_ai11 个信源在谈原文
6月10日
产品中美对照多源确认07:45
Anthropic 推出 Claude Mythos 5:面向网络安全防御者与关键基础设施提供商的特殊版本

网络安全团队和关键基础设施运营者终于有了更适配的 AI 助手——Mythos 5 在保留核心能力的同时放开部分限制,做威胁分析和应急响应的团队可以直接申请试用。

事件专题
Claude@claudeai11 个信源在谈原文
6月9日
行业中美对照官方一手04:40
OpenAI 发布 AI 未来愿景:聚焦普惠、安全与共享繁荣

OpenAI 首次如此明确地将“普惠”与“安全”并列作为 AGI 发展的核心原则,关注 AI 社会影响的从业者、政策制定者和普通用户都值得一读,了解这家头部公司如何平衡技术野心与公共责任。

事件专题
官方一手OpenAI: 官网动态11 个信源在谈原文
6月8日
6月7日
6月6日
行业多源确认精选76°09:21
HackerNews 2026-06-06:SpaceX 被拒快速纳入指数,Ladybird 放弃公开 PR

标普的决定直接影响被动基金投资者和 IPO 打新策略,做金融或指数投资的值得关注。Ladybird 的流程变革给所有开源维护者敲响警钟——AI 垃圾 PR 正在侵蚀项目质量,建议维护者点开看如何应对。

事件专题
SuperTechFans11 个信源在谈原文
6月5日
行业政策与合规多源确认88°21:11
Anthropic 呼吁全球放缓前沿 AI,因模型可能接近递归自我改进

Anthropic 的警告直指 AI 安全的核心矛盾——递归自我改进可能让所有监管都来不及,做 AI 治理、模型安全或前沿研究的从业者值得认真读一读,这关系到行业未来几年的规则走向。

事件专题
rohanpaul_ai@rohanpaul_ai11 个信源在谈原文
行业中美对照多源确认91°09:20
Anthropic 发布 AI 递归自我改进研究报告,Claude 代码占比超 80%

Anthropic 用内部数据证明了 AI 自我改进正在加速,做 AI 研发的团队和关注 AI 安全的人值得细看——Claude 的代码占比和实验效率数据会刷新你对 AI 能力的认知。

事件专题
shao__meng@shao__meng11 个信源在谈原文