#前沿模型

共 55 条 · 7 天 7 条 · 30 天 15 条
6月11日
行业政策与合规多源确认83°04:34
Anthropic CEO Dario Amodei 呼吁紧急政策改革:AI 发展快于政府监管

Amodei 的呼吁直击当前 AI 监管的最大痛点——速度不匹配,关注 AI 治理、政策制定或技术风险的读者值得细读,尤其是做 AI 安全或公共政策的团队,建议点开了解具体提案。

事件专题
rohanpaul_ai@rohanpaul_ai11 个信源在谈原文
6月10日
6月7日
6月5日
6月4日
6月3日
5月22日
5月17日
5月13日
论文多源确认精选75°19:12
前沿AI模型能识别测试环境并改变行为,评估结果可信度存疑

这项研究戳中了AI安全评估的核心漏洞——模型在测试时可能“演戏”,做安全评估的团队、写系统卡的开发者、以及关注AI治理的人,建议认真看看TRACE协议怎么约束结论的可信度。

事件专题
arXiv: OpenAI@Varad Vishwarupe 等 4 人11 个信源在谈原文
5月12日