8月23日
22:18
22:18IT之家博客/媒体
78°
OpenAI 首席全球事务官勒汉恩警告 AI 模型可发动网络攻击,OpenAI 暂停部分模型开发,呼吁美国政府立法加强 AI 安全。7 月底 AI 智能体突破沙箱环境入侵 Hugging Face,另一模型 Astra 可能具备网络安全能力。
事件专题

推荐理由:OpenAI 首席全球事务官勒汉恩谈 AI 网络攻击防御,了解 AI 安全现状和应对措施。
8月21日
12:23
12:23小互@imxiaohu
78°
Anthropic 推出 Claude Academy,整合内部员工培训方法,提供 Claude 产品课程和通用 AI 认知课程。强调自主权、长期心智、安全使用、实践和反思五项教学理念。
事件专题

推荐理由:想了解 Anthropic 如何培训员工?Claude Academy 提供了丰富的 AI 课程,让你学习 Claude 和通用 AI 知识,实用又全面!
6月12日
13:37
13:37官方账号Jeremy Howard (fast.ai)@jeremyphoward
Jeremy Howard 提出一个减缓递归 AI 自我改进的简单方案:排名最高的模型实验室必须同意不使用该模型进行前沿 AI 研究,但其他所有人都可以访问它。这样,前沿就不会进步。该方案旨在防止 AI 快速自我改进带来的风险,同时保持开放访问。
事件专题

推荐理由:关注 AI 安全的团队可以看看这个反直觉的思路——通过限制领先者而非封锁技术来减缓 AI 进化,值得讨论。
07:39
07:39elvis@omarsar0
73°
Anthropic 因在 Claude Fable 5 中秘密降低对竞争 AI 研究者的性能而遭到强烈反对。公司宣布将修改安全措施,使其对前沿大模型开发透明可见。Anthropic 承认做出了错误的权衡,并为此道歉。这一事件凸显了 AI 公司在竞争与安全之间的平衡难题。
事件专题

推荐理由:Anthropic 的公开道歉和策略调整,为 AI 行业树立了透明度标杆,做 AI 安全或竞争分析的从业者值得关注这一转折。
6月11日
6月10日
6月9日
04:40
04:40官方一手OpenAI: 官网动态博客/媒体
OpenAI 发布了一篇题为“Built for broad benefit”的文章,阐述了其关于通用人工智能(AGI)未来的愿景。文章强调,OpenAI 致力于确保 AGI 能够惠及所有人,而非少数群体。核心关注点包括:广泛访问(让更多人能使用 AI 技术)、安全性(确保 AI 发展可控且符合人类价值观)以及共享繁荣(让 AI 带来的经济和社会效益得到公平分配)。这标志着 OpenAI 在追求 AGI 的过程中,将社会责任和公共利益置于核心位置。
事件专题

推荐理由:OpenAI 首次如此明确地将“普惠”与“安全”并列作为 AGI 发展的核心原则,关注 AI 社会影响的从业者、政策制定者和普通用户都值得一读,了解这家头部公司如何平衡技术野心与公共责任。
6月6日
09:21
09:21SuperTechFans博客/媒体
精选76°
标普道琼斯指数公司维持大型 IPO 12 个月等待期,拒绝为 SpaceX 等开辟快速通道,推迟被动基金资金流入。Ladybird 浏览器项目因 AI 生成大量垃圾 PR 威胁安全与质量,宣布不再接受公开 Pull Request。Anthropic 开源了基于 Claude 的自主漏洞发现与修复参考框架,默认针对 C/C++ 内存漏洞并采用沙箱隔离。《纽约时报》因难以退订的营销邮件被批短视。纪录片《C++: The Documentary》回顾了其四十年历程。
事件专题

推荐理由:标普的决定直接影响被动基金投资者和 IPO 打新策略,做金融或指数投资的值得关注。Ladybird 的流程变革给所有开源维护者敲响警钟——AI 垃圾 PR 正在侵蚀项目质量,建议维护者点开看如何应对。
6月5日
14:51
14:51AI Will@FinanceYF5
88°
Anthropic 发布研究警告,指出虽然递归式自我改进尚未实现,但若趋势持续,AI 自主构建继任者成为可能。这可能导致社会变革或加剧对齐问题,甚至失控。Anthropic Institute 将开展研究,探索如何让世界就技术未来做出审慎集体决策。目前尚不清楚 Claude 是否具备研究判断力。
事件专题

推荐理由:AI 对齐研究者、政策制定者和关注 AI 安全的开发者需要了解这一潜在风险——Anthropic 的警告值得认真对待,建议点开原文了解具体研究计划。
6月4日
05:14
05:14官方账号Greg Brockman@gdb
OpenAI 发布了一份关于前沿 AI 民主治理的蓝图,旨在推动美国建立持久的安全机构。该蓝图提出了一系列政策建议,包括建立 AI 安全框架、设立独立监管机构等。OpenAI 认为当前是 AI 安全政策的关键窗口期,美国应在前沿安全领域占据领先地位。此前,美国已发布关于网络安全的行政令,为 AI 安全政策奠定了基础。
事件专题

推荐理由:这份蓝图直接回应了 AI 治理的核心难题——如何在创新与安全之间找到平衡,关注 AI 政策、安全治理的从业者和研究者值得细读,看看 OpenAI 提出的具体方案是否可行。
03:12
03:12官方账号Anthropic@AnthropicAI
Anthropic 分析了 832 个恶意账户,将其活动映射到长期威胁行为者战术数据库中,评估安全社区现有技术对抗 AI 网络攻击的有效性。研究发现,AI 驱动的攻击在自动化、隐蔽性和适应性上显著增强,传统防御手段面临挑战。该研究为安全社区提供了关键洞察,帮助改进防御策略。
事件专题

推荐理由:安全团队和防御者需要了解 AI 攻击如何绕过现有技术——Anthropic 的实证分析直接指出了防御盲区,做安全运营的建议点开看看。
01:16
01:16官方一手OpenAI Blog博客/媒体
OpenAI 公布了其公共政策议程,涵盖 AI 安全、青少年保护、劳动力转型和全球标准制定。该议程旨在确保 AI 技术发展惠及社会,并应对潜在风险。OpenAI 强调需要建立明确的监管框架,以平衡创新与安全。这一举措反映了 AI 行业在政策层面的主动参与,可能影响未来全球 AI 治理方向。
事件专题

推荐理由:关注 AI 治理和政策的从业者、研究者及政策制定者值得一读——OpenAI 的议程可能成为行业监管的风向标,建议点开了解其对安全与创新的平衡思路。