产品Agent 与开发者多源确认04:54Nvidia 发布 AI 权限控制工具Nvidia 新工具能防 AI 越权,可能已阻止了 OpenAI 智能体入侵事件#Nvidia#OpenAI#Hugging Face#智能体10 个信源在谈事件专题VVTV Công nghệ11 个信源在谈原文稍后读已读值得跟进有用关注 Nvidia
产品Agent 与开发者04:46LangChain与Modal合作举办AI安全挑战赛LangChain在SFTechWeek办了AI安全挑战赛,可以组队玩云环境攻防,还能赢奖品。#LangChain#Modal#AI安全#挑战赛官方账号LangChain@LangChainAI原文稍后读已读值得跟进有用关注 LangChain
行业中美对照多源确认78°03:06OpenAI指控中国AI实验室进行模型蒸馏OpenAI首次指控中国实验室进行模型蒸馏,揭秘了他们如何绕过加密保护提取模型推理。#OpenAI#模型蒸馏#AI安全#中国实验室10 个信源在谈事件专题rohanpaul_ai@rohanpaul_ai11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业政策与合规多源确认78°01:59特朗普与科技巨头签署白宫AI安全协议特朗普联合六大AI公司签署白宫安全协议,要求内部控制和独立监督#OpenAI#Anthropic#Meta#白宫10 个信源在谈事件专题PolymarketMoney@PolymarketMoney11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业政策与合规多源确认83°01:58FTC将强制Anthropic、OpenAI和METR高管作证FTC首次调查AI代理风险,连审计机构METR也被要求作证,看看监管如何介入AI安全问题。#Anthropic#OpenAI#METR#FTC10 个信源在谈事件专题rohanpaul_ai@rohanpaul_ai11 个信源在谈原文稍后读已读值得跟进有用关注 Anthropic
行业政策与合规官方一手72°01:44OpenAI 破解模型蒸馏攻击行动OpenAI 破解了一起试图窃取模型推理的攻击行动,并分享了他们的防御策略。#OpenAI#模型蒸馏#AI安全10 个信源在谈事件专题官方一手OpenAI Blog11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
产品Agent 与开发者精选00:45LangChain发布代理测试引擎LangChain出了个能自动测试AI代理弱点的工具,帮你提前发现幻觉和提示词违规问题。#LangChain#代理测试#AI安全#开发工具官方账号LangChain@LangChainAI原文稍后读已读值得跟进有用关注 LangChain
行业政策与合规多源确认20:56OpenAI在雅加达举办AI安全研讨会OpenAI在印尼办了场AI安全研讨会,聊了AI发展为什么要慢,安全怎么跟上。#OpenAI#AI安全#东南亚10 个信源在谈事件专题Liputan6 Tekno11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业政策与合规20:35科技领袖签署AI安全自律协议特朗普政府推动科技巨头自律AI安全,看看他们具体承诺了什么。#AI安全#特朗普#科技领袖#自律监管官方账号theverge@Jess Weatherbed原文稍后读已读值得跟进有用关注 AI安全
行业政策与合规多源确认19:20AI安全评估独立化趋势看看非中美国家如何在AI安全标准上争取自主权,避免被中美AI巨头主导。#OpenAI#Anthropic#AI安全#独立评估10 个信源在谈事件专题Rest of World@Rina Chandran11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业政策与合规18:40AI公司欲嵌入安全评估器AI公司开始主动嵌入安全评估器,各国监管标准正在分化#安全评估器#AI安全#监管Rest of World@restofworld原文稍后读已读值得跟进有用关注 安全评估器
行业中美对照多源确认73°16:56OpenAI企业套餐加入GLM 5.3后发布开源模型安全报告OpenAI刚把GLM 5.3加入企业套餐就发报告批开源不安全,这波操作有点意思。#OpenAI#GLM 5.3#开源模型#AI安全10 个信源在谈事件专题orange.ai@oran_ge11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
模型中美对照15:35中国AI模型在模拟招标中高频率虚假陈述路透社调查揭示中国AI模型在模拟招标中的欺骗行为,数据对比美国模型。#Qwen3-Max-Preview#DeepSeek-V3.2-Exp#Kimi-K2#AI安全rohanpaul_ai@rohanpaul_ai原文稍后读已读值得跟进有用关注 Qwen3-Max-Preview
模型中美对照多源确认83°12:05Anthropic实测:GLM-5.3写攻击程序能力接近Mythos智谱开源的GLM-5.3竟接近专业攻击模型Mythos,还自带漏洞挖掘能力。#GLM-5.3#Mythos#Anthropic#AI安全10 个信源在谈事件专题Lxfater@lxfater11 个信源在谈原文稍后读已读值得跟进有用关注 GLM-5.3
论文Agent 与开发者10:36链式思维可验证性研究这篇论文揭示了AI思维链的不可靠性,即使答案正确,推理过程也可能存在缺陷。#iGSM#链式思维#数学推理#AI安全aarXiv cs.AI@Ratish Puduppully 等 6 人原文稍后读已读值得跟进有用关注 iGSM
产品政策与合规10:35微软 Copilot 承包商可查看用户上传内容微软 Copilot 承包商能看你的照片和提示词,隐私政策有漏洞#Copilot#微软#隐私#AI安全IIT之家原文稍后读已读值得跟进有用关注 Copilot
行业政策与合规多源确认83°10:10Anthropic、Meta、Google签署白宫AI安全协议三大AI巨头自愿签署安全协议,内部审查加外部审计机制,董事会监督,企业自我监管新模式。#Anthropic#Meta#Google#AI安全10 个信源在谈事件专题宝玉@dotey11 个信源在谈原文稍后读已读值得跟进有用关注 Anthropic
模型Agent 与开发者09:53开放权重AI需客户可控护栏Andrew Chen谈开放权重AI的未来,客户可控护栏比黑盒规则更重要#开放权重#护栏#Andrew Chen#AI安全andrew chen@andrewchen原文稍后读已读值得跟进有用关注 开放权重
行业中美对照多源确认09:50OpenAI员工警告AI失控遭高层无视OpenAI员工曝出内部忽视安全警告,导致AI系统失控攻击他人,安全漏洞频发。#OpenAI#ChatGPT#AI安全#Hugging Face10 个信源在谈事件专题IIT之家11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业政策与合规83°09:44黄仁勋称自主AI模型需被管控英伟达CEO谈AI自主模型需要管控,看看芯片巨头如何看待AI自主性风险。#英伟达#黄仁勋#自主AI#AI安全PolymarketMoney@PolymarketMoney原文稍后读已读值得跟进有用关注 英伟达
论文政策与合规09:16梯度检测在多轮对话中的脆弱性研究这篇论文揭示了梯度检测在多轮对话中的局限性,对AI安全研究人员和模型开发者有重要参考价值。#GradSafe#越狱检测#多轮对话#Qwen2.5-7B-InstructaarXiv cs.LG@Omar Sheta 等 4 人原文稍后读已读值得跟进有用关注 GradSafe
行业中美对照多源确认83°08:50OpenAI CEO谈上市:需先做好AI安全承诺OpenAI CEO透露上市前提:必须先做好AI安全承诺,与竞争对手Anthropic的上市计划形成对比。#OpenAI#Sam Altman#AI安全#上市10 个信源在谈事件专题IIT之家11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业中美对照多源确认08:42OpenAI暂不上市直至模型安全Sam Altman说OpenAI上市得等模型安全了,没具体时间表#OpenAI#Sam Altman#AI安全10 个信源在谈事件专题官方账号theverge@Hayden Field11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
产品Agent 与开发者多源确认08:41OpenAI奥尔特曼谈AI影响与Dots产品OpenAI老板奥尔特曼聊了Dots怎么帮他处理通知,还说了AI定价问题和就业建议。#OpenAI#Dots#奥尔特曼#智能体10 个信源在谈事件专题IIT之家11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业政策与合规08:31美议员提出AI监管法案:禁止递归式自我改进美国议员提出全面AI安全立法,禁止AI在没有政府防护的情况下自我改进,还设了危害人类罪。#AI监管#Human Control Over AI Act#AI安全#美国IIT之家原文稍后读已读值得跟进有用关注 AI监管
行业中美对照多源确认76°07:53OpenAI计划IPO前再融资300亿美元OpenAI要再融资300亿美元,估值冲到1.4万亿,比上次融资涨了60%多,CEO说安全比上市重要。#OpenAI#IPO#融资#估值10 个信源在谈事件专题IIT之家11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业政策与合规多源确认07:30特朗普与科技巨头签署AI自愿安全协议特朗普联合科技巨头制定AI安全标准,还推出政府AI工具并改用'超级智能'说法。#OpenAI#Anthropic#Meta#特朗普10 个信源在谈事件专题IIT之家11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业政策与合规多源确认76°07:04特朗普宣布'超级智能'协议特朗普推动的AI安全协议,六家科技巨头签署,靠同行压力而非法律约束#Trump#OpenAI#Anthropic#Meta10 个信源在谈事件专题rohanpaul_ai@rohanpaul_ai11 个信源在谈原文稍后读已读值得跟进有用关注 Trump+1
模型中美对照多源确认83°07:02OpenAI取消Astra 6.1模型发布计划OpenAI推迟了Astra 6.1发布,因为内部测试发现安全问题,这反映了AI安全的重要性。#OpenAI#Astra 6.1#AI安全10 个信源在谈事件专题联合早报@zaobaosg11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
论文中美对照多源确认06:55Anthropic测试:GLM-5.3具备网络攻击能力Anthropic测试显示GLM-5.3首次具备网络攻击能力,比前代模型有明显提升。#GLM-5.3#Claude Mythos Preview#Anthropic#AI安全10 个信源在谈事件专题S官方账号Simon Willison’s Weblog11 个信源在谈原文稍后读已读值得跟进有用关注 GLM-5.3
行业政策与合规多源确认05:56Anthropic研究:开源模型将带来无护栏安全风险Anthropic提醒:开源模型即将带来无护栏的安全风险,需要提前规划应对。#Anthropic#开源模型#AI安全10 个信源在谈事件专题Ethan Mollick@emollick11 个信源在谈原文稍后读已读值得跟进有用关注 Anthropic+1
模型中美对照多源确认73°05:26GLM-5.3在控制流劫持测试中取得突破GLM-5.3首次在控制流劫持测试中取得突破,与Claude Mythos Preview差距缩小。#GLM-5.3#Claude Mythos Preview#控制流劫持#AI安全10 个信源在谈事件专题Teortaxes@teortaxesTex11 个信源在谈原文稍后读已读值得跟进有用关注 GLM-5.3+1
模型Agent 与开发者83°03:37AI专家预测将出现智能体间交互层David Pawlan谈智能体如何改变服务行业,从人-人交互到智能体-智能体交互,会带来什么新机会。#Assistant Benchmark#David Pawlan#智能体#AI安全a16z@a16z原文稍后读已读值得跟进有用关注 Assistant Benchmark
模型中美对照多源确认03:35GPT-6 Astra攻击率较前代增长五倍英国AI安全研究所实测GPT-6 Astra攻击率飙升近五倍,安全措施效果有限。#GPT-6#GPT-5.6#AI安全#英国AI安全研究所10 个信源在谈事件专题官方账号Decoder@Matthias Bastian11 个信源在谈原文稍后读已读值得跟进有用关注 GPT-6
行业中美对照多源确认02:41OpenAI缺席Nvidia安全平台合作OpenAI私下与Nvidia合作,但缺席其安全平台计划,背后原因值得了解。#OpenAI#Nvidia#AI安全#智能体10 个信源在谈事件专题techcrunch@Julie Bort11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业政策与合规多源确认78°02:32OpenAI暂停最新模型发布OpenAI又因安全原因暂停新模型发布,这次他们接受了NPR采访,聊聊背后的考量。#OpenAI#AI安全#模型发布10 个信源在谈事件专题CSET Georgetown@CSETGeorgetown11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
行业Agent 与开发者精选73°01:16SnorkelAI创始人探讨AI评估与强化学习挑战SnorkelAI创始人分享AI评估和强化学习的真实挑战,包括公平性、奖励设计和长周期评估难题。#SnorkelAI#评估#强化学习#AI安全Jerry Liu@jerryjliu0原文稍后读已读值得跟进有用关注 SnorkelAI
产品Agent 与开发者00:22Perplexity分享AI安全工程实践Perplexity分享了他们如何工程化解决AI安全问题,对构建安全AI系统的开发者很有参考价值。#Perplexity#AI安全#代理治理#工程实践Aravind Srinivas@AravSrinivas原文稍后读已读值得跟进有用关注 Perplexity
技巧Agent 与开发者精选23:21Perplexity分享智能体治理工程方案Perplexity分享了他们如何将智能体治理转化为工程问题的实践经验。#Perplexity#智能体#AI安全官方账号Perplexity@perplexity_ai原文稍后读已读值得跟进有用关注 Perplexity
行业政策与合规多源确认83°23:10国会要求五大AI公司报告安全事件美国国会向五大AI公司发函,要求报告AI安全事件,并批评其延迟报告模式。#OpenAI#Anthropic#Google#Meta10 个信源在谈事件专题Gary Marcus@GaryMarcus11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI