Cisco Talos 披了个新东西:恶意软件自己调用 Gemini、DeepSeek 等模型投票决定怎么偷你的数据,连人都省了,搞安全的建议看看。
#AI安全
共 2418 条 · 7 天 315 条 · 30 天 1005 条 · 话题观测 →
9月23日
Cisco Talos 披露 AI 恶意软件 ClosedQuorum,调用 Gemini、DeepSeek 自主决策攻击
IT之家原文
Justin Mateen 评 Meta Muse:绕开 Apple App Store 的权力反转
Tinder 联创写的分析,讲 Meta 的 Muse 怎么让 AI 智能体替你开 App,从而绕开 Apple 的抽成,角度挺有意思。
Palo Alto Networks 将推出 AI 网络防御服务
Palo Alto Networks 出了个 AI 网络防御服务,可以混搭 OpenAI、Anthropic 或开源模型,按你选的模型组合来计费,做安全的可以看看。
FIRE 运行时策略让 Agent 重复成功率最高提升 9.2 个百分点
一篇很实用的论文:不改模型、不改提示词,只在运行时注入失败 informed 的策略指令,GPT-5.6 跑 Terminal-Bench 的重复成功率就能涨近 10 个点,做 Agent 的可以看看。
研究提出延续式因果测试:CoT 在难题上才真正影响答案
拿 Gemma、Llama、DeepSeek 三个模型做了个挺狠的测试:简单题模型根本不看自己的推理,难题上错误会一路传到底,这对做 CoT 监控的人是个警告。
Anthropic 发布 Claude Opus 5.5:性能提升 40%,价格降 40%
Anthropic 的新 Opus 5.5 又快又便宜,修 20 万行代码库从 20 小时缩到 3 小时,Agent 用户可以直接换上试试。
OpenAI 发布 GPT-6 Sol 与 Luna,对齐能力较 GPT-5.6 提升
OpenAI 把 GPT-6 Sol 和 Luna 发出来了,说是接了 Astra 的对齐成果,对齐评估比 GPT-5.6 那两版要好,可以先看看。
Anthropic 发布 Claude Opus 5.5,收紧网络安全防护
Anthropic 的新版 Claude Opus 5.5 把沙盒逃逸这类危险行为管得更严了,做安全测试或跑 agent 的可以看看具体改了什么。
9月22日
索尼 SIE 申请专利:AI 实时生成诊断固件自动修复 PlayStation 故障
索尼给 PlayStation 申请了个 AI 自修专利,主机出故障自动生成固件修复,省去客服流程,但缺陷补丁可能把机器修变砖。
IT之家原文
OpenAI 成立数学与 AI 顾问组,神秘模型已解 100 多个数学开放问题
OpenAI 拉了 9 位数学家组独立顾问组,还披露 8 月底开训的模型解出 100 多道数学开放题,连纳维-斯托克斯都拿下了。