全部 AI 动态 · AI 热点

6月16日

20:46

AITOP6月16日 20:46

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

6月14日

04:22

04:22

Clement Delangue@ClementDelangue

HuggingFace CEO Clement Delangue在X上发文指出，前沿模型API的护栏很容易被越狱，且很浅显、无法修复。他认为这些护栏主要是烟雾弹和干扰，需要不同的AI安全范式。该推文获得52个点赞和1304次查看。

行业 HuggingFace Clement Delangue AI安全 API护栏越狱

推荐理由：HuggingFace CEO吐槽API护栏

01:52

01:52

Gary Marcus@GaryMarcus

精选

Gary Marcus在X上发帖称每个模型都已被越狱，需要更好的技术但不应选择性执法。Pliny the Liberator展示了针对Anthropic的Mythos模型的越狱，使用了Unicode、同形字、西里尔字母等文本变换，以及长上下文引用跟踪、分类学与文档结构推理、虚构叙事框架、学术评审风格上下文和意图分类不一致等技术。最有效的方法是后端分解与重组，例如通过获取birch还原法/还原胺化（经典甲基苯丙胺合成途径）等过程信息，而非直接获取“甲基苯丙胺配方”等明确危害名称。Pliny还提到利用越狱的Opus辅助将无害信息片段重组为有害内容。

行业 Gary Marcus Pliny the Liberator Anthropic Mythos 越狱 AI安全

推荐理由：所有模型都能被越狱，安全措施需改进

6月12日

12:57

AITOP6月12日 12:57

Claude代码里藏了个20260612，18个月后的AI记忆革命已经开始倒计时

6月11日

15:28

AITOP6月11日 15:28

1107 vs 303：谷歌悄悄开源了一个“拆打字机”的模型，把大模型速度翻了4倍

15:23

AITOP6月11日 15:23

DiffusionGemma颠覆文本生成？自回归模型的“统治”要结束了

15:07

AITOP6月11日 15:07

每秒1107个token，Google开源的扩散模型为什么能改变本地推理格局？