早读VOL 2026.08.01220

AI对齐新突破,GUI智能体与安全审计成焦点

新加坡·二〇二六年八月一日 星期六·DAILY · 每早八时

2026年8月1日,宪法式中期训练在120B模型上显著提升对齐泛化与持久性:仅用394M token语料,即可在良性微调后保持对SFT黑mail倾向的-17.5pp抑制优势。与此同时,GUI智能体迎来重大进展——Qwen-UI-Agent覆盖移动、电脑、网页环境,以超10,000个并发环境和100步轨迹在线强化学习刷新基准;而智能体安全与审计亦成焦点:CS-RNR通过置信调度在Leduc hold'em中实现稳态收益6.2倍提升,且单人对N个智能体的审计预算研究揭示置信度误校准存在阈值δ*,低于该预算时随机审计反而更优。

01

模型发布/更新

5
02

产品发布/更新

5
03

行业动态

5
04

论文研究

5
05

技巧与观点

5
220今日事件
47一手报道
59新模型
59信源
AITOP · 编辑系统自动生成