VOL.2026.09.03·224 STORIES·AITOP DAILY

AITOP日报

二〇二六年九月三日 星期四DAILY · 每早八时
01

模型发布/更新

Model Releases
5
02

产品发布/更新

Product
5

Google发布Gemini 3.8 Flash和Flash Cyber

官方一手X·KOLX:marktechpost (@Asif Razzaq)原文 ↗

Google于2026年9月2日发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款模型。两款模型基于相同的基础智能,通过安全缓解措施而非模型大小进行区分。Gemini 3.8 Flash定价为每100万代币0.75美元和3.75美元,截至2026年12月31日为 introductory 价格。Flash Cyber在CWE-Bench基准测试中达到47.2%的pass@1成绩,仅通过Fairwind计划向经过验证的防御者开放。

NVIDIA发布Switchyard代理库

官方一手X·KOLX:marktechpost (@Michal Sutter)原文 ↗

NVIDIA发布了Switchyard,一个Apache-2.0许可的Rust代理和库,用于LLM流量处理。该工具可将请求解码为提供商中立类型,使用直通、随机、LLM分类器或阶段路由器算法进行路由,并将响应转换回客户端格式。Switchyard支持Claude Code或Codex CLI在vLLM、NIM或Ollama上运行无需修改。目前项目处于预alpha阶段,不适合生产环境使用。

03

行业动态

Industry
5

惠然微电子发布国内首台14/22nm CD-SEM设备

官方IT之家原文 ↗

惠然微电子在CSEAC 2026展会上发布14nm研发级和22nm量产级12英寸晶圆CD-SEM eMILO-FW300设备。该设备向下兼容22nm大规模量产、向上支撑14nm前沿工艺研发,是国内首台打通"研发+量产"双场景的高端CD量测设备。公司还推出光掩模版关键尺寸量测设备Mask CD-SEM eMILO-FR7,填补国产高端掩模量测设备空白。AI-电子束量测技术平台RMS补齐国产设备在算法与数据处理端的短板,实现从硬件到软件的自主可控。

04

论文研究

Research
5

单提示词即可洗除水印:基础图像模型的新威胁

官方一手X·KOLX:arXiv: OpenAI (@Jidong Yang, Qi Li, Wei Zong, Yang-Wai Chow, Willy Susilo, Huaike Yu, Chunpeng Wang, Suo Gao)原文 ↗

研究人员发现,攻击者可通过单个重建提示词,从OpenAI和Google的六种图像编辑模型中获取无法可靠解码水印的输出。研究评估了三种水印方案和1800个重建结果,发现OpenAI模型在有效载荷干扰方面表现最强,而Nano Banana 2显示DwtDct在高保真重建下仍然脆弱。提示词消融实验表明,无需特定的移除指令即可实现有效载荷干扰,这主要是由重建路径而非攻击性措辞引起的。

字节跳动发布HarnessDev自进化智能体框架

X·KOLX:elvis (@omarsar0)原文 ↗

字节跳动Seed团队提出HarnessDev方法,不再评估模型完成任务的表现,而是评估其构建的智能体框架。该框架从弱种子和少量案例开始,构建完整执行系统,再通过下游反馈改进。实验涵盖6个创作者LLM、4个领域和2207个保留下游实例。结果显示,生成的框架在代码和搜索研究方面落后于成熟的人工工程参考,但在写作和机器学习实验方面与之相当或更优。

05

技巧与观点

Tips & Takes
5
224
今日事件
75
一手报道
62
新模型
77
信源
AITOP · 编辑系统自动生成