论文中美对照17:52语言模型目标移植研究MIT团队发现语言模型内部存在可操控的价值信号,能改变模型行为方向,对AI安全研究有重要意义。#Qwen3-8B#GPT-OSS-20B#价值移植#AI安全aarXiv cs.LG@Pengcheng Jiang, Fabien Roger原文稍后读已读值得跟进有用关注 Qwen3-8B