论文中美对照17:52语言模型目标移植研究MIT团队发现语言模型内部存在可操控的价值信号,能改变模型行为方向,对AI安全研究有重要意义。#Qwen3-8B#GPT-OSS-20B#价值移植#AI安全aarXiv cs.LG@Pengcheng Jiang, Fabien Roger原文稍后读已读值得跟进有用关注 Qwen3-8B
行业政策与合规多源确认71°12:39OpenAI 暂停最强模型推理,直至系统加固完成OpenAI 把最强模型的推理全停了,说要先加固系统,Gary Marcus 觉得这是承认管不住模型,信息量不小。#OpenAI#AI安全#模型控制10 个信源在谈事件专题Gary Marcus@GaryMarcus11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
产品多源确认08:42Notion AI新增模型控制功能Notion上线了模型控制功能,管理员现在可以自定义AI模型选择和默认设置。#Notion#Notion AI#Custom Agents#模型控制3 个信源在谈事件专题Notion@NotionHQ4 个信源在谈原文稍后读已读值得跟进有用关注 Notion
论文精选11:02预测推理模型未来行为,新方法FPCG实现更优控制这项研究解决了推理模型行为控制中输出质量下降的痛点,做模型对齐或安全控制的开发者可以直接用FPCG方法,在保持生成质量的同时精准引导模型行为。#推理模型#模型控制#激活探针#行为预测aarXiv cs.LG@Evgenii Kortukov 等 8 人原文稍后读已读值得跟进有用关注 推理模型