#门控机制

共 4 条 · 7 天 0 条 · 30 天 0 条
信息流里打上「门控机制」标签的资讯、产品与论文,按刊登时间排,新的在上。
8月7日
6月10日
论文精选11:38
Provenance-Grounded Gating and Adaptive Recovery in Synthetic Post-Training Data Curation

做合成数据后训练管线的团队会感兴趣——这篇论文用实验证明了来源证据门控和适应性恢复策略能显著提升数据质量,比简单重采样更高效,建议做数据筛选的开发者点开看看具体方法。

arXiv cs.AI@Soham Bhattacharjee 等 4 人原文
5月29日
论文精选72°13:03
GRASP:带回归感知门控的技能提案器,让LLM智能体自我改进不倒退

做LLM智能体自我改进的团队终于有了一个不担心「修好一个、搞坏一个」的方案——GRASP用硬回归预算和门控机制确保每次改进都是净收益,临床场景提升显著,建议做智能体可靠性的开发者点开看看。

arXiv: DeepSeek@Johannes Moll 等 7 人原文
5月22日