#AIME
共 5 条 · 7 天 0 条 · 30 天 3 条
信息流里打上「AIME」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月2日
9月29日
TaH2 自适应循环 Transformer 提升 AIME 测试时扩展效率
清华团队提出 TaH2,让循环 Transformer 只对需要的 token 多迭代,AIME 上同等算力多拿 3.4 分,代码已开源。
9月23日
Stanford 与 Together AI 研究:自组织智能体团队在推理基准上超越单模型与路由器
Stanford 和 Together AI 让 o3-mini、Claude Sonnet 4、DeepSeek-V3 自己商量怎么合作,只练 15 道题就在 AIME 上比理想路由器高 13.4 分,方法写得挺细。
7月24日
7月9日
AdaPrefix-GRPO:自适应前缀控制提升困难推理问题训练效果
这篇论文解决了GRPO训练时难问题学不到东西的痛点,用自适应前缀让模型在数学推理上准确率翻倍,而且模型越小效果越明显,值得做强化学习的人看看。