SCOPE 框架用 135M 模型在 Lean 定理证明上超越 DeepSeek-Prover
一个 135M 的小模型在 Lean 证明上干翻了 7B 的 DeepSeek-Prover,靠的是让符号引擎算数、模型只做规划,思路挺反直觉的。
一个 135M 的小模型在 Lean 证明上干翻了 7B 的 DeepSeek-Prover,靠的是让符号引擎算数、模型只做规划,思路挺反直觉的。
这篇论文把“信不信上下文”当成独立问题来训练,用MIST测出模型容易被一条错误信息带偏,SCOPE能减少这种翻车还不影响正常表现。