论文17:56Soohak:数学专家策划的LLM科研级数学评测基准Soohak填补了现有数学评测基准在科研深度上的空白,为AI在数学领域的前沿应用提供了更精确的评估工具,有助于推动模型在数学推理和问题解决上的进步。#推理模型#LLM#数学评测#基准测试AK@_akhaliq原文稍后读已读值得跟进有用关注 推理模型