论文10:44QANTA 2026多模态问答:任务特定双智能体架构与置信度校准他们用GPT-4.1-mini和GPT-4.1做两个不同任务,靠置信度校准和数值推理拿了QANTA 2026最高分0.402,不是靠堆模型而是靠策略。#GPT-4.1-mini#GPT-4.1#QANTA2026#多模态问答aarXiv cs.AI@Nirjhar Das, Md. Al-Mamun Provath原文稍后读已读值得跟进有用关注 GPT-4.1-mini