论文Agent 与开发者多源确认83°10:18长期AI决策能力研究:模型表现远低于人类最新研究揭示,即使是顶尖AI模型在长期复杂任务中也仅达人类四分之一表现。#GPT-5.6 Sol#Claude Opus#Qwen3.7-Max#长期决策2 个信源在谈事件专题rohanpaul_ai@rohanpaul_ai3 个信源在谈原文稍后读已读值得跟进有用关注 GPT-5.6 Sol