09:48OpenRouter@OpenRouterAI精选Qwen在长期任务和视觉智能体基准上报告了新成绩。PaperBench从64.8升至93.0,OSWorld-Verified从73.3升至86.1,Vision2Web从42.1升至69.0。数据由OpenRouter推文转述。AI模型Qwen3.7 MaxPaperBenchOSWorld-Verified推荐理由:Qwen放出了新基准分,PaperBench直接到93,比之前64.8涨了一大截,智能体任务可以关注。原文稍后读已读值得跟进有用关注 Qwen3.7 Max