事件专题 · 多源确认

桥水基金研究:前沿AI模型金融判断准确率不足80%,微调开源模型达84.7%

桥水基金旗下AIA Labs与Thinking Machines Lab测试了GPT、Claude、Gemini等前沿模型在金融信息筛选任务中的表现。使用基础提示词时平均准确率仅约50%,经专家优化后提升至约70%,仍未达到80%的可信部署门槛。研究团队以阿里开源模型Qwen3-235B为基座进行微调,最终达到84.7%的准确率,优于最佳前沿模型的78.2%,错误率降低29.8%,推理成本仅为前沿模型的约十四分之一。

当前结论

桥水和Mira Murati团队发现,GPT和Claude在金融判断上准确率才70%,不如微调的Qwen3-235B的84.7%,成本还低14倍。

3 个信源67° AI 热度最后更新 2026/7/3 13:51:20

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情