主要来源orange.ai
查看原文事件专题 · 多源确认
27B模型Qwen3.8-27b评测52分,追平Luna和DS V4
Qwen3.8-27b在Artificial Analysis评测中拿到52分,追平Luna和DS V4。这个27B参数模型只需3000美元硬件即可运行,却超过了四个月前发布的所有模型,包括Opus。推文作者质疑,这样的成绩要么来自后训练黑科技,要么就是基准测试被操纵。
当前结论
看看这个27B小模型,用3000美元硬件就打平了Luna和DS V4,还超了Opus,到底是黑科技还是刷分?
3 个信源66° AI 热度最后更新 2026/8/17 21:38:41
证据链
相关来源 1阿里通义 Qwen
查看原文相关来源 2Simon Willison’s Weblog
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。