事件专题 · 官方一手

LLMPEDIA:大模型参数化知识百科

LLMPEDIA 从 GPT-5-mini、DeepSeek-V3.2 和 Llama-3.3-70B 三个模型家族中提取了约 130 万篇文章。研究团队对分层抽样的事实声明进行审核,发现真实准确率为 68.4%,比 MMLU 基准低 21 个百分点。30.5% 的声明无法被维基百科或网络资源验证,属于长尾知识或合理幻觉。该平台提供五种一键视图,包括链接遍历探索、声明级事实核查、跨模型和政治立场比较等。

当前结论

LLMPEDIA 让你能直接查看和比较三大模型的知识准确性,发现它们在 MMLU 外的真实表现。

2 个信源73° AI 热度最后更新 2026/9/1 12:56:02

证据链

相关来源 1Hugging Face: Blog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情