11:55官方账号arXiv cs.AI@Laurens Samson, Iva Gornishka, Gossa Lô, Yuki M. Asano, Sennay Ghebreab荷兰研究者提出“Grip on LLMs”评估框架,针对政府场景的荷兰语大模型。该框架涵盖事实性、诚实性、社会偏见、能耗、成本和训练数据透明度六个维度,测试了30多个多语言及荷兰语专用模型。结果显示没有模型在所有维度上表现最佳,高质量模型通常伴随更高能耗和成本,而偏见与两者无关。事实性和诚实性由不同属性决定,高事实性不意味着高诚实性。研究团队发布了面向非技术用户的公开模型概览。论文Grip on LLMs荷兰语评估基准推荐理由:荷兰政府项目组做的评估框架,测了30多个模型,告诉你哪个模型在事实性、能耗、成本上表现如何,选型时直接参考。原文稍后读已读值得跟进有用关注 Grip on LLMs