模型中美对照多源确认23:48Meta发布新模型,在多项基准测试中超越GPT-4Meta搞了个新模型,叫Llama 3.2,在MMLU和HellaSwag这些测试里比GPT-4强,还分了免费和付费版,企业用户可以试试。#Llama 3.2#Meta#GPT-4#MMLU9 个信源在谈事件专题The Rundown AI@therundownai10 个信源在谈原文稍后读已读值得跟进有用关注 Llama 3.2
论文官方一手06:29BenchMIRT:LLM基准实际测量什么BenchMIRT研究告诉你,现在流行的LLM基准测试到底在测什么,有什么局限性。#BenchMIRT#LLM#基准测试#MMLU1 个信源在谈事件专题H官方一手Hugging Face: Blog2 个信源在谈原文稍后读已读值得跟进有用关注 BenchMIRT
论文11:56跨模型KV缓存迁移:线性映射实现预填充复用同系列模型切换总得重新预填充?这篇用线性映射传KV缓存,能省2.7到25倍时间,四对组合还保住九成以上准确率。#Qwen3#KV缓存#跨模型迁移#HellaSwagaarXiv cs.LG@Taekyung Heo 等 9 人原文稍后读已读值得跟进有用关注 Qwen3