10:55官方账号arXiv cs.AI@Molood Arman一项新研究提出Coherence Index(CI)与Meta-Predictive Clarity System(MPCS),用于黑盒诊断LLM集体的输出分散与认知修订耦合。研究在gpt-4o-mini和gemini-2.5-flash上构建5-agent集体,每种条件运行310个配对。在gpt-4o-mini上,条件异议将虚假前提恢复率提高17.7点,而静态人格多样性使其降低8.1点。在gemini-2.5-flash上,相同干预几乎无增益(26.1% vs 27.1%),尽管输出分散度确实下降。机制标注显示,Gemini的94%响应为重新表述而非承认,GPT为24%。论文gpt-4o-minigemini-2.5-flash智能体推荐理由:这篇论文出个黑盒诊断,看LLM集体输出分散时是不是真改观点,结果GPT和Gemini相反:Gemini 94%在复读,GPT 24%。原文稍后读已读值得跟进有用关注 gpt-4o-mini
10:17官方账号arXiv cs.LG@Yair Feldman, Linxi Zhao, Nathan Godey, Dongyoung Go, Yilun Hua, Kilian Q. Weinberger, Jennifer J. Sun, Yoav ArtziCO-LMLM将知识库中的连续键与文本知识值配对,摆脱了传统关系型知识库的查询限制。在Wikipedia和FineWeb-Edu上预训练,360M参数模型困惑度低于使用40倍数据训练的LLM。SimpleQA验证显示其性能与gpt-4o-mini相当,且高于Claude Sonnet 4.5。该架构在多个规模下均优于先前LMLM和普通LLM。AI模型CO-LMLMLMLM知识库推荐理由:CO-LMLM用360M参数打平gpt-4o-mini,事实准确度比Claude还高,这是用更小模型做更好知识检索的路线。原文稍后读已读值得跟进有用关注 CO-LMLM