#大模型

共 189 条 · 7 天 0 条 · 30 天 48 条 · 话题观测 →
大模型:新模型发布、评测榜单、价格与 API 变化。
10月3日
10月2日
10月1日
9月30日
9月29日
9月27日
9月21日
Yann LeCun 重申自回归大模型无法实现人类水平 AI

Yann LeCun(深度学习领域权威)重申观点,说当前 LLM 无法实现人类水平 AI,理由很具体,比如推理能力在 token 空间中实现是有限的,自改进方法只适用于特定领域,跨模态能力通常用单独训练的编码器,还有家用机器人或 L4/L5 自动驾驶汽车这些例子,和现在的情况对比很清晰。

官方账号Yann LeCun@ylecun原文
9月20日
牛津研究团队发表论文称大模型无法真正“发明”新事物

牛津研究团队发表新论文,通过数学论证指出,大模型(LLMs)无法真正“发明”新事物,因为它们本质上是预测下一个词的模型,无法相信现有数据中错误的信息。作者认为,人类能够基于现有数据提出新理论,而大模型则只能反映过去。作者每天使用这些模型,发现新突破通常来自人类判断现有数据错误并做出新理论。

Gary Marcus@GaryMarcus原文
9月19日
9月18日
9月17日
研究揭示开源大模型在招聘中存在性别和种族偏见触发机制

朋友,这篇论文挺有意思的,它不是简单说大模型有偏见,而是具体分析了哪些语言触发器(比如代理性语言、排斥性编码)会导致偏见,还给出了一个具体的审计方法,对做招聘AI系统的人应该挺有参考价值。

arXiv: DeepSeek@Kosuke Kitahara, Nobuhiro Yamaguchi原文
9月16日
9月15日
9月14日
9月13日