大语言模型·concept

大语言模型

别名
首次出现
2026-05-22
最近出现
2026-07-25
累计提及
445
§ 01综述

大语言模型(LLM)是一种基于海量文本数据训练、能生成类人文本的人工智能模型。近期,其训练数据来源、内部工作机制及应用场景成为讨论焦点。

大语言模型近期进展

  • 游戏数据训练优于互联网文本:通用智能CEO认为,游戏数据能提供更结构化、目标驱动的训练环境,可能让AI学会更合理的逻辑而非简单模仿网络语言。 原文标题
  • Anthropic发现类脑“全局工作空间”结构:在Claude模型中识别出类似人脑全局工作空间的J空间,支持信息整合与共享,为解释LLM推理提供新视角。 原文标题
  • LLM用于对抗自身产生的垃圾信息:Reddit利用LLM检测和过滤由LLM生成的垃圾内容,形成以子之矛攻子之盾的策略。 原文标题
  • 医药与健康领域应用深化:DeepMind论文登上Nature Health封面,展示LLM处理健康查询;另有研究优化LLM用于药物警戒因果关系评估。 原文标题
  • 当前焦点与观察点

    大语言模型的训练数据来源正从通用互联网文本转向更专业、更可控的语料(如游戏、医学文档),以提高可靠性与安全性。同时,对其内部机制的可解释性研究(如J空间)为理解模型行为提供了新工具。此外,LLM本身被用于管理由其引发的问题(如内容污染),体现了该技术的双刃剑属性。未来,如何平衡性能提升、可解释性与社会影响,将是该领域持续关注的核心。
    § 02相关报道10 条在档
    1. 01
      卡帕西分享 AI 闲聊技巧:无需精调提示词,想到什么说什么
      IT之家
    2. 02
      用4句提示和workflows让模型完成游戏开发
      Mike Krieger
    3. 03
      腾讯混元大语言模型与多模态团队合并,姚顺雨统一管理
      IT之家
    4. 04
      谷歌旗舰大模型难产背后:军方合作引员工不满,内部感叹“已落后”
      IT之家
    5. 05
      人工Epanorthosis:大语言模型为何过度使用古典修辞格及缓解方法
      arXiv cs.AI
    6. 06
      多模态语音大语言模型实现92.4%认知障碍检测准确率
      arXiv cs.LG
    7. 07
      Jefferies用Strands Agents和Amazon Bedrock构建交易助手
      AWS Machine Learning Blog
    8. 08
      Gary Marcus:ChatGPT/Claude已不是纯LLM,而是神经符号AI系统
      Gary Marcus
    9. 09
      SymptomAI:面向日常症状评估的对话式AI智能体
      Google Research: Blog
    10. 10
      编排开源小语言模型在恶意软件分析中超越单个大语言模型
      arXiv cs.AI
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/%E5%A4%A7%E8%AF%AD%E8%A8%80%E6%A8%A1%E5%9E%8B