llama·general

LLaMA

别名
首次出现
2026-05-22
最近出现
2026-07-27
累计提及
233
§ 01综述

LLaMA 是 Meta 推出的一系列开源大语言模型,因其高性能和开放性已成为 AI 研究社区的重要基础设施。它不仅降低了大型语言模型的使用门槛,还催生了大量基于 LLaMA 的衍生模型和应用。

LLaMA 近期进展

  • 开源模型的规模与多样性持续扩展:全球首个不含英伟达 GPU 训练的万亿参数模型近期受到开发者关注,体现了开源社区在算力依赖和创新方面的突破。全球首个英伟达含量为0的万亿模型,成了海外开发者的抢手货
  • 开放权重模型的安全评估受到重视:一项研究通过双信号审计方法识别了被剥离拒绝机制的开放权重模型,这对包括 LLaMA 在内的开源模型的安全性提出了新挑战。双信号审计识别被剥离拒绝机制的开放权重模型
  • 基于 LLaMA 的应用生态日渐丰富:如 WebBrain 开源浏览器代理,可在 Chrome 和 Firefox 中自动化任务,这类工具常依托 LLaMA 等模型实现本地优先的 AI 能力。WebBrain: 开源本地优先AI浏览器代理,自动化Chrome和Firefox任务
  • 当前焦点与观察点

    当前 LLaMA 及其衍生模型面临的核心问题是如何在保持开放性的同时确保安全与可控。一方面,模型被广泛应用于金融、教育等领域的测试,但如桥水基金测试所示,LLM(包括 LLaMA 类模型)在依赖公开信息的任务中仍存在明显局限;另一方面,针对模型偏见、共情能力及鲁棒性的评估基准不断涌现,提示社区需更细粒度地衡量模型质量。此外,开源模型的监管与审计成为热点,如何在不限制创新的前提下有效识别并修复安全漏洞,将是 LLaMA 生态持续发展的关键。

    § 02相关报道10 条在档
    1. 01
      Google发布JAXBench:文档优化使Gemini 3 Flash正确率从5.8%升至37.3%
      elvis
    2. 02
      吴恩达发布100%开源个人桌面Agent
      量子位
    3. 03
      Unsloth等四大微调框架:速度、VRAM、多GPU对比
      marktechpost
    4. 04
      渐进式披露在智能体中不随规模扩展,效果取决于Agent Harness
      elvis
    5. 05
      OR:一种可微分的信任域策略优化方法
      arXiv cs.LG
    6. 06
      The Geometry of Semantic Space:Transformer架构的连续几何框架
      arXiv cs.LG
    7. 07
      Kimi K3 很强但 Arena 评分被高估,类似 Llama 4
      Ethan Mollick
    8. 08
      Meta和xAI陷入下一代模型陷阱,OpenAI凭借Orion/GPT-4.5成功脱险
      Ethan Mollick
    9. 09
      腾讯混元发布Hy3 1-bit/4-bit版本,295B模型单GPU可运行
      Hunyuan
    10. 10
      腾讯混元发布Hy3 1bit与4bit量化版,295B模型可单卡本地运行
      IT之家
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/LLaMA