#Llama
共 26 条 · 7 天 0 条 · 30 天 13 条
信息流里打上「Llama」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月3日
10月2日
9月30日
9月24日
论文10:33
反向拍卖按任务竞价:固定 token 定价存在 10%–71% 价差一篇把拍卖机制套到 LLM 采购上的论文,Llama 和 Qwen 实测显示固定定价比竞价贵 10% 到 71%,做 API 成本优化的可以看看思路。
KV-Cache 淘汰策略可按风险目标认证:Llama 上 SnapKV 认证通过 75% 保留率
这论文把 KV-cache 压缩变成了能签合同的事:给定风险目标,自动算出能砍多少缓存,砍不了就回退全 KV。做长文本推理部署的可以看看。
9月23日
9月21日
Yann LeCun 否认曾要求 Meta 停止 LLM 研发,称自己一直支持
LeCun 晒履历自证:OPT-175B、Galactica、Llama 都有他推动的份,谁再说他反对 LLM 他可不认。
9月17日
9月16日
9月15日
9月11日
8月7日
AMD 宣布计划收购 Taalas,补强 AI 推理芯片路线图
AMD 要收购 Taalas,这家公司做定制 AI 推理芯片,比 GPU 快几千倍,但绑定单个模型,适合想了解 AI 芯片新路线的人。
IT之家原文
7月29日
论文11:10
Evaluating VLMs for Agent-Driven Geometry Clipping Detection in Game QA这篇论文用六种VLM检测游戏里的几何裁剪bug,发现Gemini最稳,开源模型要看怎么问提示词。想了解VLM实际落地坑点的可以看看。
7月5日
7月3日
7月1日
扩散模型在分子设计中的突破:前Llama负责人加入Genesis,PEARL零样本OpenBind获胜
前Llama老大跑去做药了,他们用扩散模型搞的PEARL在OpenBind零样本赢了,共折叠也终于过了门槛。想了解AI怎么设计新药的可以看这个。
6月30日
6月17日
6月16日
vLLM v0.23.0 发布:408 次提交,DeepSeek-V4 支持增强
vLLM v0.23.0 大更新,DeepSeek-V4 和 Llama 用户值得升级,新的 KV 缓存卸载能省显存,推理与工具调用解析也更顺了。
6月8日
6月5日
5月15日