#轻量模型
共 7 条 · 7 天 0 条 · 30 天 0 条
信息流里打上「轻量模型」标签的资讯、产品与论文,按刊登时间排,新的在上。
8月7日
Ling 3.0 Tiny 在 Vercel AI Gateway 限时免费至8月14日
Ling 3.0 Tiny 这阵子在 Vercel 的 AI Gateway 里免费用,想试小模型的抓紧,8月14号早上8点前都行。
7月22日
Google DeepMind 发布 Gemini 3.5 Flash-Lite,面向高吞吐重复任务
Google DeepMind 出了个更轻量的 Gemini 3.5 Flash-Lite,专门跑重复性任务,又快又便宜,适合批量处理场景。
6月26日
PP-OCRv6 部署数据:A100 上 0.13 秒一张图,CPU 比 v5 快 3.9-5.2 倍
PaddleOCR 把 v6 的部署数据拉得很细,A100 0.13 秒、M4 0.35 秒,还有三种尺寸选,想在生产环境搭 OCR 的直接抄作业。
vLLM 日首发支持 LFM2.5-230M,面向 agent 工作负载
vLLM 第一时间给 Liquid AI 的 LFM2.5 小模型做了适配,230M 参数跑 agent 任务,手机、机器人上都能用。
6月12日
6月3日
行业13:43
Cohere 赞助黑客马拉松:让模型回归小巧实用想用低成本模型做出真正有用的东西?这场黑客马拉松就是为你准备的——Cohere 赞助、Hugging Face 和 Gradio 主办,直接上手做点小而美的 AI 应用,建议关注。