用 Qwen-Image-2.1 画图的朋友可以试试这个官方 turbo 版,8 步就出图,比默认采样快不少,推理加速可以搭配 vllm-omni。
#开源模型
韩国 Upstage 出的 Solar Mini 4,3B 激活参数跑出 208 tokens/秒,在 Cline 里免费能用,写代码的可以试试。
StepFun 的 Step 5 Preview 发一天就冲上 OpenRouter 第一,600B 参数 MoE 加 1M 上下文,编码和前端生成都能打,10 月 15 日开源,可以换到自己现有工作流里试试。
有意思的观察:GLM-5.3-Flash 已经有三人写了专属推理引擎,作者判断未来每个模型都会有自己的深度优化版本,做推理优化的可以关注这个方向。
Ai2 和 Hugging Face 10月16日在旧金山办免费开源 AI 聚会,现场能见到开源社区的人,感兴趣可以报名。
有人统计了 OpenRouter 的数据,DeepSeek 一家跑的 Token 比 OpenAI、Google、Anthropic、xAI 四家加起来还多,可以看看。
DeepSeek 在 OpenRouter 上的调用量超过了 OpenAI、Google、Anthropic 和 xAI 四家加起来,开源模型的真实使用量值得看看这组数据。
KingKong 把 1.8 kg 的 22 自由度跳跳机器人 Jumper 整套开源了,从 MuJoCo 强化学习到 RKNN 部署都有,能跳 400 mm,做硬件的朋友可以直接复现。
华为系团队 openJiuwen 把企业级 agent 运行时开源了,swarm 调度、沙箱、多租户隔离都内置,想搭智能体平台的可以看看。
Liquid AI 把决策模型做小做快了,d1-3B 单次判断 8 毫秒,d1-omni-600M 还能听语音,权重已放出可自己微调部署。
Yann LeCun 路线的 JEPA 思想做了个开源实现,把预测拆成互不干扰的要素分别推算,附论文和 GitHub 框架,想搞世界模型研究的可以看看。
JetBrains 开源了新的编程模型 Mellum2.1,专门练了智能体写代码的能力,高负载下吞吐量几乎是 Qwen3.5-9B 两倍,还能本地部署保数据安全。
Mistral 上了个 1T 参数的大家伙,激活只有 49B,Agent Arena 排名升了 11 位,10 月底开源,可以等等看。
35B 的模型离线跑在 iPhone 上只占 1.8GB 内存,这压缩水平真少见,做端侧 AI 的朋友可以看看他们的开源方案。
四个人的小团队用 AI 写代码,做了免费开源的 PhotoCraft 和 LightCraft 来替代 Photoshop 和 Lightroom,不用订阅不用联网,还在 Alpha 阶段可以尝鲜。
一个从数据、工具到权重全开源的 Lean 4 定理证明器,用 AlphaProof 万分之一不到的算力拿到 MiniF2F 50.8% pass@16,搞形式化验证的可以自己复现了。
Robbie Tilton 的开源修图工具 Compositor 出了 v1.4,GPU 渲染快了 10 倍,整个应用才 11MB,想找 PS 平替可以试试。
LightOn 的开源 OCR 模型 OCR-3 出了,0.8B 和 4B 两个版本都能自己部署,表格图表效果不错,价格比 Gemini 便宜不少,做文档处理可以试试。
Bindu Reddy 说中国公司不能套壳 Claude 或 OpenAI,只能硬做模型,所以 DeepSeek、GLM、Kimi 越来越强,观点挺有意思。
如果你在旧金山,周六下午两点去 Dolores Park 就能碰到 UnslothAI 的 Daniel Han 和 Mike Chen 这些开源社区的人,直接面对面聊。
Stability AI 出了个叫 SemanTok 的新方法,把视频开头的 token 做得更语义化,小模型能打三倍大的模型,做视频生成的可以看看这篇论文。