#开源模型
一个 8.5MB 的 TTS 模型,笔记本 CPU 就能跑,速度是实时的 25 倍,音质只比原版 Kokoro 低一点,还开源了代码和音频样本。
Nvidia 投资的 Reflection 放出了开源权重模型 Beam,主打编程和智能体任务,直接对标 DeepSeek 这些中国开源模型,价格还更便宜。
Kimi 背后的月之暗面估值半年多从 315 亿涨到 500 亿美元,ARR 三个月翻倍,准备明年去香港上市,监管调查这块也值得留意。
训练万亿参数 MoE 模型的负载不均问题有了新解法,DeepSeek-V4-Pro 上实测训练加速最高 1.94 倍,还不用加硬件,做训练的可以看看。
本地小模型也能当药物发现的规划器了,Llama 3.2-3B 微调后工具调用准得吓人,就是碰到没见过的流程还会翻车。
智谱的 GLM-5.3 上架了 Amazon Bedrock,海外调用量直接能分钱,国内华为云阿里云也有类似协议,这套分成打法挺值得看看。
swyx 梳理了 Meta 从 Llama 4 翻车到重回前沿讨论的 18 个月,Alexandr Wang 的组建思路值得看看。
有团队把 3D 重建里的 Gaussian Splatting 搬进语音压缩,不用 codebook 也能做到和 EnCodec、DAC 差不多的效果,思路挺新鲜。
英伟达投的 Reflection AI 憋了个大招,Beam 开放权重,直接叫板 DeepSeek 和 GLM-5.2,跑代码和智能体任务的朋友可以关注下。
拿了 20 亿美金的 Reflection 放出首个开源模型 Beam,501B 参数只激活 23B,直接对标 GLM 和 DeepSeek 的 Flash 系列,权重本月放出。
Z.ai 把 GLM 5.3 放到了 Amazon Bedrock 上,753B 参数的 MoE 模型,跑代码和长任务,还教你用提示词缓存省成本。
用 Pi Durable 搭了个类似 OpenAI dots 的个人智能体,断点续跑、有记忆还有自己的 Linux 桌面,之后还打算开源,动手党可以跟着试试。
Reflection AI 放了个 501B 总参、23B 激活的开源模型 Beam,主攻编程和智能体任务,权重这个月就放,做本地部署的可以盯一下。
vLLM 和 Hugging Face 一起办开源 AI 开发者聚会,10 月 16 日在旧金山 The Midway,在湾区的话可以去认识一圈开源圈的人。
Reflection 出了第一个开源模型 Beam,500 多亿参数里每次只用 23B 激活,主打编程和智能体任务,权重这个月就放出,可以关注下。
Reflection AI 放出了首个开源模型 Beam,501B 只激活 23B,官方说打平 GLM-5.2 还省 3-4 倍算力,做编程和智能体的可以关注权重发布。
Reflection 新模型 Beam 正在被 Artificial Analysis 独立测试,早期数据显示它是同级开源模型里最省 token 的之一。
Reflection 新模型又输给了中国模型,跟 Nvidia 和 Thinking Machines 一样,Lambert 直说中国团队做 LLM 确实很强。
Reflection 放了个 501B 的开源模型 Beam,激活只有 23B,跑智能体省算力,号称效率比 GLM 5.2 高 3-4 倍,权重本月放出。
Reflection AI 出了个开源模型 Beam,501B 参数只激活 23B,跑编程和智能体任务省算力,权重这个月就放,可以蹲一下。
Reflection AI 开源了 Beam,501B 参数 MoE,作者称推理算力只要 GLM-5.2 的三分之一,Apache 2.0 可商用,不过注意这数字只是估算。
Reflection AI 出了个叫 Beam 的开源模型,501B 参数只激活 23B,主打编程和 Agent,本月开源权重,Ollama 也能跑。
Nvidia 投资的 Reflection 出了首个开源权重模型 Beam,号称推理打平 GLM-5.2 还更省算力,权重这个月就放。
Reflection 的 Beam 开源在即,501B 参数只激活 23B,SWE-bench Verified 拿到 80.9 分,效率号称比 GLM 5.2 高 3-4 倍,写代码跑智能体的可以盯一下。
IBM 和 Red Hat 会在 PyTorch 大会上讲 Spyre 加速器和分布式推理的落地细节,做底层基础设施的可以去听。
Reka AI 用 320 块 H100 三个月训出 19B 的 Rho-1,文本图像视频加机器人控制一个模型全包,算力开销比主流大模型小得多。
GitHub 做了个专门测 AI 代码审查能力的开源基准 ReviewBench,用真实 PR 和生产对齐的指标打分,做代码审查工具的可以拿来自测。
PyTorchCon 北美大会下个月开,两天议程全围绕 vLLM、Ray、DeepSpeed 这些开源框架,做推理和训练的可以去看看。
Upstage 的 Solar Mini 4 这两周在 Nous Portal 免费用,3B 激活参数却能打过 10 倍大的模型,赶紧去试试。