#开源模型
共 1804 条 · 7 天 272 条 · 30 天 616 条 · 话题观测 →
8月15日
DeepSeek V4 Pro 正式版上线国家超算互联网,Harness 同步开源
国产超算平台直接上线 DeepSeek V4 Pro 正式版,还能一键部署和二次开发,Harness 框架也开源了,搞智能体开发的朋友可以看看。
Qwen3.8-27B 登陆 Ollama,可接入 Claude Code 等工具
写代码用 Ollama 的话,Qwen3.8-27B 现在能直接跑了,还带 Apple Silicon 优化,试试呗。
阿里开源 Qwen3.8-2.4T-A95B,SiliconFlow 首日上线
阿里 Qwen3.8 开源当天就能在 SiliconFlow 上直接调用,2.4T 参数输入才两美元每百万 token,写代码做研究都能一口气跑完。
阿里Qwen团队发布Qwen 3.8开源模型,采用Apache 2.0许可
阿里开源了Qwen 3.8,270亿参数比Qwen 3.7 Plus更强,原生支持26.2万token上下文,做本地和智能体应用可以看看。
Qwen3.8-27B开源,SGLang Day-0支持单卡RTX 5090跑206 tok/s
Qwen3.8-27B开源了,SGLang当天就能跑,单张5090能到206 tok/s,小模型之王回来了,试试吧。
8月14日
模型23:47
Meta发布开放权重模型Glimmer,扎克伯格称AI应属于每个人Meta把开源模型Glimmer放出来了,能自己下载跑,不像自家Muse Spark只能走API。扎克伯格还发了封信说AI该人人可用。
70天超10款模型,CNBC:美国限制催化中国AI创新,加速进入全球企业业务体系
这篇把6月以来中国AI密集发模型的节奏和全球企业采购逻辑说清楚了,还给了DeepSeek比Claude便宜39倍的实测成本对比。
智谱正式发布 GLM-5.3:编程能力最强开源模型,较 GLM-5.2 提升50%
想用最强开源编程模型的可以蹲一下,GLM-5.3 纯靠后训练就把 Terminal-Bench 分数翻了 6 倍,两周后开放权重。
从原型到生产:在Microsoft Foundry上部署Fireworks模型
微软和Fireworks出了个实战指南,教你用Azure Foundry跑开源模型,从原型到生产该注意啥都讲清楚了,做AI产品的不妨看看。
8月13日