#开源模型
共 1804 条 · 7 天 274 条 · 30 天 616 条 · 话题观测 →
8月19日
8月18日
Qwen3.8-27B单提示生成惊艳效果,可在本地运行
Alibaba_Qwen发布了Qwen3.8-27B,单提示就能生成惊艳效果,对比Gemini-3.7-flash表现更好,还能在本地3090显卡上运行。
Nous Research 为 Hermes Agent 推出 Bot Mode,将代理配置变为命名机器人名册
Nous Research 给 Hermes Agent 加了 Bot Mode,每个机器人有独立记忆和技能,还能固定模型,现在桌面版默认开启,玩开源代理的可以试试。
NVIDIA Nemotron 3.5 Lightning 上线 SageMaker JumpStart
英伟达的新开源模型,30B MoE 但只跑 3B 活跃参数,放在 SageMaker 上直接部署,专为智能体高频调用设计,吞吐量翻 4 倍,适合跑大批量任务的人。
8月17日
GLM 5.3:DeepsecBench最高分开源模型,成本仅1/3
Vercel测了GLM 5.3,网络安全评分是开源模型里最高的,价格只要别家三分之一,跑deepsec.sh能多跑三倍,防御岗可以关注。
8月16日
Anthropic CEO谈AI监管:监管也能分散权力
Dario Amodei亲自下场谈监管立场:他说Anthropic推的政策是专门拖慢头部公司、帮小公司的,还拿SB53和开源模型举例,跟主流“监管=垄断”的论调不一样。
8月15日
DeepSeek V4 Pro 正式版上线国家超算互联网,Harness 同步开源
国产超算平台直接上线 DeepSeek V4 Pro 正式版,还能一键部署和二次开发,Harness 框架也开源了,搞智能体开发的朋友可以看看。
Qwen3.8-27B 登陆 Ollama,可接入 Claude Code 等工具
写代码用 Ollama 的话,Qwen3.8-27B 现在能直接跑了,还带 Apple Silicon 优化,试试呗。
阿里开源 Qwen3.8-2.4T-A95B,SiliconFlow 首日上线
阿里 Qwen3.8 开源当天就能在 SiliconFlow 上直接调用,2.4T 参数输入才两美元每百万 token,写代码做研究都能一口气跑完。
阿里Qwen团队发布Qwen 3.8开源模型,采用Apache 2.0许可
阿里开源了Qwen 3.8,270亿参数比Qwen 3.7 Plus更强,原生支持26.2万token上下文,做本地和智能体应用可以看看。
Qwen3.8-27B开源,SGLang Day-0支持单卡RTX 5090跑206 tok/s
Qwen3.8-27B开源了,SGLang当天就能跑,单张5090能到206 tok/s,小模型之王回来了,试试吧。