#Ollama
Reflection AI 出了个叫 Beam 的开源模型,501B 参数只激活 23B,主打编程和 Agent,本月开源权重,Ollama 也能跑。
Google 把 Antigravity SDK 和 Gemma 4 打通了,本地离线跑智能体,不花 token 钱,还能接 Ollama,适合想自己折腾本地部署的人。
教你把 Qwen3.8-27B 装进 Mac 本地跑代码,内存要多少、怎么配引擎、测试怎么兜底都写清楚了,还能当 Claude Code 的免费备胎。
DeepSeek 新出的 V4.1-Flash 模型,现在可以直接在 Ollama 云端用了,比之前的 DeepSeek 模型好用、快、便宜。
DeepSeek 新出的 V4.1-Flash 模型,在 Ollama 云端上线了,比之前的小模型更智能、更快,还能处理图片,适合 Max 和 Team 帐户的用户。
Ollama adds Kimi K3 to Pro & Max plans, offering more models soon. Try it with Claude Code for cloud access.
Ollama官方说deepseek v4 flash跑得最好,本地想试的话有qwen3.8优化版,但注意qwen慢30倍贵4.5倍,小样本测试。
Ollama 云端上线了 DeepSeek-V4-Pro,订阅 Pro/Max 就能直接用,美国节点还带零数据保留,要试的话一条命令就够。
Ollama 现在能直接跑 DeepSeek Harness 了,全本地运行,还能看后台轨迹,所有组件都能当插件换,挺好玩,值得试试。
写代码用 Ollama 的话,Qwen3.8-27B 现在能直接跑了,还带 Apple Silicon 优化,试试呗。
Ollama和NVIDIA联手了,新出的Nemotron 3.5 Lightning主打快和高效,还是开源的,做智能体可以试试。
NVIDIA 新出的 30B 模型,跑在本地,专门给常驻智能体用,速度快 4 倍,还支持 1M 上下文,搞智能体的可以试试。