Meta开源了30B的Muse Glimmer,用Ollama就能在苹果芯片上跑,还能配合Claude Code和Codex做本地智能体,上手试试吧。
#Ollama
Ollama 云把 DeepSeek-V4-Flash 设为默认了,现在跑 200+ tps 还零数据保留,Pro 套餐能开多个长会话,写代码的可以试试。
Ollama 云把 DeepSeek-V4-Flash-0731 设为默认,速度快到 120+ tps,美欧零留存,写代码长会话管够。
Ollama云上线了DeepSeek-V4-Flash-0731,速度比昨天快2倍多,还能配合Claude Code用,可以试试。
DeepSeek-V4-Flash-0731 上架 Ollama 云了,agent 能力更强,能直接配合 Claude Code 用,跑一条命令就能体验。
Ollama 和 Intel 合作,让开源模型在 Core Ultra Series 3 上跑本地推理,隐私又好用。
Kimi 新旗舰 K3 登上 Ollama,2.8T MoE 超强视觉理解,还能直接配合 Claude Code 用,性能提升 2.5 倍每单位计算。
Ollama 说 GLM-5.2 太火了,怕服务慢,先暂停 Max 新订阅。Pro 还能买,下周还有大模型上线,想用的话赶紧。
NVIDIA老大Jensen Huang亲自发文挺开放模型,Ollama转发,说了开放模型为啥跟封闭模型一样重要,还附了公开信链接。
Elie直接把Palantir百万级的战争室搬到GitHub了,World Monitor免费开源,3D地球看全球新闻、金融、军事动态,本地AI跑,不用API,下载就能用。
NVIDIA 发了新开源模型 Nemotron Ultra,在 Ollama 上跑得很火,专门搞定复杂长任务,比之前的版本更强。
Ollama 拿到融资了,现在有 900 多万人在用它跑本地模型。开源路线越来越主流,想自己掌控 AI 栈的开发者可以关注。
Ollama 把 GLM-5.2 的云推理速度拉到 80-120 tok/s,比别家快两倍多,还支持 VS Code 和 Claude Code 调用。
Ollama 现在可以直接跑 Ornith 编程智能体了,从 9B 到 397B 都有,SWE-Bench 拿了 82.4 分,本地搞智能体编码超方便。
Ollama 把 GLM-5.2 和 Kimi-K2.7-Code 也带进 Codex 了,以前只能用 OpenAI 模型,现在敲一行命令就能切换试试。
对于需要跨平台管理对话和任务的团队或个人,Ollama 的这项更新解决了智能体碎片化问题,值得尝试将你的智能体接入常用消息应用。
Ollama 让 Gemma 4-12B 的本地部署门槛降到最低,做模型实验或本地 Agent 开发的团队可以直接跑起来,省去繁琐配置。
Hermes Desktop 让本地 AI 智能体落地更简单,做自动化或智能体开发的团队可以直接通过 Ollama 体验,无需复杂配置。