08:39官方账号Simon Willison’s Weblog(博客/媒体)精选llm-chat-completions-server 0.1a0 基于 LLM 0.32rc1 的 content-addressable logs 特性构建,支持通过 OpenAI Chat Completions 格式请求多轮对话。用户安装后可通过命令行启动本地服务器(默认端口 9001),暴露所有已安装的 LLM 模型(如 qwen3.5-4b)。该插件由 GPT-5.6 Sol 编写,能自动去重重复消息部分。每个请求可携带完整对话历史,客户端负责维护状态。AI产品llmOpenAIChat Completions10 个信源在谈事件专题推荐理由:Simon 搞了个小工具,让你在本地用 OpenAI 的 API 格式调用任何 LLM 模型,像 qwen3.5-4b 这种,还能自动去重消息,试试看。原文稍后读已读值得跟进有用关注 llm