事件专题 · 多源确认

LLM Chat Completions Server 0.1a0 发布,本地运行 OpenAI 兼容 API

llm-chat-completions-server 0.1a0 基于 LLM 0.32rc1 的 content-addressable logs 特性构建,支持通过 OpenAI Chat Completions 格式请求多轮对话。用户安装后可通过命令行启动本地服务器(默认端口 9001),暴露所有已安装的 LLM 模型(如 qwen3.5-4b)。该插件由 GPT-5.6 Sol 编写,能自动去重重复消息部分。每个请求可携带完整对话历史,客户端负责维护状态。

当前结论

Simon 搞了个小工具,让你在本地用 OpenAI 的 API 格式调用任何 LLM 模型,像 qwen3.5-4b 这种,还能自动去重消息,试试看。

11 个信源49° AI 热度最后更新 2026/7/30 15:43:16

证据链

主要来源Simon Willison’s Weblog
查看原文
相关来源 8歸藏(guizang.ai)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情