Simon Willison · 博客

llm-chat-completions-server 0.1a0

llm-chat-completions-server 0.1a0

二〇二六年八月二十六日 · 英文原文

llm-chat-completions-server 0.1a0 发布,旨在支持 OpenAI Chat Completion 风格请求,利用 LLM 0.32rc1 中新增的内容可寻址日志(content-addressable logs)对消息哈希去重。用户可通过 `uv tool install llm --pre` 安装,并在 9001 端口启动服务器,暴露所有已安装的 LLM 模型。代码由 GPT-5.6 Sol 编写。

发布:llm-chat-completions-server 0.1a0

LLM 0.32rc1 中新增的内容可寻址日志(content-addressable logs)的一个关键目标是支持 OpenAI Chat Completion 风格的请求,其中每条新消息都会扩展之前的对话,如下所示:

curl http://localhost:8002/v1/chat/completions \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "qwen3.5-4b",
    "messages": [
      {"role": "user", "content": "Capital of France?"},
      {"role": "assistant", "content": "Paris."},
      {"role": "user", "content": "Germany?"}
    ]
  }'

这里对话状态由客户端跟踪,因此每个请求会变得越来越长。LLM 中的新 schema 设计旨在通过使用各个消息部分的哈希值来对这些请求进行去重。

为了测试这一功能,我构建了以下插件:

uv tool install llm --pre
llm install llm-chat-completions-server
llm chat-completions-server -p 9001

运行上述命令会在 9001 端口启动一个 localhost 服务器,该服务器通过兼容 ChatGPT Completions 的端点暴露你安装的所有 LLM 模型(来自任何已安装的插件)。

GPT-5.6 Sol 编写了整个代码——事实证明它非常了解 OpenAI Chat Completions API 的结构。

标签:projects, openai, llm

译自 Simon Willison · 博客 · 录于 二〇二六年八月二十六日