llm-chat-completions-server 0.1a0
llm-chat-completions-server 0.1a0
摘要
llm-chat-completions-server 0.1a0 发布,旨在支持 OpenAI Chat Completion 风格请求,利用 LLM 0.32rc1 中新增的内容可寻址日志(content-addressable logs)对消息哈希去重。用户可通过 `uv tool install llm --pre` 安装,并在 9001 端口启动服务器,暴露所有已安装的 LLM 模型。代码由 GPT-5.6 Sol 编写。
发布:llm-chat-completions-server 0.1a0
LLM 0.32rc1 中新增的内容可寻址日志(content-addressable logs)的一个关键目标是支持 OpenAI Chat Completion 风格的请求,其中每条新消息都会扩展之前的对话,如下所示:
curl http://localhost:8002/v1/chat/completions \
-H 'Content-Type: application/json' \
-d '{
"model": "qwen3.5-4b",
"messages": [
{"role": "user", "content": "Capital of France?"},
{"role": "assistant", "content": "Paris."},
{"role": "user", "content": "Germany?"}
]
}'
这里对话状态由客户端跟踪,因此每个请求会变得越来越长。LLM 中的新 schema 设计旨在通过使用各个消息部分的哈希值来对这些请求进行去重。
为了测试这一功能,我构建了以下插件:
uv tool install llm --pre
llm install llm-chat-completions-server
llm chat-completions-server -p 9001
运行上述命令会在 9001 端口启动一个 localhost 服务器,该服务器通过兼容 ChatGPT Completions 的端点暴露你安装的所有 LLM 模型(来自任何已安装的插件)。
GPT-5.6 Sol 编写了整个代码——事实证明它非常了解 OpenAI Chat Completions API 的结构。
标签:projects, openai, llm
译自 Simon Willison · 博客 · 录于 二〇二六年八月二十六日