跳到正文
北京时间
原文
Simon Willison 博客·· 2026-07-30精选AI 评分72

llm-chat-completions-server 0.1a0 发布

llm-chat-completions-server 0.1a0

AI 导读

Simon Willison 发布 llm-chat-completions-server 0.1a0 插件,可在本地 9001 端口启动一个兼容 OpenAI Chat Completions API 的服务器,暴露 LLM 工具中所有已安装的模型。

推荐理由

Simon 把 LLM 工具变成了兼容 OpenAI 的 API 服务器,开发者可以本地直接用任何模型,省去适配工作,安装即用,实用性强。

正文 · AI 翻译

新版内容可寻址日志在 LLM 0.32rc1 中的一个关键目标,是能够支持 OpenAI Chat Completion 风格的请求——即每条传入消息都延续之前的对话,就像这样:

curl http://localhost:8002/v1/chat/completions \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "qwen3.5-4b",
    "messages": [
      {"role": "user", "content": "Capital of France?"},
      {"role": "assistant", "content": "Paris."},
      {"role": "user", "content": "Germany?"}
    ]
  }'

在这里,对话状态由客户端跟踪,因此这些请求会变得越来越长。LLM 中的新 schema 设计旨在利用各个消息部分的哈希值来对这些请求进行去重。

为了测试这一点,我构建了这个插件:

uv tool install llm --pre
llm install llm-chat-completions-server
llm chat-completions-server -p 9001

运行它会启动一个位于 9001 端口的 localhost 服务器,通过一个兼容 ChatGPT Completions 的端点,暴露你收藏的全部 LLM 模型(来自你已安装的任何插件)。

GPT-5.6 Sol 写了整个东西——事实证明它非常了解 OpenAI Chat Completions API 的结构。

标签:项目、openai、llm

来源:Simon Willison 博客 · simonwillison.net