# Simon Willison 发布 llm-chat-completions-server 插件，把本地模型变成 OpenAI 兼容接口

> 原标题：llm-chat-completions-server 0.1a0 发布

- 来源：AI HOT 精选
- 发布时间：2026-07-30T15:43:16.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/47696
- 原文：https://simonwillison.net/2026/Jul/30/llm-chat-completions-server

## 摘要

Simon Willison 给他的 LLM 命令行工具写了个插件，启动后会在本地跑一个服务器，把你装过的所有模型（包括其他插件装的）都暴露成 OpenAI 的 /v1/chat/completions 接口。这样任何支持 OpenAI API 格式的客户端都能直接调用你本地的模型。做这个插件主要是为了测试 LLM 0.32rc1 的新日志存储设计：客...

## 推荐理由

Simon Willison 发了个小插件，把本地模型全变成 OpenAI 格式的 API 端点，主要是为了测试新版 LLM 工具用内容哈希做日志去重的设计。工具层面的创新很实在，机制也清楚，但毕竟是个小版本预览，影响范围有限。我会先打个折，给 72 分，放在 featured 里。

## 锐评

这个插件解决了一个很实际的痛点：你本地用 LLM 工具装了一堆模型，但其他支持 OpenAI API 格式的客户端调不了。现在启动一个本地服务器，所有模型就都暴露在 /v1/chat/completions 接口下了，curl 或任何兼容客户端都能直接调用。

做这个插件的主要目的是测试 LLM 0.32rc1 的新日志存储设计。新设计用内容哈希去重，客户端每次把整段对话历史发过来，重复的消息部分不会让存储无限膨胀。这是个聪明的优化，尤其适合那种客户端自己维护对话状态的场景。

整件事最有趣的点：代码是 GPT-5.6 Sol 写的。Willison 说它“对 OpenAI API 的接口形状熟得不得了”。这算是一个用 AI 写 AI 工具插件的闭环案例。不过正文没披露这个插件在生产环境下的性能表现和稳定性，也没提多模型并发调用时的资源占用情况，想直接用到正式项目里还得自己测一下。
