本地模型接入台

这台机器上跑着一个 30B 的模型。
同一个网络里的任何一台电脑、任何支持"自定义接口"的 agent,填三个值就能用它。
网关检测中…
模型 —
已发钥匙 —

要填的三个值

① 接口地址(Base URL)—— 结尾的 /v1 不能少
-
② 模型名(Model)
qwen3-coder:30b
要看图(手机截图 / 照片 / 表格)就把模型名换成 qwen3-vl:8b,地址和钥匙都不用动。看字用上面的,看图用这个。
③ 钥匙(API Key)—— 每台电脑领自己的
还没领 → 点右边按钮,填个名字就发给你
只有这三个框要填。其余全部留空 —— Organization、Project、Region、代理、模型参数, 一个都别动。这是所有人填错的地方。

填进 agent —— 照着对号入座

Cherry Studio(图形界面最好懂)
位置:左下角齿轮「设置」→「模型服务」→ 右上「添加」→ 名字随便写(如 本地)→ 类型必须选 OpenAI
API 地址
API 密钥
模型
其余留空。点「检查」应提示成功。
模型那栏要手动「添加模型」把名字粘进去,不是下拉选的。
Cline / Roo Code(VS Code 插件)
位置:侧边栏打开 Cline → 齿轮 Settings
· API ProviderOpenAI Compatible
Base URL
API Key
Model ID
其余留空。把 Request Timeout 调到 600 秒以上。
Cursor(写代码的编辑器)
位置:Settings →「Models」
1. 打开 Override OpenAI Base URL,填下面这个
Base URL
2. 在 OpenAI 的 API Key 框里填钥匙,点 Verify
API Key
3. 「Add model」手动加模型名
模型
只勾选新加的这一个模型,别的名字它连不上、会一直转圈。
Chatbox(桌面 / 手机,最简单)
位置:设置 →「模型」→ 添加自定义提供方
· API 模式OpenAI API Compatible
API 域名
API 路径留空
API 密钥
模型
OpenClaw(你那套群控用的)
位置:跑 OpenClaw 那台电脑的 C:\Users\你的用户名\.openclaw\openclaw.json
models.providers 里加一块 local
baseUrl
apiKey
模型 id
另外两行固定写:"api": "openai-completions""timeoutSeconds": 600
改完执行 openclaw models list --provider local 验证。
Dify / n8n / AnythingLLM / Open WebUI
套路一样:模型供应商选 OpenAI,然后
API Base
API Key
模型名
不要选 "Ollama" 或 "LocalAI",那些走别的协议,连不上。
用代码调(Python / Node)
任何 OpenAI SDK 改一行就行:
base_url
api_key
model
现成能跑的示例:D:\QWEN\ollama-api-examples\call_ollama.py
记这三条就够
1. 只填地址 / 钥匙 / 模型,其余全留空
2. 地址结尾必须带 /v1
3. 超时一律调到 600 秒 —— 模型冷启动要 90 秒,默认超时会误判
不要双击 HTML 文件打开任何页面。 要从浏览器地址栏输入 进去。 资源管理器里双击打开的话,页面发不出请求。
领钥匙页 用量看板 健康检查(机器看的,别当网页打开):/health
服务端(这台机器)自己发钥匙、删钥匙:双击桌面上的 钥匙管理.cmd。已过期的钥匙删掉后,对方下次请求立刻失效。