本地模型接入台
这台机器上跑着一个 30B 的模型。
同一个网络里的任何一台电脑、任何支持"自定义接口"的 agent,填三个值就能用它。
要填的三个值
① 接口地址(Base URL)—— 结尾的 /v1 不能少
-
② 模型名(Model)
qwen3-coder:30b
要看图(手机截图 / 照片 / 表格)就把模型名换成 qwen3-vl:8b,地址和钥匙都不用动。看字用上面的,看图用这个。
③ 钥匙(API Key)—— 每台电脑领自己的
还没领 → 点右边按钮,填个名字就发给你
只有这三个框要填。其余全部留空 —— Organization、Project、Region、代理、模型参数,
一个都别动。这是所有人填错的地方。
填进 agent —— 照着对号入座
Cherry Studio(图形界面最好懂)
位置:左下角齿轮「设置」→「模型服务」→ 右上「添加」→ 名字随便写(如
本地)→ 类型必须选
OpenAI
API 地址
API 密钥
模型
其余留空。点「检查」应提示成功。
模型那栏要手动「添加模型」把名字粘进去,不是下拉选的。
Cline / Roo Code(VS Code 插件)
位置:侧边栏打开 Cline → 齿轮 Settings
·
API Provider 选
OpenAI Compatible
Base URL
API Key
Model ID
其余留空。把 Request Timeout 调到 600 秒以上。
Cursor(写代码的编辑器)
位置:Settings →「Models」
1. 打开
Override OpenAI Base URL,填下面这个
Base URL
2. 在 OpenAI 的
API Key 框里填钥匙,点 Verify
API Key
3. 「Add model」手动加模型名
模型
只勾选新加的这一个模型,别的名字它连不上、会一直转圈。
Chatbox(桌面 / 手机,最简单)
位置:设置 →「模型」→ 添加自定义提供方
·
API 模式 选
OpenAI API Compatible
API 域名
API 路径留空
API 密钥
模型
OpenClaw(你那套群控用的)
位置:跑 OpenClaw 那台电脑的
C:\Users\你的用户名\.openclaw\openclaw.json
在
models.providers 里加一块
local:
baseUrl
apiKey
模型 id
另外两行固定写:
"api": "openai-completions"、
"timeoutSeconds": 600
改完执行
openclaw models list --provider local 验证。
Dify / n8n / AnythingLLM / Open WebUI
套路一样:
模型供应商选 OpenAI,然后
API Base
API Key
模型名
不要选 "Ollama" 或 "LocalAI",那些走别的协议,连不上。
用代码调(Python / Node)
任何 OpenAI SDK 改一行就行:
base_url
api_key
model
现成能跑的示例:
D:\QWEN\ollama-api-examples\call_ollama.py
记这三条就够
1. 只填地址 / 钥匙 / 模型,其余全留空
2. 地址结尾必须带 /v1
3. 超时一律调到 600 秒 —— 模型冷启动要 90 秒,默认超时会误判
不要双击 HTML 文件打开任何页面。
要从浏览器地址栏输入 进去。
资源管理器里双击打开的话,页面发不出请求。