API 连接配置教程:OpenAI、Claude、Gemini 与本地模型
先明确一个概念
它本身不带任何模型——所有回复都由你接入的外部大模型生成。平台的价值在于:把你的提示词、角色卡、记忆、编排结果组织成高质量请求发给模型。所以接模型是使用一切功能的前提。
支持的 API 类型
聊天补全(Chat Completion)
| 提供商 | 说明 |
|---|---|
| OpenAI | GPT 系列 |
| Anthropic | Claude 系列 |
| Google AI Studio / Vertex AI | Gemini 系列 |
| OpenRouter | 聚合多家模型的中转服务 |
| 自定义 OpenAI 兼容 | 各类兼容格式的中转站、自建服务 |
文本补全(Text Completion)
| 提供商 | 说明 |
|---|---|
| KoboldAI | 本地开源模型前端 |
| Ollama | 本地模型管理与推理 |
| llama.cpp / TabbyAPI | 本地推理后端 |
| Text Generation WebUI | Oobabooga 界面 |
拿不准选哪种?商业 API 与绝大多数场景用聊天补全即可。
用连接管理器管理多套配置
连接管理器(Connection Manager)让你保存任意多套连接配置,一键切换:
- 打开设置面板,找到连接管理器
- 新建配置,起个能认出来的名字(如「Claude 日常」「本地 Qwen」)
- 选 API 类型、填地址和密钥,保存
- 下拉列表里随时切换——切换连接不会影响你当前用的聊天补全预设
典型用法:日常闲聊挂低成本模型,重要剧情切旗舰模型,离线场景切本地模型。模型列表会按 API 类型动态加载,也支持给自建服务手动配可用模型清单。
密钥安全
密钥存储在服务端(你自己部署的实例就是存你自己机器上),不会暴露在前端页面。如果用的是别人提供的实例,不要填重要密钥。
排查请求问题
配好之后如果回复异常,用内置的请求检查器看实际发出的请求内容和 Token 用量,详见故障排查手册。
下一步建议:先读预设解耦是什么,理解连接和预设分家后的配合方式。