LLM 配置
yuyuflow 提供兼容常见大模型客户端的 API。无论你使用自研程序、OpenAI SDK 还是 CLI 工具,通常只需要配置 Base URL、API Key、Model 和超时时间。
通用配置项
| 配置项 | 说明 | 示例 |
|---|---|---|
| Base URL | 客户端发送请求的 API 基础地址 | https://art-api.yuyuflow.com/v1 |
| API Key | 在控制台创建的访问令牌 | YOUR_API_KEY |
| Model | 控制台中可用的完整模型名 | YOUR_MODEL |
| Timeout | 客户端等待响应的最长时间 | 60 秒 |
如果
https://art-api.yuyuflow.com已包含/v1,不要再次追加;不同兼容接口的路径以后端实际配置为准。
选择模型
模型市场中的模型名称就是请求体里的 model 值。调用前请检查:
- 模型名称拼写与控制台完全一致。
- 模型当前处于可用状态。
- 模型支持你需要的能力,例如文本、工具调用或视觉输入。
- 上下文长度和输出限制满足业务需求。
- 价格和限流策略符合项目预算。
不要把供应商名称、展示名称或自己的备注当作 model 参数;以控制台提供的模型 ID 为准。
令牌分组与权限
API Key 通常会绑定一个令牌分组,令牌分组决定该 Key 可以访问哪些模型和能力。建议:
- 为开发、测试和生产环境分别创建令牌。
- 为不同项目使用不同 API Key,便于成本隔离。
- 只授予业务真正需要的模型权限。
- 为高权限令牌设置较短有效期,并定期清理不用的令牌。
- 遇到
401、403或模型不可用时,先检查令牌分组和模型状态。
不要暴露凭证
API Key 只能放在服务端环境变量、密钥管理服务或本地受保护配置中。不要写入前端代码、Git 仓库、公开日志或截图。
OpenAI 兼容请求
cURL
bash
curl -X POST "https://art-api.yuyuflow.com/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_MODEL",
"messages": [
{"role": "user", "content": "请返回 pong"}
],
"temperature": 0.2
}'Python SDK
python
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://art-api.yuyuflow.com/v1",
timeout=60.0,
)
completion = client.chat.completions.create(
model="YOUR_MODEL",
messages=[{"role": "user", "content": "请返回 pong"}],
)
print(completion.choices[0].message.content)Node.js SDK
javascript
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.API_KEY,
baseURL: "https://art-api.yuyuflow.com/v1",
timeout: 60_000,
});
const completion = await client.chat.completions.create({
model: process.env.MODEL || "YOUR_MODEL",
messages: [{ role: "user", content: "请返回 pong" }],
});
console.log(completion.choices[0].message.content);配置检查顺序
建议按以下顺序定位问题:
- 用 cURL 验证 Base URL 和 API Key。
- 用控制台确认模型名和令牌分组。
- 再迁移到 Python、Node.js 或其他 SDK。
- 最后接入 Codex、Claude Code 等 CLI 工具。
常见错误
| 现象 | 优先检查 |
|---|---|
401 Unauthorized | API Key 是否正确、是否过期、是否带 Bearer 前缀 |
403 Forbidden | 令牌分组是否有目标模型权限 |
| 模型不存在 | model 是否使用完整模型 ID |
| 请求超时 | Base URL、网络、模型负载和客户端 timeout |
| 返回格式不兼容 | 客户端使用的接口类型是否与平台支持的兼容协议一致 |
下一步可阅读 快速开始、Codex 配置 或 Claude Code 配置。

