创建并使用 API 密钥
- 登录控制台后进入“API 密钥”。
- 点击“创建”,填写名称并选择服务分组。
- 分组倍率代表对应计费倍率。按客户端选择 GPT、Claude 或 Kiro 等分组。
- 保存密钥;密钥仅展示一次,请妥善保管。
- 可通过 CC Switch 导入,或在客户端手动填写 API 地址和密钥。
- 调用后在控制台的请求日志中核对模型、Token 与费用。
API 基础地址:https://tokenapis.com/。部分 OpenAI 兼容客户端要求填写 https://tokenapis.com/v1。
安装 CC Switch
CC Switch 是用于管理和切换 API 服务商的开源工具。
官方 Releases
官方中文手册
macOS
- 从官方 Releases 下载
.dmg 文件。 - 打开安装包,将 CC Switch 拖入 Applications。
Windows
- 在 Releases 中展开“Show all assets”。
- 下载
Windows.msi 安装包并按提示安装。
配置词元 API
- 创建新的服务商配置。
- 基础地址填写
https://tokenapis.com/。 - 填入控制台创建的 API Key。
- 保存并切换至该配置,通过余额查询或一次测试请求验证。
模型与尺寸
| 模型 | 分辨率 | 常用尺寸 |
|---|
gpt-image-2 | 1K | 1024x1024 |
gpt-image-2-2k | 2K 原生 | 1792x1024、1024x1792、2560x1440 |
gpt-image-2-4k | 4K 原生 | 3840x2160 |
纯文本生图
接口:POST /v1/images/generations
curl --request POST "https://tokenapis.com/v1/images/generations" \
--header "Content-Type: application/json" \
--header "Authorization: Bearer <your-api-key>" \
--data '{
"model": "gpt-image-2",
"prompt": "生成一张 2D 游戏角色立绘",
"size": "1024x1024"
}'
公网 URL 参考图
仍使用 /v1/images/generations,通过 reference_images 传入可公开访问的 URL。
{
"model": "gpt-image-2",
"prompt": "保持参考图角色一致,生成待机图",
"size": "1024x1024",
"reference_images": ["https://example.com/reference.png"]
}
本地图片参考图
接口:POST /v1/images/edits,使用 multipart 上传。
curl --request POST "https://tokenapis.com/v1/images/edits" \
--header "Authorization: Bearer <your-api-key>" \
-F "model=gpt-image-2" \
-F "prompt=保持参考图角色一致,生成待机图" \
-F "size=1024x1024" \
-F "image[]=@/path/to/reference.png;type=image/png"
本地图片必须使用 /v1/images/edits;不要把本地路径放进 reference_images。
安装 Codex CLI
需要 Node.js 18+ 和 npm 8+。
npm install -g @openai/codex
codex --version
接入词元 API
可通过 CC Switch 导入,或在配置中将请求地址指向 https://tokenapis.com/ 并填入 API Key。
模型上下文参考
| 模型 | 上下文上限 | 最大输出 | 定位 |
|---|
gpt-5.6 / gpt-5.6-sol | 1,050,000 | 128,000 | 复杂推理与编码 |
gpt-5.6-terra | 1,050,000 | 128,000 | 质量与成本平衡 |
gpt-5.6-luna | 1,050,000 | 128,000 | 高频、成本敏感任务 |
gpt-5.5 | 1,050,000 | 128,000 | 上一代旗舰 |
gpt-5.4 | 1,050,000 | 128,000 | 通用编码与专业工作 |
gpt-5.4-mini | 400,000 | 128,000 | 轻量、高吞吐 |
Codex 上下文配置
日常使用建议保留模型的真实上限,同时在进入长上下文加价区间前自动压缩:
model_context_window=1050000
model_auto_compact_token_limit=240000
GPT-5.4、GPT-5.5 与 GPT-5.6 系列在输入超过 272K 后会触发长上下文加价。只有确实需要超长上下文时,才建议把自动压缩阈值提高到 900,000;不要把 1,000,000 当作所有任务的日常默认阈值。
准备客户端
安装支持自定义第三方服务的 Claude Desktop 版本。出于安全考虑,请仅从可信官方渠道获取安装程序。
配置第三方模型
- 打开设置并启用 Developer Mode。
- 进入“Configure Third-Party”。
- URL 填写
https://tokenapis.com/。 - 填入词元 API Key,点击“Apply Locally”。
- 新建 Project,选择本地工程目录并发送测试消息。
若配置未生效,请检查 URL、密钥和所选分组,并确认已点击“Apply Locally”。
安装 Claude Code
macOS / Linux / WSL
curl -fsSL https://claude.ai/install.sh | bash
Windows CMD
curl -fsSL https://claude.ai/install.cmd -o install.cmd && install.cmd && del install.cmd
接入词元 API
推荐通过 CC Switch 导入,或手动将请求 URL 设置为 https://tokenapis.com/ 并填入 API Key。
使用 GPT 分组
- 在控制台创建 API Key 时选择 GPT 分组。
- 在 CC Switch 中手动创建配置,填写该 Key 与词元 API 地址。
- 其余 Claude Code 配置保持默认,发送请求后在控制台核对计费。
1 小时缓存请求特征
网关需要完整 Claude Code 请求特征,包括 x-app: cli、Anthropic 版本、会话 ID,以及带 ttl: 1h 的 cache_control。仅修改 User-Agent 不足以启用。
可用模型
| 模型 | 用途 |
|---|
gemini-3.1-pro-preview | 复杂任务 |
gemini-3-pro-preview | 通用推理 |
gemini-3-flash-preview | 高速度、Agent 工作流 |
基础配置
在支持 OpenAI 兼容端点的配置项中使用 https://tokenapis.com/v1,填入 API Key,并选择上表中的模型。
不同 Gemini CLI 版本的自定义端点参数可能不同,请以当前客户端配置项为准。
OpenAI 兼容 Agent
适用于支持自定义 OpenAI Compatible API 的 Agent 工具。
| Base URL | https://tokenapis.com/ |
|---|
| API Key | 在词元控制台创建的密钥 |
|---|
| 质量优先 | gpt-5.6 或 gpt-5.6-sol |
|---|
| 成本平衡 | gpt-5.6-terra |
|---|
| 兼容选择 | gpt-5.5 或 gpt-5.4 |
|---|
正常配置使用不带 /v1 的基础地址。只有具体客户端明确要求版本路径时,才按该客户端说明添加。
使用 BYOK 扩展
Cursor 本身的自定义模型能力可能受版本或套餐限制。可使用开源 BYOK 扩展配置兼容服务。
cursor-byok 官方 Releases
- 从项目 Releases 下载与系统匹配的扩展。
- 在 Cursor 中安装扩展并打开 BYOK 配置。
- Base URL 填写
https://tokenapis.com/v1。 - 填入 API Key 与目标模型名。
- 保存后发送一条测试请求。
安装与配置
OpenCode 官方 Releases
- 下载并安装适合当前系统的 OpenCode。
- 新增 OpenAI 兼容服务商。
- 请求 URL 设置为
https://tokenapis.com/v1。 - 填入 API Key 和目标模型。
- 保存并发送测试请求。
OpenCode 的请求 URL 末尾需要包含 /v1。
安装 Grok CLI
curl -fsSL https://x.ai/cli/install.sh | bash
配置
当前需手动设置。将以下内容合并到 Grok CLI 配置文件,并替换 API Key。
[cli]
installer = "internal"
[models]
default = "grok-4.5"
default_reasoning_effort = "xhigh"
[model."grok-4.5"]
model = "grok-4.5"
base_url = "https://tokenapis.com/v1"
api_key = "sk-xxxxxxxxxxxxxxx"
api_backend = "chat_completions"
supports_reasoning_effort = true
reasoning_efforts = ["none", "minimal", "low", "medium", "high", "xhigh", "max"]
[ui]
max_thoughts_width = 120
fork_secondary_model = "grok-build"
yolo = false
compact_mode = false
permission_mode = "always-approve"
其他客户端
在 Claude Code 中使用时可选择 Kiro 分组并请求 grok-4.5。在 Cursor 中配置时,核心参数为模型名、https://tokenapis.com/v1 和 API Key。