Codex 配置
使用专用的 Codex 渠道调用 Codex。请在控制台创建 API Key,并将类型选择为 Codex。Codex 按 0.8 倍速度消耗购买额度,但不会改变你购买的 Token 额度。
Codex Key 只支持 GPT/Codex 模型。AWSQ 和 CCMAX Key 应使用 Anthropic 兼容接口,Gemini Key 应使用 /api/gemini。
支持的模型和价格
| 模型 | 渠道 | 输入 | 缓存 | 输出 |
|---|---|---|---|---|
gpt-6-astra | Codex | 8.00 | 0.80 | 40.00 |
gpt-6-sol | Codex | 1.60 | 0.16 | 8.00 |
gpt-6.1-sol | Codex | 1.60 | 0.08 | 8.00 |
gpt-5.5 | Codex | 4.00 | 0.40 | 24.00 |
codex-auto-review | Codex | 4.00 | 0.40 | 24.00 |
gpt-5.6-sol | Codex | 3.20 | 0.32 | 16.00 |
gpt-5.6-terra | Codex | 1.60 | 0.16 | 9.60 |
gpt-5.6-luna | Codex | 0.16 | 0.016 | 0.96 |
表格中的价格是 Codex 渠道实际生效的每 100 万 Token 美元价格(上游价格乘以渠道 0.8 倍消耗系数)。使用同一个 Key 的请求共享购买额度。
表中的 GPT-5.5、GPT-5.6 和 GPT-6 价格适用于不超过 272K 输入 Token 的请求。超过 272K 时,整次请求的输入及缓存价格翻倍,输出价格为 1.5 倍。GPT-5.6 和 GPT-6 的缓存写入按基础输入价格的 1.25 倍计费。详见 OpenAI 官方的 GPT-5.5、GPT-5.6 Sol、Astra 和 GPT-6 Sol 价格。
GPT-5.6 和 GPT-6 的 Fast 费率为标准档位的 2 倍;GPT-5.5 短上下文 Fast 为 2.5 倍。这些模型的 Flex 费率为 0.5 倍,以响应中的 service_tier 为准。未指定档位时,渠道明确使用 default;显式 auto 按可能的 Fast 费用预留。未配置价格的档位(包括 ultrafast)会被拒绝。详见 OpenAI Fast 价格。
内置 Web search 每次搜索额外消耗 $0.008,File search 每次调用额外消耗 $0.002(已计入 Codex 渠道 0.8 倍系数);打开搜索结果页面不另收搜索调用费。托管 Code Interpreter、托管 shell 和图片生成工具暂不支持,因为其独立使用费无法在此准确计算。详见 OpenAI 工具价格。
GPT-5.5、GPT-5.6 和 GPT-6 未指定 max_output_tokens 时默认限制为 32,768,可显式设到最多 128,000。任意 Codex 模型的内置搜索工具默认最多调用 5 次,也可设置 max_tool_calls。这些模型以及使用收费工具的请求暂不支持服务端保存的上下文(previous_response_id、conversation 或提示词 ID)和远程文件、图片引用,因为无法据此预留输入 Token 额度。
搜索返回内容也按模型输入费率计费。max_tool_calls 可设为 0–20;预留额包括每次可能的后续执行最多 1,050,000 输入 Token,并考虑长上下文、缓存写入和处理档位,因此可能明显高于最终账单。减少调用上限可降低临时预留额;完成后按实际用量结算并释放预留。
Codex CLI
使用 Node.js 18 或更高版本安装官方 Codex CLI:
1 npm install -g @openai/codex2 codex --version
CLI 从以下目录读取配置:macOS/Linux 为 ~/.codex,Windows 为 C:\Users\你的用户名\.codex。目录不存在时创建一次即可。
config.toml
在该目录中创建 config.toml:
1 model_provider = "aiinide"2 model = "gpt-5.5"3 model_reasoning_effort = "high"4 disable_response_storage = true5 6 [model_providers.aiinide]7 name = "AI in IDE"8 base_url = "https://aiinide.com/api/codex"9 wire_api = "responses"10 requires_openai_auth = true11 12 [features]13 web_search_request = true
gpt-5.5 是 Codex 默认模型。将 model 改为 gpt-6-astra、gpt-6-sol 或 gpt-6.1-sol 可使用 GPT-6 系列;也可以选择 gpt-5.6-sol、gpt-5.6-terra 或 gpt-5.6-luna。Base URL 必须保留到 /api/codex,CLI 会继续拼接 /responses。
auth.json
在同一目录创建 auth.json,填入控制台生成的 API Key:
1 {2 "OPENAI_API_KEY": "YOUR_DASHBOARD_API_KEY"3 }
客户端不要使用服务器环境中的 CODEX_API_KEY,CLI 或编辑器只应使用你在控制台创建的 Key。
启动 Codex
进入项目目录并运行:
1 cd your-project2 codex
官方 VS Code Codex 扩展也可以使用相同的 config.toml 和 auth.json。如果扩展提示缺少配置,请检查文件位置,并确认选择的是 Codex 类型的 Key。
Responses API
Responses 接口地址:
1 POST https://aiinide.com/api/codex/responses
请求示例:
1 export CODEX_API_KEY="YOUR_DASHBOARD_API_KEY"2 3 curl https://aiinide.com/api/codex/responses \4 -H "Authorization: Bearer $CODEX_API_KEY" \5 -H "Content-Type: application/json" \6 -d '{7 "model": "gpt-6-astra",8 "input": "用三个要点解释这个代码仓库。",9 "reasoning": {"effort": "high"}10 }'
流式请求加入 "stream": true,并使用 curl -N 保持连接:
1 curl -N https://aiinide.com/api/codex/responses \2 -H "Authorization: Bearer $CODEX_API_KEY" \3 -H "Content-Type: application/json" \4 -d '{5 "model": "gpt-6-astra",6 "input": "总结这段代码。",7 "stream": true8 }'
Chat Completions
使用 Chat Completions 格式的 OpenAI 兼容客户端可调用:
1 curl https://aiinide.com/api/codex/chat/completions \2 -H "Authorization: Bearer $CODEX_API_KEY" \3 -H "Content-Type: application/json" \4 -d '{5 "model": "gpt-5.6-terra",6 "messages": [{"role": "user", "content": "给我一份简短的发布检查清单。"}],7 "stream": false8 }'
接口会校验 Key 的渠道和模型,将请求转发到已配置的 Codex 上游,并在响应后记录用量。Codex 请求不要发送到 /api/anthropic。
常见错误
401:请使用有效且未过期的控制台 Key,并通过Authorization: Bearer ...发送。400:检查模型名称、请求格式,并确认 Key 类型为 Codex。AWSQ/CCMAX Key 不能调用此接口。429:Key 的购买额度、美元额度或请求次数已达到限制。503:Codex 上游暂时不可用,请稍后重试。