Browse documentation
Configuration de Codex
Utilisez Codex avec le canal Codex dédié. Créez une clé dans le tableau de bord, sélectionnez Codex, puis utilisez cette clé dans votre client. Le canal consomme le quota acheté à 0,8×, sans modifier la quantité de quota achetée.
Les clés Codex prennent uniquement en charge les modèles GPT/Codex. Les clés AWSQ et CCMAX utilisent l’endpoint compatible Anthropic, tandis que les clés Gemini utilisent /api/gemini.
Modèles et tarifs
| Modèle | Canal | Entrée | Cache | Sortie |
|---|---|---|---|---|
gpt-6-astra | Codex | 8.00 | 0.80 | 40.00 |
gpt-6-sol | Codex | 1.60 | 0.16 | 8.00 |
gpt-6.1-sol | Codex | 1.60 | 0.08 | 8.00 |
gpt-5.5 | Codex | 4.00 | 0.40 | 24.00 |
codex-auto-review | Codex | 4.00 | 0.40 | 24.00 |
gpt-5.6-sol | Codex | 3.20 | 0.32 | 16.00 |
gpt-5.6-terra | Codex | 1.60 | 0.16 | 9.60 |
gpt-5.6-luna | Codex | 0.16 | 0.016 | 0.96 |
Les prix sont les tarifs effectifs du canal Codex en USD par million de tokens (tarifs amont multipliés par le facteur de consommation 0,8×). Le quota acheté est partagé par les requêtes de la clé.
Les tarifs indiqués pour GPT-5.5, GPT-5.6 et GPT-6 concernent les requêtes de 272 000 tokens d’entrée au maximum. Au-delà de ce seuil, les tarifs d’entrée et de cache doublent et le tarif de sortie est multiplié par 1,5 pour toute la requête. L’écriture du cache coûte 1,25× le tarif d’entrée de base pour GPT-5.6 et GPT-6. Consultez les tarifs OpenAI de GPT-5.5, GPT-5.6 Sol, Astra et GPT-6 Sol.
Fast coûte 2× le tarif Standard pour GPT-5.6 et GPT-6, et 2,5× pour GPT-5.5 en contexte court. Flex coûte 0,5× pour ces modèles. La facturation suit service_tier dans la réponse. Si ce champ est omis, le canal envoie default ; auto réserve le coût Fast possible. Les niveaux sans tarif configuré, dont ultrafast, sont refusés. Voir les tarifs Fast OpenAI.
En plus des tokens, chaque recherche Web intégrée coûte 0,008 $ et chaque appel File search 0,002 $ après le facteur Codex de 0,8×. L’ouverture d’une page ne déclenche pas de frais de recherche. Code Interpreter hébergé, le shell hébergé et la génération d’images ne sont pas disponibles sur ce canal, car leurs frais distincts ne peuvent pas y être calculés avec précision. Consultez les tarifs des outils OpenAI.
Pour GPT-5.5, GPT-5.6 et GPT-6, max_output_tokens vaut 32 768 par défaut s’il est omis (jusqu’à 128 000 sur demande explicite). Les outils de recherche intégrés de tout modèle Codex sont limités à cinq appels par défaut, sauf si max_tool_calls est défini. Le contexte conservé côté serveur (previous_response_id, conversation ou un identifiant de prompt) et les références à des fichiers ou images distants ne sont pas disponibles pour ces modèles ni pour les requêtes utilisant des outils facturés, car leur usage en entrée ne peut pas être réservé sur le quota.
Le contenu récupéré est aussi facturé au tarif d’entrée du modèle. max_tool_calls accepte 0–20. La réservation couvre jusqu’à 1 050 000 tokens d’entrée par continuation possible, avec les tarifs de contexte long, d’écriture du cache et du niveau de service. Elle peut dépasser nettement la facture finale. Réduire le nombre d’appels réduit la réservation temporaire, libérée après facturation de l’usage réel.
Codex CLI
Installez le CLI officiel avec Node.js 18 ou une version plus récente :
1 npm install -g @openai/codex2 codex --version
Le CLI lit ~/.codex sur macOS/Linux et C:\Users\VotreNomUtilisateur\.codex sur Windows. Créez ce dossier s’il n’existe pas.
config.toml
Créez config.toml dans ce dossier :
1 model_provider = "aiinide"2 model = "gpt-5.5"3 model_reasoning_effort = "high"4 disable_response_storage = true5 6 [model_providers.aiinide]7 name = "AI in IDE"8 base_url = "https://aiinide.com/api/codex"9 wire_api = "responses"10 requires_openai_auth = true11 12 [features]13 web_search_request = true
gpt-5.5 est le modèle Codex par défaut. Choisissez gpt-6-astra, gpt-6-sol ou gpt-6.1-sol pour la famille GPT-6 ; gpt-5.6-sol, gpt-5.6-terra et gpt-5.6-luna sont également disponibles. L’URL doit s’arrêter à /api/codex; le CLI ajoute /responses.
auth.json
Dans le même dossier, créez auth.json avec la clé créée dans votre tableau de bord :
1 {2 "OPENAI_API_KEY": "YOUR_DASHBOARD_API_KEY"3 }
N’utilisez jamais la clé amont CODEX_API_KEY du serveur dans un client.
Démarrer Codex
1 cd your-project2 codex
L’extension Codex officielle pour VS Code peut utiliser les mêmes fichiers. En cas de configuration manquante, vérifiez leur emplacement et le type de la clé.
Responses API
Endpoint :
1 POST https://aiinide.com/api/codex/responses
1 export CODEX_API_KEY="YOUR_DASHBOARD_API_KEY"2 3 curl https://aiinide.com/api/codex/responses \4 -H "Authorization: Bearer $CODEX_API_KEY" \5 -H "Content-Type: application/json" \6 -d '{7 "model": "gpt-6-astra",8 "input": "Expliquez ce dépôt en trois points.",9 "reasoning": {"effort": "high"}10 }'
Pour le streaming, ajoutez "stream": true et utilisez curl -N :
1 curl -N https://aiinide.com/api/codex/responses \2 -H "Authorization: Bearer $CODEX_API_KEY" \3 -H "Content-Type: application/json" \4 -d '{"model":"gpt-6-astra","input":"Résumez ce code.","stream":true}'
Chat Completions
Les clients compatibles OpenAI peuvent utiliser :
1 curl https://aiinide.com/api/codex/chat/completions \2 -H "Authorization: Bearer $CODEX_API_KEY" \3 -H "Content-Type: application/json" \4 -d '{"model":"gpt-5.6-terra","messages":[{"role":"user","content":"Donnez une courte checklist de publication."}],"stream":false}'
Le proxy vérifie le canal et le modèle, transmet la requête à l’amont Codex configuré et enregistre l’utilisation. N’envoyez pas les requêtes Codex à /api/anthropic.
Dépannage
401: utilisez une clé de tableau de bord valide et non expirée avecAuthorization: Bearer ....400: vérifiez le modèle, le format JSON et le canal de la clé. Les clés AWSQ/CCMAX ne sont pas acceptées.429: le quota acheté, le quota en dollars ou la limite de requêtes est atteint.503: l’amont Codex est temporairement indisponible ; réessayez plus tard.