Configuration de Codex

Utilisez Codex avec le canal Codex dédié. Créez une clé dans le tableau de bord, sélectionnez Codex, puis utilisez cette clé dans votre client. Le canal consomme le quota acheté à 0,8×, sans modifier la quantité de quota achetée.

Les clés Codex prennent uniquement en charge les modèles GPT/Codex. Les clés AWSQ et CCMAX utilisent l’endpoint compatible Anthropic, tandis que les clés Gemini utilisent /api/gemini.

Modèles et tarifs

ModèleCanalEntréeCacheSortie
gpt-6-astraCodex8.000.8040.00
gpt-6-solCodex1.600.168.00
gpt-6.1-solCodex1.600.088.00
gpt-5.5Codex4.000.4024.00
codex-auto-reviewCodex4.000.4024.00
gpt-5.6-solCodex3.200.3216.00
gpt-5.6-terraCodex1.600.169.60
gpt-5.6-lunaCodex0.160.0160.96

Les prix sont les tarifs effectifs du canal Codex en USD par million de tokens (tarifs amont multipliés par le facteur de consommation 0,8×). Le quota acheté est partagé par les requêtes de la clé.

Les tarifs indiqués pour GPT-5.5, GPT-5.6 et GPT-6 concernent les requêtes de 272 000 tokens d’entrée au maximum. Au-delà de ce seuil, les tarifs d’entrée et de cache doublent et le tarif de sortie est multiplié par 1,5 pour toute la requête. L’écriture du cache coûte 1,25× le tarif d’entrée de base pour GPT-5.6 et GPT-6. Consultez les tarifs OpenAI de GPT-5.5, GPT-5.6 Sol, Astra et GPT-6 Sol.

Fast coûte 2× le tarif Standard pour GPT-5.6 et GPT-6, et 2,5× pour GPT-5.5 en contexte court. Flex coûte 0,5× pour ces modèles. La facturation suit service_tier dans la réponse. Si ce champ est omis, le canal envoie default ; auto réserve le coût Fast possible. Les niveaux sans tarif configuré, dont ultrafast, sont refusés. Voir les tarifs Fast OpenAI.

En plus des tokens, chaque recherche Web intégrée coûte 0,008 $ et chaque appel File search 0,002 $ après le facteur Codex de 0,8×. L’ouverture d’une page ne déclenche pas de frais de recherche. Code Interpreter hébergé, le shell hébergé et la génération d’images ne sont pas disponibles sur ce canal, car leurs frais distincts ne peuvent pas y être calculés avec précision. Consultez les tarifs des outils OpenAI.

Pour GPT-5.5, GPT-5.6 et GPT-6, max_output_tokens vaut 32 768 par défaut s’il est omis (jusqu’à 128 000 sur demande explicite). Les outils de recherche intégrés de tout modèle Codex sont limités à cinq appels par défaut, sauf si max_tool_calls est défini. Le contexte conservé côté serveur (previous_response_id, conversation ou un identifiant de prompt) et les références à des fichiers ou images distants ne sont pas disponibles pour ces modèles ni pour les requêtes utilisant des outils facturés, car leur usage en entrée ne peut pas être réservé sur le quota.

Le contenu récupéré est aussi facturé au tarif d’entrée du modèle. max_tool_calls accepte 0–20. La réservation couvre jusqu’à 1 050 000 tokens d’entrée par continuation possible, avec les tarifs de contexte long, d’écriture du cache et du niveau de service. Elle peut dépasser nettement la facture finale. Réduire le nombre d’appels réduit la réservation temporaire, libérée après facturation de l’usage réel.

Codex CLI

Installez le CLI officiel avec Node.js 18 ou une version plus récente :

1
npm install -g @openai/codex
2
codex --version

Le CLI lit ~/.codex sur macOS/Linux et C:\Users\VotreNomUtilisateur\.codex sur Windows. Créez ce dossier s’il n’existe pas.

config.toml

Créez config.toml dans ce dossier :

1
model_provider = "aiinide"
2
model = "gpt-5.5"
3
model_reasoning_effort = "high"
4
disable_response_storage = true
5
 
6
[model_providers.aiinide]
7
name = "AI in IDE"
8
base_url = "https://aiinide.com/api/codex"
9
wire_api = "responses"
10
requires_openai_auth = true
11
 
12
[features]
13
web_search_request = true

gpt-5.5 est le modèle Codex par défaut. Choisissez gpt-6-astra, gpt-6-sol ou gpt-6.1-sol pour la famille GPT-6 ; gpt-5.6-sol, gpt-5.6-terra et gpt-5.6-luna sont également disponibles. L’URL doit s’arrêter à /api/codex; le CLI ajoute /responses.

auth.json

Dans le même dossier, créez auth.json avec la clé créée dans votre tableau de bord :

1
{
2
  "OPENAI_API_KEY": "YOUR_DASHBOARD_API_KEY"
3
}

N’utilisez jamais la clé amont CODEX_API_KEY du serveur dans un client.

Démarrer Codex

1
cd your-project
2
codex

L’extension Codex officielle pour VS Code peut utiliser les mêmes fichiers. En cas de configuration manquante, vérifiez leur emplacement et le type de la clé.

Responses API

Endpoint :

1
POST https://aiinide.com/api/codex/responses
1
export CODEX_API_KEY="YOUR_DASHBOARD_API_KEY"
2
 
3
curl https://aiinide.com/api/codex/responses \
4
  -H "Authorization: Bearer $CODEX_API_KEY" \
5
  -H "Content-Type: application/json" \
6
  -d '{
7
    "model": "gpt-6-astra",
8
    "input": "Expliquez ce dépôt en trois points.",
9
    "reasoning": {"effort": "high"}
10
  }'

Pour le streaming, ajoutez "stream": true et utilisez curl -N :

1
curl -N https://aiinide.com/api/codex/responses \
2
  -H "Authorization: Bearer $CODEX_API_KEY" \
3
  -H "Content-Type: application/json" \
4
  -d '{"model":"gpt-6-astra","input":"Résumez ce code.","stream":true}'

Chat Completions

Les clients compatibles OpenAI peuvent utiliser :

1
curl https://aiinide.com/api/codex/chat/completions \
2
  -H "Authorization: Bearer $CODEX_API_KEY" \
3
  -H "Content-Type: application/json" \
4
  -d '{"model":"gpt-5.6-terra","messages":[{"role":"user","content":"Donnez une courte checklist de publication."}],"stream":false}'

Le proxy vérifie le canal et le modèle, transmet la requête à l’amont Codex configuré et enregistre l’utilisation. N’envoyez pas les requêtes Codex à /api/anthropic.

Dépannage

  • 401 : utilisez une clé de tableau de bord valide et non expirée avec Authorization: Bearer ....
  • 400 : vérifiez le modèle, le format JSON et le canal de la clé. Les clés AWSQ/CCMAX ne sont pas acceptées.
  • 429 : le quota acheté, le quota en dollars ou la limite de requêtes est atteint.
  • 503 : l’amont Codex est temporairement indisponible ; réessayez plus tard.
Configuration de Codex - AI in IDE Documentation | AI in IDE | Assistant de codage IA