Skip to main content
Codex construit son propre corps de requête, vous n’avez donc pas d’endroit où placer start_within. La date limite est plutôt associée à la clé. Créez-en une d’abord (voir clés d’agent).

Configurer cela avec un agent

Ouvrez le bloc ci-dessous et copiez-le dans n’importe quel agent de codage. L’invite ne vous demande jamais votre clé API : l’agent configure tout le reste, puis imprime la ligne d’exportation que vous devrez exécuter vous-même.

Configurer Codex

Codex conserve chaque profil dans son propre fichier. Ce profil laisse votre configuration Codex habituelle intacte, et vous l’activez par exécution avec --profile.
  1. Écrivez le fichier de profil. Collez ceci une fois :
  1. Exportez la clé que Codex lit. Le fichier de profil ne la contient jamais.
  1. Démarrez Codex avec le profil.
C’est toute l’intégration. Codex appelle /v1/responses, envoie la clé comme jeton d’authentification (bearer token), et la clé fournit la date limite. L’en-tête de session nomme le fournisseur utilisé, vous pouvez donc voir que le profil a été pris en compte. Pour nous joindre à chaque exécution de Codex, placez les mêmes lignes dans ~/.codex/config.toml. Les champs model et model_provider de niveau supérieur y définissent votre valeur par défaut. env_key et auth s’excluent mutuellement. env_key lit la clé depuis votre environnement, ce qui est le chemin le plus court. Conservez plutôt les secrets dans un trousseau de clés (keychain) et vous omettez env_key, puis nommez une commande d’assistance dans auth. Conservez la ligne model. Codex utilise par défaut un slug se terminant par -codex, pour lequel nous n’avons pas de prix et que nous ne mettons jamais en concurrence. Utilisez le gpt-5.6-sol complet, car l’alias gpt-5.6 seul fait afficher un avertissement de métadonnées par Codex.

Confirmer que la clé a été appliquée

Chaque réponse est accompagnée de x-flexinference-defaults-applied. Codex n’affiche pas les en-têtes de réponse, alors lisez plutôt la requête dans le tableau de bord sous Logs.

Dépannage

Rien ne nous parvient du tout. Vous avez exécuté un codex simple, qui utilise votre fournisseur et compte habituels. Démarrez-le avec --profile flexinference. Toute erreur que vous avez vue est la leur, y compris les limites d’utilisation, et l’en-tête de session nomme le fournisseur utilisé. 400 model_not_priced_for_managed. model n’est pas défini, donc la requête est arrivée sur un slug -codex pour lequel nous n’avons pas de prix. Définissez model = "gpt-5.6-sol" dans le profil. Avec votre propre clé de fournisseur, nous exécutons ce slug à la place, sans coût de notre part. 400 service_tier_not_allowed. Le profil définit service_tier, et nous lisons le niveau de service à partir de la date limite à la place. Supprimez la ligne. 400 key_default_not_applicable nommant une route épinglée. La requête épingle une route cloud telle que foundry, qui n’a pas de niveau bon marché à mettre en concurrence. Supprimez la route épinglée, ou modifiez la clé pour un niveau de service. Chaque requête épuise un budget de tentatives complet. Codex a son propre request_max_retries, et une politique de retry de clé s’y ajoute. Définissez l’un ou l’autre, pas les deux. Le curseur reste en attente. Flex race coûte moins cher et démarre plus tard, ce que vous ressentez dans une boucle interactive. Modifiez la date limite de la clé en Priority ou Standard. La prochaine requête la prendra en compte sans redémarrage. Consultez erreurs pour toutes les refus que nous renvoyons, et clés d’agent pour celles qui ne sont pas spécifiques à Codex.