Skip to main content

Réponse rapide

Ajoutez model, model_context_window et model_auto_compact_token_limit au début de config.toml. Fermez ensuite complètement Codex, relancez-le et démarrez une nouvelle conversation. GPT-5.6 Sol prend officiellement en charge 1 050 000 tokens via l’API. La configuration ci-dessous demande un budget de 1 000 000 tokens et lance la compaction automatique vers 900 000 tokens.
Ce réglage n’agrandit pas le contexte d’un modèle incompatible. Le contexte réellement disponible dépend de la version de Codex, du provider, des limites serveur, de l’espace réservé à la sortie et aux outils, ainsi que de la politique de compaction. Il ne garantit pas exactement 1 000 000 tokens utilisables.

Configuration permanente

Placez ces lignes avant tout en-tête [section] :
Enregistrez, redémarrez complètement Codex et créez une nouvelle conversation. Le seuil 900000 conserve une marge pour la sortie, les outils et les messages suivants.

Pour une seule session CLI

Ces valeurs temporaires expirent à la fermeture de la session.

Vérifier et dépanner

  1. Redémarrez Codex et ouvrez une nouvelle conversation.
  2. Vérifiez que gpt-5.6-sol est le modèle actif.
  3. S’il est indisponible, vérifiez le Model ID et le provider dans le model plaza.
  4. Si Codex ignore les valeurs, vérifiez qu’elles sont au niveau racine du bon fichier et qu’elles ne sont pas dupliquées.

Contexte effectif, consommation et coût

Codex réserve une partie du contexte à la sortie, aux appels d’outils et aux instructions système. Les limites du client ou du serveur peuvent déclencher une compaction anticipée. Un contexte plus grand conserve davantage de code et d’historique, mais peut fortement augmenter les tokens d’entrée, la latence et le coût. Pour une tâche courte, le réglage par défaut est généralement préférable.

Documents associés

References