Réponse rapide
Ajoutezmodel, model_context_window et model_auto_compact_token_limit au début de config.toml. Fermez ensuite complètement Codex, relancez-le et démarrez une nouvelle conversation. GPT-5.6 Sol prend officiellement en charge 1 050 000 tokens via l’API. La configuration ci-dessous demande un budget de 1 000 000 tokens et lance la compaction automatique vers 900 000 tokens.
Configuration permanente
Placez ces lignes avant tout en-tête
[section] :
900000 conserve une marge pour la sortie, les outils et les messages suivants.
Pour une seule session CLI
- macOS / Linux
- Windows PowerShell
Vérifier et dépanner
- Redémarrez Codex et ouvrez une nouvelle conversation.
- Vérifiez que
gpt-5.6-solest le modèle actif. - S’il est indisponible, vérifiez le Model ID et le provider dans le model plaza.
- Si Codex ignore les valeurs, vérifiez qu’elles sont au niveau racine du bon fichier et qu’elles ne sont pas dupliquées.
Contexte effectif, consommation et coût
Codex réserve une partie du contexte à la sortie, aux appels d’outils et aux instructions système. Les limites du client ou du serveur peuvent déclencher une compaction anticipée. Un contexte plus grand conserve davantage de code et d’historique, mais peut fortement augmenter les tokens d’entrée, la latence et le coût. Pour une tâche courte, le réglage par défaut est généralement préférable.Documents associés
- Installation de Codex et custom provider
- Guide complet de config.toml
- model_provider, Base URL et wire_api

