Respuesta rápida
Añademodel, model_context_window y model_auto_compact_token_limit al inicio de config.toml. Después, cierra Codex por completo, vuelve a abrirlo e inicia una conversación nueva. GPT-5.6 Sol admite oficialmente 1.050.000 tokens mediante API; esta configuración solicita un presupuesto de 1.000.000 y empieza a compactar el historial alrededor de 900.000.
Configuración permanente
Coloca estas líneas antes de cualquier encabezado
[section]:
900000 deja margen para la salida, las herramientas y los mensajes siguientes.
Solo para una sesión de CLI
- macOS / Linux
- Windows PowerShell
Verificar y resolver problemas
- Reinicia Codex y abre una conversación nueva.
- Confirma que el modelo activo sea
gpt-5.6-sol. - Si no está disponible, comprueba el Model ID y el provider en el model plaza.
- Si Codex ignora los valores, confirma que estén en el nivel superior del archivo correcto y no aparezcan duplicados.
Contexto efectivo, consumo y coste
Codex reserva parte del contexto para salida, llamadas a herramientas e instrucciones del sistema, y puede compactar antes por límites del cliente o del servidor. Un contexto mayor conserva más código e historial, pero puede aumentar considerablemente los tokens de entrada, la latencia y el coste. Para tareas cortas suele convenir el valor predeterminado.Documentos relacionados
- Instalación de Codex y custom provider
- Guía completa de config.toml
- model_provider, Base URL y wire_api

