Resposta rápida
Adicionemodel, model_context_window e model_auto_compact_token_limit no início do config.toml. Depois, encerre totalmente o Codex, abra-o novamente e crie uma conversa nova. O GPT-5.6 Sol oferece oficialmente 1.050.000 tokens via API; esta configuração solicita um orçamento de 1.000.000 e inicia a compactação do histórico por volta de 900.000.
Configuração permanente
Coloque estas linhas antes de qualquer cabeçalho
[section]:
900000 preserva espaço para saída, ferramentas e novas mensagens.
Apenas para uma sessão CLI
- macOS / Linux
- Windows PowerShell
Verificar e corrigir problemas
- Reinicie o Codex e crie uma conversa nova.
- Confirme que o modelo ativo é
gpt-5.6-sol. - Se ele não estiver disponível, confira o Model ID e o provider no model plaza.
- Se os valores forem ignorados, confirme que estão no nível superior do arquivo correto e sem duplicatas.
Contexto efetivo, consumo e custo
O Codex reserva parte da janela para saída, chamadas de ferramentas e instruções do sistema, e pode compactar antes por limites do cliente ou servidor. Um contexto maior retém mais código e histórico, mas pode aumentar bastante tokens de entrada, latência e custo. Para tarefas curtas, o padrão costuma ser melhor.Documentos relacionados
- Instalação do Codex e custom provider
- Guia completo do config.toml
- model_provider, Base URL e wire_api

