Короткий ответ
Добавьтеmodel, model_context_window и model_auto_compact_token_limit в начало config.toml, полностью перезапустите Codex и создайте новый диалог. Официальное API-окно GPT-5.6 Sol составляет 1 050 000 токенов. Конфигурация ниже задаёт для Codex бюджет в 1 000 000 токенов и запускает автоматическое сжатие истории примерно на 900 000.
Постоянная настройка
Откройте пользовательский файл Codex:
Добавьте строки на верхнем уровне, до любого заголовка
[section]:
Порог
900000 оставляет запас под ответ модели, результаты инструментов и следующие сообщения.Настройка только для одной CLI-сессии
- macOS / Linux
- Windows PowerShell
Как проверить настройку
- Полностью перезапустите Codex и создайте новый диалог.
- Убедитесь, что выбрана модель
gpt-5.6-sol. - Если модель недоступна, проверьте актуальный Model ID и поддержку provider в model plaza.
- Если значения игнорируются, проверьте путь к файлу, верхний уровень TOML и отсутствие дубликатов.
Почему доступный контекст может быть меньше
model_context_window задаёт бюджет контекста для Codex. Часть окна резервируется под ответ, инструменты и системные инструкции. Клиентские и серверные ограничения также могут уменьшить доступный объём или раньше запустить compaction. Поэтому миллион токенов — запрошенный бюджет, а не гарантированный размер каждого запроса.
Расход и стоимость
Большой контекст помогает дольше сохранять код, вывод терминала и историю диалога, но может заметно увеличить расход входных токенов, задержку и стоимость. Для коротких задач обычно лучше оставить значение по умолчанию. Актуальные модели и условия смотрите в model plaza.Связанные документы
- Установка Codex и настройка custom provider
- Полное руководство по Codex config.toml
- Как работают model_provider, Base URL и wire_api

