संक्षिप्त उत्तर
config.toml की शुरुआत में model, model_context_window और model_auto_compact_token_limit जोड़ें। फिर Codex को पूरी तरह बंद करके दोबारा खोलें और नई conversation शुरू करें। GPT-5.6 Sol की आधिकारिक API context window 1,050,000 tokens है। नीचे का config Codex से 1,000,000-token budget का अनुरोध करता है और लगभग 900,000 tokens पर history compaction शुरू करता है।
स्थायी configuration
इन पंक्तियों को किसी भी
[section] header से पहले रखें:
900000 की सीमा output, tool results और अगले messages के लिए जगह छोड़ती है।
केवल एक CLI session के लिए
- macOS / Linux
- Windows PowerShell
जाँच और समस्या समाधान
- Codex restart करके नई conversation बनाएँ।
- पुष्टि करें कि active model
gpt-5.6-solहै। - Model उपलब्ध न हो तो model plaza में वर्तमान Model ID और provider support देखें।
- Values लागू न हों तो जाँचें कि वे सही user file के top level पर हैं और दो बार घोषित नहीं की गई हैं।
वास्तविक context, usage और लागत
Codex output, tool calls और system instructions के लिए context का कुछ भाग reserve करता है। Client या server limits compaction को पहले शुरू कर सकती हैं। बड़ा context अधिक code और history रख सकता है, लेकिन input tokens, latency और लागत काफी बढ़ा सकता है। छोटी tasks के लिए default setting सामान्यतः बेहतर है।संबंधित दस्तावेज़
- Codex installation और custom provider setup
- config.toml की पूरी guide
- model_provider, Base URL और wire_api

