Skip to main content

संक्षिप्त उत्तर

config.toml की शुरुआत में model, model_context_window और model_auto_compact_token_limit जोड़ें। फिर Codex को पूरी तरह बंद करके दोबारा खोलें और नई conversation शुरू करें। GPT-5.6 Sol की आधिकारिक API context window 1,050,000 tokens है। नीचे का config Codex से 1,000,000-token budget का अनुरोध करता है और लगभग 900,000 tokens पर history compaction शुरू करता है।
यह setting ऐसे model को लंबा context नहीं देती जो इसका समर्थन नहीं करता। वास्तविक usable context Codex version, provider, server limits, output और tools के लिए reserve, तथा compaction policy पर निर्भर करता है। ठीक 1,000,000 tokens उपलब्ध होना सुनिश्चित नहीं है।

स्थायी configuration

इन पंक्तियों को किसी भी [section] header से पहले रखें:
फ़ाइल सेव करें, Codex को पूरी तरह restart करें और नई conversation बनाएँ। 900000 की सीमा output, tool results और अगले messages के लिए जगह छोड़ती है।

केवल एक CLI session के लिए

Session बंद होने पर ये temporary values समाप्त हो जाती हैं।

जाँच और समस्या समाधान

  1. Codex restart करके नई conversation बनाएँ।
  2. पुष्टि करें कि active model gpt-5.6-sol है।
  3. Model उपलब्ध न हो तो model plaza में वर्तमान Model ID और provider support देखें।
  4. Values लागू न हों तो जाँचें कि वे सही user file के top level पर हैं और दो बार घोषित नहीं की गई हैं।

वास्तविक context, usage और लागत

Codex output, tool calls और system instructions के लिए context का कुछ भाग reserve करता है। Client या server limits compaction को पहले शुरू कर सकती हैं। बड़ा context अधिक code और history रख सकता है, लेकिन input tokens, latency और लागत काफी बढ़ा सकता है। छोटी tasks के लिए default setting सामान्यतः बेहतर है।

संबंधित दस्तावेज़

References