Skip to main content

Kurzantwort

Trage model, model_context_window und model_auto_compact_token_limit am Anfang der config.toml ein. Beende Codex anschließend vollständig, starte es neu und öffne eine neue Unterhaltung. GPT-5.6 Sol unterstützt laut offizieller API-Spezifikation 1.050.000 Token. Die folgende Konfiguration fordert ein Budget von 1.000.000 Token an und beginnt die automatische Kompaktierung bei ungefähr 900.000 Token.
Die Einstellung erweitert kein Modell ohne Long-Context-Unterstützung. Der effektiv verfügbare Kontext hängt von Codex-Version, provider, Serverlimits, reserviertem Platz für Ausgabe und Tools sowie der Kompaktierungsstrategie ab. Exakt 1.000.000 nutzbare Token sind nicht garantiert.

Dauerhafte Konfiguration

Setze diese Zeilen vor jeden [section]-Header:
Speichere die Datei, starte Codex vollständig neu und beginne eine neue Unterhaltung. Der Schwellenwert 900000 lässt Platz für Ausgabe, Tools und weitere Nachrichten.

Nur für eine CLI-Sitzung

Die temporären Werte verfallen mit dem Ende der Sitzung.

Prüfen und Fehler beheben

  1. Starte Codex neu und öffne eine neue Unterhaltung.
  2. Prüfe, ob gpt-5.6-sol aktiv ist.
  3. Falls das Modell fehlt, prüfe Model ID und provider im model plaza.
  4. Werden Werte ignoriert, müssen sie in der richtigen Benutzerdatei auf oberster Ebene und ohne Duplikate stehen.

Effektiver Kontext, Verbrauch und Kosten

Codex reserviert Kontext für Ausgabe, Tool-Aufrufe und Systemanweisungen. Client- oder Serverlimits können eine frühere Kompaktierung auslösen. Mehr Kontext hält mehr Code und Verlauf bereit, kann aber Eingabe-Token, Latenz und Kosten deutlich erhöhen. Für kurze Aufgaben ist der Standard meist sinnvoller.

Verwandte Dokumente

References