快速答案
在config.toml 顶部设置 model、model_context_window 和 model_auto_compact_token_limit,然后完全重启 Codex 并新建对话。GPT-5.6 Sol 的官方 API 规格支持 1,050,000 token 上下文;下面的配置让 Codex 以 1,000,000 token 作为上下文预算,并在约 900,000 token 时开始自动压缩。
永久设置
打开 Codex 用户配置文件:
将以下三行放在文件顶部,必须位于所有
[section] 标题之前:
model_auto_compact_token_limit = 900000 会在达到完整上下文窗口前压缩较早的历史记录,为模型输出、工具结果和后续消息留出空间。仅为一次 CLI 会话启用
不想修改默认设置时,可以通过-c 只覆盖当前 Codex CLI 会话。
- macOS / Linux
- Windows PowerShell
如何确认配置已生效
- 完全重启 Codex,而不是只关闭当前对话。
- 创建新对话,并确认当前模型为
gpt-5.6-sol。 - 如果模型不可用,请到 模型广场确认当前 Model ID 和 provider 支持情况。
- 如果设置未生效,请确认字段位于顶层、文件路径正确,并且没有重复的同名字段。
为什么实际可用上下文可能低于 100 万?
model_context_window 告诉 Codex 当前模型可使用的上下文预算,但最终可用长度还要扣除输出、工具调用和系统指令等预留空间。Codex 也可能根据客户端或服务端配置提前压缩历史记录。因此,100 万是配置预算,不是每次请求都能填满的保证值。

