Codex умеет работать с контекстным окном на миллион токенов, но по умолчанию использует меньше. Команда Codex настроила лимит как компромисс между скоростью и стоимостью — не каждый запуск требует миллиона. Теперь они документировали ручной способ включить полный контекст.

Это не скрытая функция и не флаг бета-тестирования. Три строки в конфигурационном файле — и Codex начинает использовать всё окно модели GPT-5.6 Sol.

Три строки и перезапуск

Откройте ~/.codex/config.toml и добавьте в начало файла, до любых заголовков секций:

model = "gpt-5.6-sol"
model_context_window = 1000000
model_auto_compact_token_limit = 900000

Первая строка выбирает модель. Вторая задаёт бюджет контекста в миллион токенов. Третья запускает автоматическое сжатие истории примерно на отметке 900 тысяч — оставляет запас до предела, чтобы не упереться в потолок посреди задачи.

После сохранения перезапустите Codex и начните новую сессию. Для разового запуска без изменения настроек подойдёт команда:

codex -m gpt-5.6-sol \
-c model_context_window=1000000 \
-c model_auto_compact_token_limit=900000

Совет: ключ model_auto_compact_token_limit принимает порог в токенах. Если поставить его слишком близко к лимиту, сжатие не успеет сработать и сессия упрётся в потолок. 900 тысяч при окне в миллион — безопасный зазор.

Когда это реально нужно

Большое окно позволяет дольше удерживать код, результаты инструментов и историю разговора до того, как старые сообщения начнут сжиматься. На больших репозиториях это разница между агентом, который помнит весь проект, и агентом, который забыл начало задачи.

Цена — более высокая задержка и расход ресурсов. Каждый дополнительный токен в окне замедляет обработку. Поэтому включать миллион токенов имеет смысл для действительно крупных репозиториев и долгих агентных задач, а не для повседневной работы.

  • Большой репозиторий, где агент теряет контекст при стандартном окне.
  • Длинная агентная сессия с множеством вызовов инструментов и результатов.
  • Разовый анализ кодовой базы, где важно удержать структуру целиком.

Для коротких задач и небольших проектов стандартный лимит работает быстрее и дешевле. Миллион токенов — это инструмент для конкретного сценария, не настройка по умолчанию.

Миллион токенов не делает агента умнее. Он позволяет ему дольше помнить. Включайте, когда объём проекта оправдывает задержку — не потому, что миллион звучит лучше, чем меньше.

Ссылки

Ссылки