Codex умеет работать с контекстным окном на миллион токенов, но по умолчанию использует меньше. Команда Codex настроила лимит как компромисс между скоростью и стоимостью — не каждый запуск требует миллиона. Теперь они документировали ручной способ включить полный контекст.
Это не скрытая функция и не флаг бета-тестирования. Три строки в конфигурационном файле — и Codex начинает использовать всё окно модели GPT-5.6 Sol.
Три строки и перезапуск
Откройте ~/.codex/config.toml и добавьте в начало файла, до любых заголовков секций:
model = "gpt-5.6-sol"
model_context_window = 1000000
model_auto_compact_token_limit = 900000
Первая строка выбирает модель. Вторая задаёт бюджет контекста в миллион токенов. Третья запускает автоматическое сжатие истории примерно на отметке 900 тысяч — оставляет запас до предела, чтобы не упереться в потолок посреди задачи.
После сохранения перезапустите Codex и начните новую сессию. Для разового запуска без изменения настроек подойдёт команда:
codex -m gpt-5.6-sol \
-c model_context_window=1000000 \
-c model_auto_compact_token_limit=900000
Совет: ключ model_auto_compact_token_limit принимает порог в токенах. Если поставить его слишком близко к лимиту, сжатие не успеет сработать и сессия упрётся в потолок. 900 тысяч при окне в миллион — безопасный зазор.
Когда это реально нужно
Большое окно позволяет дольше удерживать код, результаты инструментов и историю разговора до того, как старые сообщения начнут сжиматься. На больших репозиториях это разница между агентом, который помнит весь проект, и агентом, который забыл начало задачи.
Цена — более высокая задержка и расход ресурсов. Каждый дополнительный токен в окне замедляет обработку. Поэтому включать миллион токенов имеет смысл для действительно крупных репозиториев и долгих агентных задач, а не для повседневной работы.
- Большой репозиторий, где агент теряет контекст при стандартном окне.
- Длинная агентная сессия с множеством вызовов инструментов и результатов.
- Разовый анализ кодовой базы, где важно удержать структуру целиком.
Для коротких задач и небольших проектов стандартный лимит работает быстрее и дешевле. Миллион токенов — это инструмент для конкретного сценария, не настройка по умолчанию.
Миллион токенов не делает агента умнее. Он позволяет ему дольше помнить. Включайте, когда объём проекта оправдывает задержку — не потому, что миллион звучит лучше, чем меньше.
Ссылки
Ссылки
- Документация: Codex CLI
- Документация: Configuration Reference