13 августа DeepSeek выпустила финальную версию V4 Pro — DeepSeek-V4-Pro-0813. Модель доступна через API, веб-интерфейс и мобильное приложение, а главный акцент обновления — работа с инструментами и AI-агентами.

DeepSeek заработала репутацию на дешёвых сильных моделях. V4 Pro продолжает этот маршрут, но с заметным сдвигом: модель рассчитана не просто на генерацию текста, а на длительные агентные сценарии — вызов инструментов, многошаговые задачи, код.

Параллельно компания объявила изменение тарификации API. С 16 августа вводятся пиковые и внепиковые тарифы. Стоимость растёт, и для некоторых сценариев — заметно.

Что изменилось в модели

V4 Pro поддерживает контекст до 1 миллиона токенов и выдачу до 384 тысяч токенов. Режим размышления (thinking mode) включён по умолчанию — модель заранее прогоняет цепочку рассуждений перед ответом, что полезно для задач, где важна точность, а не скорость.

Для агентных сценариев важны три вещи. Tool Calls — модель может вызывать внешние функции и API. Responses API — интерфейс для многошаговых задач с сохранением состояния. Anthropic API — совместимость с экосистемой Anthropic, что упрощает миграцию для команд, уже использующих Claude.

DeepSeek явно позиционирует модель для агентных инструментов. В документации указана прямая интеграция с Claude Code, GitHub Copilot и OpenCode — подключение происходит заменой base_url, без изменения кода.

Тарифы: peak и off-peak

Сейчас V4 Pro стоит $0,435 за 1 млн входных токенов без кэша и $0,87 за выходные. С 16 августа 16:00 UTC модель переходит на двухуровневую систему. Пиковые часы — 01:00–04:00 и 06:00–10:00 UTC, всё остальное — внепиковое время. Внепиковая цена равна половине пиковой.

В пиковые часы V4 Pro будет стоить $1,32 за вход без кэша и $3,96 за выход — рост в три раза по сравнению с текущей ценой. V4 Flash дорожает мягче: с $0,14 до $0,44 за вход без кэша и с $0,28 до $1,32 за выход. Кэш-хит (повторное использование кэшированного контекста) остаётся дешёвым: $0,044 для Pro и $0,014 для Flash в пик.

Важно: рост цены в три раза касается только пиковых часов. Внепиковая цена — половина пиковой, поэтому смещение нагрузки на тихие часы компенсирует большую часть удорожания.

Что это значит для работы

DeepSeek движется от дешёвой LLM к платформе для агентных задач. Tool Calls, Responses API и интеграции с инструментами вроде Claude Code говорят о том, что модель готовят для сценариев, где агент работает долго, вызывает внешние функции и удерживает большой контекст.

Для фоновых задач и массовой обработки рост цены ощутим. Если ваши агентные сценарии работают круглосуточно, стоит проверить, какая доля вызовов попадает в пиковые часы. Сдвиг на внепиковое время — простой способ сохранить расходы под контролем.

Для команд, уже работающих с Claude через Anthropic API, DeepSeek предлагает альтернативный бэкенд с той же структурой запросов. Миграция сводится к замене base_url и API-ключа. Но независимых тестов на агентных сценариях пока нет — прежде чем переносить критический процесс, имеет смысл прогнать несколько реальных задач и сравнить результат.

Стоит ли переходить

V4 Pro выглядит как сильный шаг в агентную сторону. 1 млн контекста, tool calls, совместимость с Anthropic API, интеграции с популярными агентными инструментами — на бумаге всё красиво. Но реальную ценность покажет не бенчмарк, а рабочий сценарий: запустите пять типичных задач и посмотрите, справляется ли модель с инструментами так же стабильно, как Claude или GPT.

С тарифами проще: посчитайте, сколько ваших вызовов попадает в окно 01:00–04:00 и 06:00–10:00 UTC. Если больше половины — сдвигайте расписание или закладывайте бюджет с запасом.

Ссылки

Ссылки