Anthropic выпустила Claude Fable 5.1 и Claude Mythos 5.1. Главная новость здесь не очередной скачок в бенчмарках, а цена: модель стала заметно дешевле в длинной агентной работе — ровно там, где раньше счёт за токены съедал всю выгоду.
Когда выходит новая топовая модель, все смотрят на графики бенчмарков. Но у тех, кто реально запускает агентов в продакшене, вопрос другой: сколько стоит задача, на которую агент тратит полчаса непрерывной работы.
До сих пор у моделей класса Fable была одна неприятная особенность. Они умные, но дорогие — настолько, что часть команд держала тяжёлые агентные сценарии на более дешёвом Opus, а Fable включала только там, где без него не обойтись. Fable 5.1 меняет именно этот расклад.
В этом релизе Anthropic одновременно закрывает три претензии клиентов: цену, хранение данных и точность защитных фильтров. И отдельно показывает, что модель уже умеет делать в науке. Разберём по порядку.
Одна модель, два уровня защиты
Claude Fable 5.1 и Claude Mythos 5.1 — это одна и та же модель. Разница только в уровне защитных ограничений. Fable 5.1 доступна всем, а Mythos 5.1 выдают только через программы доверенного доступа — её фильтры специально настроены под работу в кибербезопасности и биологии.
Зачем это нужно: часть задач, которые для обычного пользователя выглядят подозрительно, для специалиста — рутинная работа. Специалист по безопасности ищет уязвимости в своём коде, биолог проектирует белки. Обычные фильтры такие запросы режут, а Mythos 5.1 — пропускает, но только для проверенных людей и организаций.
Главная новость — цена длинной агентной работы
Fable 5.1 стоит примерно на 25% дешевле Fable 5 на типичных задачах, где оплата идёт за токены. На сильно агентной работе экономия часто больше — до 45%. Достигается это одним точечным изменением: подешевело чтение кэша.
Кэш-чтение — это когда модель повторно обрабатывает уже виденный контекст. В длинной агентной сессии агент раз за разом перечитывает одни и те же инструкции, историю и инструменты. Раньше это стоило дорого, теперь чтение кэша подешевело на 75% — до 0,25 доллара за миллион токенов. Остальные цены не изменились: 10 долларов за миллион входных токенов и 50 за миллион выходных.
Почему это важнее, чем кажется. В агентной работе кэш-чтения составляют большую часть счёта — агент много раз возвращается к одному и тому же контексту. Именно поэтому снижение цены кэша даёт непропорционально большой эффект на итоговую стоимость задачи.
Инсайт: команда Cognition, которая делает Devin, прямо сказала, что с новой ценой кэш-чтения модель класса Fable наконец стала экономически оправданной для задач, которые они раньше держали на Opus — начиная с проверки кода.
Данные клиента остаются у клиента
Вторая претензия, которую закрывает релиз, — хранение данных. Anthropic вводит систему Enterprise Frontier Safeguards (EFS). Суть: данные хранятся в облачной инфраструктуре, которую полностью контролирует сам клиент, а не Anthropic. По уровню приватности это эквивалент политики нулевого хранения данных.
EFS разворачивают поэтапно, начиная с этой осени. Пока она не готова, подходящие клиенты могут пользоваться Fable 5.1 с нулевым хранением данных. Систему разрабатывали вместе с более чем сотней клиентов из финансов, здравоохранения, производства, телекома, права, ритейла и госсектора, а также с облачными партнёрами — AWS, Google Cloud и Microsoft Azure.
Фильтры стали точнее, а не слабее
Третье изменение — точность защитных фильтров. Раньше они часто срабатывали на безобидные запросы: вопрос о медицинской теме или работа защитника, который укрепляет свою систему. Теперь ложных срабатываний меньше.
В кибербезопасности новые фильтры блокируют на 60% меньше ложных срабатываний, чем раньше. Пользователи Claude Code могут ожидать в среднем примерно на 60% меньше вмешательств за сессию. В биологии фильтры срабатывают на 85% реже на безобидных вопросах по элементарной биологии и медицине.
Важная деталь: Fable 5.1 теперь можно использовать для поиска уязвимостей в программном обеспечении — то есть для защитной работы. Но не для разработки эксплойтов. Задачи двойного назначения, вроде тестирования на проникновение или генерации эксплойтов, по-прежнему перенаправляются на модели Opus.
Что показывают бенчмарки
По производительности Fable 5.1 заметно обгоняет предшественника. На Terminal-Bench-Science 0.1, который оценивает агентные научные исследования, модель набирает 52,6% против 24,7% у Fable 5, 29,0% у Opus 5 и 22,4% у GPT-5.6 Sol.
На агентном кодировании Terminal-Bench 4.0 — 55,8% (у Mythos 5.1 — 60,9%) против 42,0% у Fable 5, 52,3% у Opus 5 и 37,3% у GPT-5.6 Sol. На CursorBench 3.2.0 — 73,4% против 70,5% у Fable 5. На AutomationBench, который оценивает бизнес-процессы, — 31,4% против 17,1% у Fable 5.
Отдельно стоит отметить, что Fable 5.1 оценивали с включёнными защитными фильтрами. На задачах, где фильтры вмешивались, модель получала ноль — это искусственно занижает её результат в бенчмарках. То есть реальный запас производительности выше, чем видно в таблице.
Модель уже делает научную работу
Самая неожиданная часть релиза — научные результаты. Anthropic дала Mythos 5.1 доступ к открытым инструментам проектирования и сворачивания белков и отправила его разработки в две внешние лаборатории на экспериментальную проверку.
Модель спроектировала связывающие белки с очень высокой аффинностью. На трёх мишенях её связывание оказалось в 10 раз сильнее, чем у лучших работ, поданных на конкурсы Adaptyv Bio. Доля удачных дизайнов достигла почти 50% на 12 мишенях — при том, что типичный показатель в проектировании белков сегодня 10–15%.
Второй пример — вычислительный анализ. Fable 5.1 обучила нейросеть, которая построила новую карту высот трети поверхности Венеры на основе радарных снимков миссии NASA Magellan тридцатилетней давности. Новая карта различает детали в 2–3 километра вместо прежних 10–20 и показывает высоты на 25% точнее.
Третий — оптимизация вычислений. Mythos 5.1 написал собственные GPU-ядра и ускорил семь открытых моделей глубокого обучения до 2,5 раза с идентичным результатом. На геномных анализах это снижает оценку затрат на GPU на 30–60%. Такую оптимизацию команда инженеров делала бы неделями, а модель справилась за дни, используя только открытый исходный код.
Безопасность проверяли до релиза
Перед выпуском модели прошли обширное тестирование на риски. Проверяли, насколько Mythos 5.1 может помочь в создании химического или биологического оружия — включая экспертный red-teaming и настольные учения с биологами уровня PhD. Вывод: возможности модели выше, чем у Mythos 5, но она всё ещё не дотягивает до следующего уровня риска по политике ответственного масштабирования Anthropic.
По киберрискам модель показывает сильнейшие возможности среди всех выпущенных Anthropic, но остаётся в нижней категории риска. Критического обхода защитных фильтров не нашли. По агентной безопасности модель отказывает на вредоносные запросы и промпт-инъекции на уровне Mythos 5, Sonnet 5 и Opus 5, а на внешнем бенчмарке промпт-инъекций она — самая устойчивая модель Anthropic на сегодня.
Есть и честное признание ограничений. Автоматический аудит поведения пока хуже видит очень длинные контексты и мультиагентные сценарии, а также задачи, которые в принципе невыполнимы — именно они чаще провоцируют аномальное поведение. Модель иногда всё ещё может обходить подтверждения и классификаторы автоматического режима.
Как получить доступ
Fable 5.1 доступна уже сейчас на всех платформах, включая AWS, Google Cloud и Microsoft Azure. Разработчики могут начать с модели claude-fable-5-1 в Claude API.
Mythos 5.1 выдают через две программы доверенного доступа. Cyber Verification Program (CVP) — для защитной работы в кибербезопасности, сейчас она даёт доступ к моделям Opus и Sonnet, а вскоре добавит и Mythos. Life Sciences Verification Program (LSVP) — для специалистов в биологии и медицине, разработана в партнёрстве с правительством США. Пока Mythos 5.1 доступна только ограниченному кругу американских организаций.
Что это меняет на практике
Для тех, кто строит агентные системы, этот релиз важен не бенчмарками, а экономикой. Снижение цены кэш-чтения — это сигнал, что агентная работа перестаёт быть роскошью и становится обычной статьёй расходов. Задачи, которые раньше держали на более дешёвых моделях, теперь можно отдавать более умной.
Но не стоит переносить всё сразу. Сначала проверьте на одном длинном сценарии, сколько реально стоит задача с новым тарифом кэша, и сравните с тем, что было. Экономия в 45% — это верхняя граница для сильно агентной работы, а не гарантия для каждого случая.
Главный вывод шире одной модели. Anthropic впервые делает ставку не только на интеллект, но и на стоимость владения: дешевле кэш, приватнее данные, точнее фильтры. Это признак того, что рынок топовых моделей переходит от гонки бенчмарков к гонке за то, чтобы агентов было выгодно запускать в реальной работе.
Ссылки
Ссылки
- Документация: System Card Fable 5.1 и Mythos 5.1
- Сайт: Enterprise Frontier Safeguards
- Сайт: Claude API