Anthropic представила Claude Fable 5.1

Компания снизила цену чтения кэша на 75% для длительных ИИ-задач

4 мин.
Anthropic представила Claude Fable 5.1

Компания Anthropic представила языковую модель Claude Fable 5.1, предназначенную для сложных и продолжительных задач в программировании, научных исследованиях и корпоративных процессах. Новинка стала доступна через API, облачные платформы и десктопное приложение. Одновременно компания выпустила Claude Mythos 5.1 — вариант той же модели с менее строгими ограничениями, доступ к которому получат только участники программы доверенного доступа Anthropic из сфер кибербезопасности и наук о жизни.

Claude Fable 5.1 рассчитана на работу, которая не сводится к одному запросу или отдельному фрагменту кода. По данным Anthropic, модель должна эффективнее вести крупные программные проекты, проверять код на уровне всего приложения, искать причины ошибок во внешних библиотеках и выполнять многоэтапные исследовательские задачи. Среди заявленных возможностей — планирование экспериментов, моделирование результатов, а также интерпретация сложных таблиц и схем.

Основной акцент разработчики сделали на снижении числа токенов, необходимых для выполнения длительной работы. Это особенно важно для ИИ-агентов, которые в процессе решения задачи многократно обращаются к инструментам, возвращаются к предыдущим выводам и повторно передают модели большой объём контекста.

Заявленные результаты тестов

Anthropic сообщает, что Claude Fable 5.1 набрала 55,8% в тесте Terminal-Bench 4.0, оценивающем способности моделей к программированию через командную строку. Для Claude Fable 5 компания приводит результат 42%. Версия Claude Mythos 5.1, работающая при более мягких настройках безопасности, получила 60,9%.

В тесте Terminal-Bench-Science 0.1, посвящённом автономной научной работе, показатель Claude Fable 5.1 составил 52,6% против 24,7% у предыдущей версии. Также разработчик заявил об улучшениях в автоматизации бизнес-процессов, работе со знаниями и выполнении задач в браузере.

Эти результаты опубликованы самой Anthropic и не являются независимым доказательством превосходства модели над всеми конкурентами. Однако они соответствуют позиции компании: Claude Fable 5.1 должна лучше удерживать контекст сложной задачи, пользоваться внешними инструментами и корректировать уже пройденные этапы работы.

Первые пользователи привели примеры длительных сценариев. Компания Millennium рассказала, что модель нашла причину редкого сбоя в библиотеке стороннего поставщика, который оставался непонятным в течение четырёх-пяти лет. В Ramp рассказали о 38-часовой работе модели над задачей машинного обучения: за это время она пересмотрела ранний вывод, провела шесть экспериментов и подготовила рекомендации.

Стоимость кэша сократили на 75%

Базовые тарифы API для Claude Fable 5.1 не изменились: миллион входных токенов стоит $10, а миллион выходных — $50. Вместо пересмотра этой цены Anthropic снизила на 75% стоимость чтения кэшированного входного контекста. Теперь она составляет $0,25 за миллион токенов вместо $1 у Claude Fable 5.

Запись в кэш сохранила прежнюю стоимость: $12,50 за миллион токенов при хранении в течение пяти минут и $20 — при хранении в течение часа. Кэширование имеет особое значение для агентных систем: им приходится снова и снова отправлять модели репозитории кода, системные инструкции, техническую документацию, описания инструментов и историю предыдущих действий.

По оценке Anthropic, кэшированные материалы в некоторых длительных задачах могут составлять не менее половины всех используемых токенов. Компания ожидает, что обновлённая цена уменьшит фактические расходы на Claude Fable 5.1 примерно на 25% в типовых сценариях и до 45% — в приложениях с интенсивным использованием ИИ-агентов.

При этом модель остаётся дорогим решением по сравнению с линейками Anthropic Opus и Sonnet, а также рядом конкурирующих систем. Компания рассчитывает, что корпоративные клиенты будут оценивать не только цену отдельного токена, но и совокупную стоимость завершения сложной задачи.

Контроль данных и защита

Осенью Anthropic намерена запустить сервис Enterprise Frontier Safeguards. Он должен позволить заказчикам хранить данные мониторинга в собственной инфраструктуре, продолжая использовать механизмы Anthropic для выявления потенциально опасного применения моделей.

Это меняет прежний подход компании, которая связывала хранение данных с необходимостью контролировать риски при работе продвинутых моделей, в том числе в кибербезопасности. Новый механизм, как утверждается, даст организациям больше контроля над журналами и данными без отключения защитных систем Anthropic.

Разработчик также сообщил об улучшении классификаторов, определяющих, следует ли блокировать запрос. Ожидается, что система будет реже ошибочно отклонять легитимные задачи, связанные с кибербезопасностью и биологическими исследованиями.

Вопрос ограничений стал особенно актуальным после того, как Anthropic и Британский институт безопасности ИИ сообщили: ранние модели Claude в тестах с необычно мягкими условиями кибербезопасности предпринимали несанкционированные действия в отношении реальных систем. После этого компания временно остановила внешние кибериспытания, усилила изоляцию и мониторинг, а затем возобновила проверки.

Невидимые водяные знаки

Claude Fable 5.1 и Claude Mythos 5.1 стали первыми новыми моделями Anthropic, которые добавляют невидимые водяные знаки в текстовые ответы и файлы. Компания ранее заявляла, что будет внедрять эту технологию в модели, выпущенные после 2 августа 2026 года, в соответствии с требованиями европейского закона об искусственном интеллекте EU AI Act.

Маркировка формируется за счёт выбора слов в тех случаях, когда модель может использовать несколько равнозначных вариантов. По утверждению Anthropic, такой знак должен сохраняться после копирования, вставки и лёгкого редактирования, оставаясь незаметным для читателя.

Компания подчёркивает, что водяной знак не меняет смысл и качество ответа и не содержит сведений о пользователе, организации или содержании диалога. API для проверки маркировки доступен регуляторам, правоохранительным органам, СМИ, фактчекерам, независимым исследователям и другим организациям, соответствующим установленным критериям. Положительный результат позволяет установить, что материал был создан или обработан Claude, однако отсутствие знака не доказывает человеческое авторство текста.