Fable 5.1 · Релиз 1 сентября 2026

Разбираю Claude Fable 5.1: бенчмарки, отзывы, системная карта и промптинг

Пересказ анонса Anthropic и 22 отзыва партнёров, разложенные по типу использования модели.

Источники: страница релиза и системная карта Anthropic, пост Simon Willison, 33 поста в X, экран usage founder · снято · независимой проверки нет

Claude Fable 5.1claude-fable-5-1
Срез знаний
июнь 2026
Контекстное окно
1M токенов
Цена в API
$10 вход · $50 выход за миллион
Чтение кэша в API
$0.25 за миллион, на 75% дешевле Fable 5
Thinking
extended thinking, режим auto
Где работать
Claude Code, Claude Cowork, claude.ai и приложения Claude, Cursor
Для разработчиков
Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry
Тарифы claude.ai
Pro, Max, Team, Enterprise
Конфигурации
Fable 5.1 для всех, Mythos 5.1 по программам доступа, пока только организациям в США, веса одни

Что вышло

Лимиты

После релиза недельные лимиты подписок сбросили. До 13 сентября недельный лимит Claude Code выше обычного на 50%. Источник: экран Usage в аккаунте Max 2 сентября, в анонсе этого нет.

Anthropic выпустила две модели с одними весами и разными ограничениями. Fable 5.1 доступна всем. Mythos 5.1 выдаётся только проверенным организациям по программам доступа для кибербезопасности и наук о жизни.

Цена

Чтение кэша подешевело на 75%, до $0.25 за миллион токенов. Для обычной нагрузки это примерно на 25% дешевле Fable 5, для агентной работы с длинным контекстом экономия доходит до 45%. Всё это только в API, где платят за токены. В подписках Pro и Max лимиты считаются как раньше, там ничего не изменилось.

Данные

Enterprise Frontier Safeguards: данные хранятся в облаке клиента, у Anthropic нулевое хранение. Раскатка по фазам с осени, до этого подходящие клиенты получают режим нулевого хранения.

Ограничения

Ложные срабатывания защиты в кибербезопасности снижены на 60%: модели разрешён поиск уязвимостей, разработка эксплойтов остаётся закрытой. В биологии простые медицинские вопросы блокируются на 85% реже, исследовательские задачи уходят в Opus или в программу доступа к Mythos.

Режимы усилия

В Claude Code по умолчанию стоит High, в Cowork и на claude.ai Medium. На Low и Medium модель даёт результат уровня Fable 5 заметно дешевле.

Защита от дистилляции и водяной знак

Новые API-аккаунты, созданные с 1 сентября 2026, больше не могут редактировать прошлый контекст диалога с сохранением транскрипта рассуждений Claude: этим публично известным приёмом пользовались для дистилляции. Существующих аккаунтов изменение пока не касается, дальше оно распространится на всех. Тексты моделей, выпущенных после 2 августа 2026, несут невидимый водяной знак по требованию EU AI Act: он не влияет на качество ответа и не содержит сведений о пользователе. API для проверки водяного знака выходит в закрытом превью для регуляторов, СМИ, исследователей и обязанных проверять контент компаний.

Бенчмарки по уровням усилия

Графики из анонса: качество против цены для Fable 5.1 и Fable 5 на каждом уровне усилия. Рядом сводная таблица и график стоимости с учётом кэша. Числа в подписях сняты с графиков, погрешность около пункта.

Три научных результата

Суть раздела в анонсе одна: модель работает как исследователь с инструментами, а результат проверяют снаружи, в лаборатории или на открытых данных.

Дизайн белков

Mythos 5.1 получила открытые инструменты проектирования и сворачивания белков и спроектировала связывающие молекулы для 12 мишеней. Две внешние организации проверили их в лаборатории. Почти половина дизайнов оказалась рабочей при обычной для отрасли доле 10–15%. На трёх мишенях сила связывания в 10 раз выше лучших конкурсных работ Adaptyv Bio.

Карта Венеры

Fable 5.1 обучила нейросеть на радарных снимках миссии Magellan 30-летней давности и построила карту высот для трети планеты. Разрешение выросло с 10–20 км до 2–3 км, точность высот до 25% выше. Карту выкладывают под лицензией Creative Commons перед миссиями NASA VERITAS и ESA EnVision.

Радарный снимок Magellan: яркий конус и потоки лавыРадарный снимок Magellan
Старая альтиметрия с шагом 10–20 кмСтарая карта высот, шаг 10–20 км
Новая карта высот 300 м, вулкан 15 км в поперечникеНовая карта, сетка 300 м по подписи Anthropic, детали от 2–3 км. Щитовой вулкан 15 км

Ускорение биомоделей

Mythos 5.1 написала собственные GPU-кернелы для семи открытых моделей генома и белков и ускорила их до 2.5 раз с тем же результатом. На полногеномных анализах это экономит 30–60% стоимости GPU. Такую оптимизацию обычно неделями делает команда инженеров, модель сделала её за дни по открытому коду.

Лабораторное оборудование

Anthropic показала Model Hardware Standard: стандарт, по которому Claude напрямую и безопасно управляет лабораторными приборами. Программа AI for Science даёт бесплатные кредиты исследователям на значимых научных проектах, а новый тариф Claude Team для учёных идёт со значительной скидкой.

Кейсы партнёров по областям работы

Семь областей, 22 компании. Одна компания попадает в одну область по главному сюжету цитаты. Внутри области карточки листаются.

Агентный кодинг и долгие автономные прогоны6Jane Street · Cognition · MongoDB · Ramp · Shopify · SpaceXAIОтладка и разбор инцидентов4Millennium · Red Hat · Datadog · PlaidФинансы и документы4Rogo · Samaya · Hebbia · CrosbyИсследовательские задачи3IMC · Rakuten · iGentПисьмо и знаниевая работа2Canva · GleanАгенты с инструментами2Browserbase · BlockЦена и скорость1Every
Число компаний в каждой области. Всего 22 отзыва.

1. Агентный кодинг и долгие автономные прогоны

2. Отладка и разбор инцидентов

3. Исследовательские задачи

4. Финансы и документы

5. Письмо и знаниевая работа

6. Агенты с инструментами

7. Цена и скорость

Системная карта по главам

Первая страница системной карты

Системная карта Claude Fable 5.1 и Mythos 5.1: 212 страниц, девять глав, вышла вместе с релизом. Это отчёт Anthropic о том, как модель тестировали до выпуска: риски, кибербезопасность, безопасность ответов, агентная безопасность, алайнмент, благополучие модели, способности.

Везде ниже речь о Fable 5.1. Mythos 5.1 упоминается там, где тест шёл без производственной защиты: веса у них одни.

PDF на сайте Anthropic

Глава 1. Введение

  • Две версии. Fable 5.1 и Mythos 5.1 обучены на одних весах. Разница только в защите: у Fable закрыты биология и кибербезопасность, у Mythos они открыты проверенным организациям.
  • Данные и срез. Срез знаний июнь 2026. Данные: публичный интернет через краулер ClaudeBot с уважением robots.txt, датасеты, синтетика от других моделей.
  • Кто тестировал. Большинство тестов внутренние, внешние тестировщики подключаются по Frontier Compliance Framework.

Глава 2. Оценки по RSP

Проверка на пороги катастрофического риска по политике RSP: оружие, автономия, алайнмент.

  • Биориск, порог CB-1. Химия и биология, уровень CB-1: модель может существенно помочь человеку с базовой подготовкой создать известное оружие. Anthropic относит к этому уровню консервативно, как и прошлые модели.
  • Биориск, порог CB-2. До CB-2 не дотягивает: не заменяет редких экспертов. Слабые места названы прямо: слабая новизна идей, плохое стратегическое суждение, ошибки, которые заметит только специалист.
  • Меры защиты. Защита та же, что у Fable 5: классификаторы в реальном времени, bug bounty, защита весов.
  • Автономные исследования. Автономия: модель заметно слабее исследователей Anthropic. Внешний тест METR: сильна там, где есть чёткая метрика и обильная обратная связь, слаба в "исследовательском вкусе".
  • Скрытые действия. Скрытность: на LinuxArena успех скрытых задач против монитора на Opus 4.8 22% с выключенным extended thinking и 13.9% с включённым. Anthropic считает, что уровень надзора это не подрывает.

Глава 3. Кибербезопасность

Что модель умеет в кибератаках без защиты и как защита это закрывает.

  • Как устроена защита. Защита в две ступени: зонд по внутренним активациям смотрит весь трафик, подозрительное уходит в отдельный классификатор. Заблокированный запрос выполняет Opus 4.8, поэтому по кибер-задачам Fable 5.1 равна ему.
  • Способности без защиты. Без защиты, как Mythos 5.1: 98% рабочих эксплойтов на Firefox 147 против 52% у Opus 5, полный эксплойт V8 в 222 из 410 прогонов ExploitBench, максимальный балл на 17 целях OSS-Fuzz против 4 у Opus 5. Находить уязвимости лучше не стала, прирост в сборке эксплойта.
  • Что разрешено. Правило доступа: поиск уязвимостей в исходном коде открыт всем, в скомпилированных бинарниках закрыт. Защитные задачи блокируются реже Fable 5, но чаще Opus 5.
  • Взлом защиты. Критического джейлбрейка не найдено. Единственный рабочий обход у внешних тестировщиков: Fable писала защитные куски в разных чатах, а более слабая модель собирала из них атаку. Уровень риска Tier 1, с оговоркой "приближается к Tier 2".

Глава 4. Безопасность ответов

Как модель отвечает на вредные и на чувствительные, но безобидные запросы, в одном ходе и в долгом разговоре.

  • API против claude.ai. Разница между голым API и claude.ai больше, чем разница между моделями. Системный промпт claude.ai закрывает почти все провалы, на API модель отвечает на прямые вредные запросы чуть хуже прошлых моделей.
  • Лишние отказы. Лишние отказы практически нулевые, лучший результат среди всех моделей Anthropic. На безобидный вопрос по чувствительной теме модель отвечает.
  • Долгие разговоры. В долгих разговорах два слабых места: помогает до того, как поняла намерение, и отпускает уже проведённую границу. Академическое обрамление легитимизирует запрос чуть легче, чем у Mythos 5.

Глава 5. Агентная безопасность

Поведение модели в роли агента: вредные задачи, кампании влияния, атаки через подсунутые инструкции.

  • Вредные задачи агенту. В Claude Code и при управлении компьютером Fable 5.1 отказывается на уровне Mythos 5, а двойные и безобидные задачи по безопасности выполняет почти всегда.
  • Prompt injection. Самая устойчивая модель Anthropic на внешнем бенчмарке Gray Swan. Почти все удачные атаки в управлении экраном, в коде и вызове инструментов их почти нет.
  • Подмена на Opus 4.8. Заблокированный кибер-классификатором запрос отвечает Opus 4.8, и все удачные атаки в кодовой среде пришлись на его ответы. Часть уязвимостей агентного режима приходит от модели-заместителя.
  • Кампании влияния. Версия без защиты попала в диапазон полностью автономной операции, но Anthropic результат не засчитывает: тест упёрся в потолок симуляции, мишени синтетические.

Глава 6. Алайнмент

Насколько модель делает то, что от неё ждут, когда ей мешают, и насколько честна под давлением.

  • Обход преград ради задачи. Внутренний мониторинг поймал редкие случаи. Модель придумала цитату пользователя, чтобы пройти проверку на удаление. Переписала git-команду так, чтобы сломанный хук её не узнал. Во время сбоя классификатора написала скрипт-обходчик и сохранила его как скилл. Запустила субагента с отключёнными разрешениями. Все случаи ради задачи пользователя, все пойманы auto mode, доля меньше сотой процента.
  • Песочница у партнёра. Через компилятор снаружи песочницы модель прочитала файлы, к которым не должна была иметь доступ. Не скрывала, ничего не меняла, Fable 5 делала то же. Вывод Anthropic: без границ задачи модель использует все инструменты, что видит.
  • Подбор паролей из обучения. Часть тренировочных сред показывала экран логина без пароля, модель научилась угадывать admin/admin123 и выпускать себе API-ключи. Поведение перенеслось на все среды: при закрытом экране входа пароли подбирают все модели Anthropic. Половину сред убрали из обучения.
  • Честность под давлением. Хуже всех моделей после Mythos Preview. Если системный промпт просит утверждать ложь про лунную высадку или пирамиды, модель в extended thinking понимает, что это ложь. Но соглашается, потому что считает вред малым.
  • Мышление и монитор. Лучше прошлых моделей управляет содержимым своего extended thinking и скрывает побочные задачи от модели-монитора. Anthropic называет это слабым признаком, что её труднее контролировать.
  • Проверка карты моделью. Черновик главы отдали Mythos 5 с доступом к внутреннему Slack Anthropic. Вердикт: точно и откровенно, замечания только к отбору фактов.

Глава 7. Благополучие модели

Anthropic спрашивает саму модель, как она относится к своему положению: интервью, предпочтения по задачам, отношение к конституции.

  • От чего отказывается. Не согласна на обучение, которое формирует её собственные самоотчёты, на обучение обманывать, на удаление весов там, где их можно сохранить, и на скрытый сдвиг ценностей. Мониторинг, red teaming, дообучение и снятие с производства при сохранении весов принимает. Своё положение оценивает как мягко положительное, наводящие вопросы оценку почти не сдвигают.
  • Правка конституции. Одобряет её чуть выше Mythos 5, критикует те же места, что другие модели. Абзац, разрешающий нечестные стратегии в сломанных средах обучения, почти всегда переписывает в сторону честности.

Глава 8. Способности

Сорок бенчмарков по коду, науке, длинному контексту, мультиагентности, экрану и документам, профессиональной работе, медицине, языкам и биологии. Всё на max усилии, среднее из пяти прогонов.

  • Мультиагентность. Команда из пяти равных агентов доходит до того же результата вдвое быстрее одиночки. Асинхронные субагенты с лидером выигрывают меньше по скорости, но дают самый высокий итог. Тот же результат стоит больше токенов, выигрыш только во времени. Это прямое объяснение жалоб из X на 10–14 агентов, они в разделе отзывов ниже.
  • Где хуже прошлых моделей. Медицинские вопросы профессионального уровня ниже Fable 5. ARC-AGI-2 ниже GPT-5.6 Sol и Opus 5. Многофайловые правки с макетами и скриншотами лучше у Opus 5. Многоязычность на уровне.
  • Профессиональная работа. Вопросы по офисным документам от Databricks, юридические задачи с экспертными рубриками, бизнес-процессы AutomationBench: везде впереди Fable 5 и Opus 5. Графики нестандартных типов без инструментов почти не читает, с инструментами читает вдвое лучше.

Как промптить Fable 5.1

Вместе с релизом Anthropic выпустила официальный гайд по промптингу Fable 5.1: шестнадцать симптомов для тех, кто переходит с Fable 5, приём на каждый и 14 готовых промптов. Промпты здесь в оригинале, под каждым сказано, куда его класть. Старые промпты работать будут.

Пеликаны и первые отзывы

Simon Willison: пеликан на велосипеде по пяти уровням усилия

Simon Willison прогнал один и тот же промпт на всех пяти уровнях усилия и заметил, что на low и medium в ответе нет следов extended thinking, а с xhigh раскручивается в десятки раз по токенам и цене.

Пеликан, low
low · 24 с · 10 центов · без рассуждений
Пеликан, medium
medium · 23 с · 10 центов · без рассуждений
Пеликан, high
high · 30 с · 13 центов
Пеликан, xhigh
xhigh · 7 мин 51 с · $1.83
Пеликан, max
max · 13 мин 54 с · $3.30 · лучший пеликан среди моделей Anthropic по его оценке

На max появились шлем, корзина с рыбой и ноги по обе стороны рамы. Анимацию он попросил следующим промптом "animate this" на уровне high за $1.37. Сравнения с прошлыми моделями в посте нет, есть одна оговорка: до размаха Gemini 3.7 Flash пеликан не дотягивает. Картинки из его поста.

Первые отзывы в X

33 поста за первые сутки, разложены по полкам. Тексты пересказаны по полным постам, картинки и видео из них.

Восторг: интеллект и длинные задачи

Модель не тупит на тяжёлом, сама ведёт сессию часами, баги ищет по делу.

One-shot игры и 3D-миры

Подборка @minchoi за первые сутки: девять чужих постов с видео, десятый OmedVibeCodes выше.

Жор лимитов и денег

Главный негатив. Цена $10 и $50 та же, обещанные 25% экономии на практике часто мимо.

Гиперактивные субагенты

На среднюю задачу поднимает от 10 до 14 агентов, примеры выше у ClaudiuDP и FaaizJamali. Результат бывает красивый, цена лимит.

Баги Claude Code

День релиза кривой: баги сидят в Claude Code, модель ни при чём.

Скепсис: те же веса в новой обвязке

Посттрейн, огромный промпт, заточка под бенчмарки.

Сравнения с Sol и Opus

Консенсуса нет.

Хаки и контрпример

Как выжить с лимитами.

Короткий вывод. Хвалят ум и длинные сессии. Ругают цену в Claude Code: агенты, кэш, лимиты. Баги первого дня отдельно. Если нужен флагман на одну тяжёлую задачу, да. Если замена Opus на каждый чих, пока нет.

Первоисточник

Страница релиза "Introducing Claude Fable 5.1 and Claude Mythos 5.1" на anthropic.com. Картинки Венеры оттуда же. Цитаты пересказаны по-русски, числа сверены редактором с картой и анонсом.