Anthropic выпустила Claude Fable 5.1 и Claude Mythos 5.1: 52,6% на Terminal-Bench-Science и чтение из кэша на 75% дешевле
Anthropic выпустила модели Claude Fable 5.1 и Claude Mythos 5.1 — спустя три месяца после появления линейки Fable 5 в июне 2026 года. По сути, это одна и та же базовая модель, поверх которой работают разные уровни защитных ограничений. Fable 5.1 доступна всем желающим под именем claude-fable-5-1, тогда как Mythos 5.1 по-прежнему открыта только для проверенных организаций. Обе модели получили окно контекста в 1 млн токенов и до 128K токенов на выходе, а адаптивное мышление у них всегда включено. Главный показатель возможностей — 52,6% в бенчмарке Terminal-Bench-Science 0.1 против 24,7% у Fable 5 и 29,0% у Opus 5. Ключевая коммерческая цифра — снижение стоимости чтения из кэша на 75%: с $1,00 до $0,25 за миллион токенов. В Anthropic оценивают, что на типичных нагрузках это даёт примерно 25% экономии, а на агентных сценариях — до 45%. При этом базовые цены на ввод и вывод не изменились: $10 и $50 за миллион токенов соответственно.
Где можно развернуть модели?
Да. Claude Fable 5.1 доступна как claude-fable-5-1 через Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry. Claude Mythos 5.1 — нет: она остаётся закрытой для проверенных американских организаций в рамках Project Glasswing.
Результаты бенчмарков
В Terminal-Bench-Science 0.1 — бенчмарке для агентных научных исследований — Fable 5.1 набирает 52,6%, тогда как Opus 5 показывает 29,0%, Fable 5 — 24,7%, а GPT-5.6 Sol — 22,4%. Anthropic указывает стандартную ошибку от 3,5 до 4,5 пункта на модель, поэтому к величине отрыва стоит относиться с осторожностью — сам порядок мест при этом остаётся показательным.
В Terminal-Bench 4.0 Fable 5.1 достигает 55,8%, а Mythos 5.1 — 60,9%. Разрыв между двумя идентичными по сути моделями — это цена защитных ограничений, и такое признание со стороны компании выглядит необычно честно. Прочие результаты: CursorBench 3.2.0 — 73,4%; Humanity’s Last Exam — 60,9% без инструментов и 65,0% с инструментами; AutomationBench — 31,4%; OSWorld 2.0 — 41,7% в строгом режиме; GDPval-AA v2 — 1853.
Откуда взялось снижение стоимости
Базовые цены на ввод и вывод не менялись. Чтение из кэша подешевело на 75% — с $1,00 до $0,25 за миллион токенов: теперь это 0,025 от стоимости базового ввода против 0,1 у всех остальных моделей Claude. По оценкам Anthropic, типичные рабочие нагрузки становятся дешевле примерно на 25%, а насыщенные контекстом агентные сценарии — до 45%. Пакетная обработка стоит $5 и $25 за миллион токенов.
Три обратно несовместимых изменения, с которыми столкнутся команды
- Принудительный вызов инструментов больше не работает. Если задать tool_choice как any или tool, API вернёт ошибку 400. Вместо этого используйте auto со строгим вызовом инструментов либо структурированные выводы.
- Блоки рассуждений привязаны к модели. Fable 5.1 может читать «мысли» более ранних моделей, но ни одна более ранняя модель не понимает её собственные. В схемах с маршрутизацией и запасными моделями при переключении на старую версию рассуждения теряются.
- Редактирование предыдущих ходов обесценивает блоки рассуждений. Добавление и удаление напоминаний по отдельным ходам, а также пересборка массива system или tools в середине диалога теперь приводят к ошибке. Проверка действует для аккаунтов, созданных 31 августа 2026 года или позже. Решения — системные сообщения с областью действия в пределах одного хода и серверное редактирование контекста.
Есть и дополняющие изменения: параметр effort для отдельных сообщений, системные сообщения в пределах хода и режим thinking.display: «updates» пока доступны в бета-версии за специальными заголовками. Подтверждение происхождения контента стало обязательным: на весь вывод наносится статистический текстовый водяной знак, а файлы подписываются учётными данными C2PA.
Anthropic честно документирует и реальные регрессии. Параллельный вызов инструментов стал менее стабильным: агентные циклы теперь могут выполнять по одному вызову за ход там, где Fable 5 объединяла сразу несколько. Модель реже комментирует свои действия, при низком effort чаще отвечает по памяти и предпочитает переписывать файл целиком, а не вносить точечные правки.
Защитные ограничения и научные результаты
Киберограничения теперь разрешают поиск уязвимостей, но запрещают разработку эксплойтов: число вмешательств в Claude Code сократилось примерно на 60% за сессию. Биологические защитные фильтры срабатывают на 85% реже на безобидных запросах. Тестирование на проникновение, генерация эксплойтов и сканирование уязвимостей по бинарному коду по-прежнему перенаправляются на Opus.
В исследовательских задачах Mythos 5.1 спроектировала связывающие белки с частотой успеха около 50% по 12 мишеням при типичной норме 10–15%, Fable 5.1 построила карту высот Венеры с разрешением 2–3 км, а специальные GPU-ядра ускорили работу семи открытых геномных моделей — вплоть до 2,5 раза.
Главные выводы
- Fable 5.1 и Mythos 5.1 — одна модель за двумя уровнями защиты; публично доступна только Fable.
- 52,6% в Terminal-Bench-Science 0.1 — почти вдвое больше, чем 24,7% у Fable 5.
- Чтение из кэша подешевело на 75% — до $0,25 за миллион токенов; базовые тарифы не менялись.
- Три обратно несовместимых изменения API затрагивают любых агентов, которые правят историю диалога.
- По умолчанию данные хранятся 30 дней; режим без хранения данных требует отдельного разрешения.
