Anthropic выпустила Claude Fable 5.1: двукратный отрыв в научных задачах, кэш в 4 раза дешевле и контекст в 1 млн токенов

Компания Anthropic представила новые флагманские модели искусственного интеллекта — Claude Fable 5.1 и специализированную версию Claude Mythos 5.1. Модель спроектирована для длительных автономных задач, масштабных рефакторингов кода и научных исследований, продемонстрировав более чем двукратное превосходство над предшественницей в терминальных средах и став заметно доступнее за счёт четырёхкратного удешевления кэшированного контекста.
Модель под идентификатором claude-fable-5-1 уже доступна в веб-версии Claude, среде Claude Code, через официальный API, а также в облачных сервисах AWS Bedrock, Google Cloud Vertex AI и Microsoft Azure.
Прорыв в терминальных бенчмарках и сравнение с конкурентами
Главный технологический скачок Fable 5.1 зафиксирован в сложных агентных средах, где ИИ обязан самостоятельно писать команды в консоли, работать с файловой системой и анализировать ошибки компиляции.
Как сообщается в официальном анонсе Anthropic, результаты ключевых стандартизированных тестов распределились следующим образом:
| Бенчмарк | Claude Fable 5.1 | Claude Fable 5 | Claude Opus 5 | GPT-5.6 Sol |
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | 29,0% | 22,4% |
| AutomationBench | 31,4% | 17,1% | 26,9% | 19,6% |
| Terminal-Bench 4.0 | 55,8% | 42,0% | 46,2% | — |
| CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% | 67,2% |
| GDPval-AA v2 (Knowledge Work) | 1853 | 1723 | 1824 | 1711 |
| Humanity’s Last Exam (с инструментами) | 65,0% | 63,8% | 63,6% | — |
| OSWorld 2.0 (Strict / Computer Use) | 41,7% | 36,1% | 39,6% | — |
Наибольший отрыв зафиксирован в научном тесте Terminal-Bench-Science, где Fable 5.1 обогнала Fable 5 в 2,13 раза (52,6% против 24,7%) и более чем вдвое превзошла флагманскую GPT-5.6 Sol (22,4%). При этом в классических задачах автодополнения кода на CursorBench прирост носит умеренный характер (+4,1% к предыдущему поколению).
Полноценную картину паритета сил эксперты смогут составить после публикации независимых замеров на портале аналитики Artificial Analysis.
Автономность до 38 часов: реальные кейсы компаний
В отличие от стандартных чат-ботов, Fable 5.1 оптимизирована под сценарии, где агент часами работает без вмешательства человека:
- Кейс Millennium: модель локализовала и устранила плавающую системную ошибку (возникавшую 1 раз на миллион запусков), которую живые инженеры не могли отследить на протяжении пяти лет. ИИ сопоставил дампы памяти (core dump) с исходным кодом внешних библиотек;
- Кейс MongoDB: агент автономно исследовал репозитории компании и за несколько дней собрал рабочий прототип сложного сервиса с непрерывным самотестированием;
- Кейс Ramp: модель провела непрерывный 38-часовой цикл отладки пайплайна машинного обучения, самостоятельно запустив и проанализировав шесть параллельных экспериментов.
Экономика Fable 5.1: кэширование в 4 раза дешевле
Согласно тарифной сетке платформы Claude API, базовая стоимость генерации осталась на уровне $10 за 1 млн входных и $50 за 1 млн выходных токенов.
Однако стоимость чтения кэшированного контекста (cache reads) снизилась сразу в четыре раза — с $1,00 до $0,25 за 1 млн токенов. Для программирования и работы с огромными репозиториями, где агент постоянно перечитывает одни и те же кодовые базы, это снижает итоговые расходы на 25–45% по сравнению с Fable 5.
По документации платформы Claude, модель получила:
- контекстное окно объёмом 1 000 000 токенов;
- максимальный размер одного ответа до 128 000 токенов;
- дату отсечки знаний (knowledge cutoff) — июнь 2026 года;
- адаптивный режим рассуждений (Adaptive Reasoning), настроенный по умолчанию на уровень High в среде Claude Code и Medium в веб-интерфейсе.
Разница между Fable 5.1 и Mythos 5.1
Параллельно представлена закрытая модификация Claude Mythos 5.1. Это та же базовая архитектура, но с расширенными допусками в области кибербезопасности и биологии для верифицированных корпоративных и правительственных исследователей.
В потребительской Fable 5.1 инженеры переработали защитные фильтры: количество ложных блокировок легитимного кода при поиске уязвимостей в Claude Code снизилось на 60%, хотя создание боевых эксплойтов и декомпиляция бинарников по-прежнему блокируются.
Научные открытия: картографирование Венеры и биоинженерия
Возможности новой архитектуры проверили на реальных научных задачах:
- Астрономия: обработав архивные радарные данные миссии NASA Magellan, Fable 5.1 самостоятельно обучила нейросеть и построила детализированную карту высот трети поверхности Венеры с разрешением 2–3 км (вместо прежних 10–20 км), повысив точность рельефа на 25%. Карта передана в открытый доступ под лицензией Creative Commons для подготовки миссий NASA VERITAS и ESA EnVision;
- Биоинженерия: версия Mythos 5.1 спроектировала синтетические белковые структуры с десятикратным превосходством по аффинности связывания над лидерами соревнований Adaptyv Bio, а также оптимизировала работу семи открытых геномных нейросетей, ускорив их вычисления до 2,5 раза.