Anthropic випустила Claude Fable 5.1: двократний відрив у наукових задачах, кеш у 4 рази дешевший і контекст у 1 млн токенів

Компанія Anthropic представила нові флагманські моделі штучного інтелекту — Claude Fable 5.1 і спеціалізовану версію Claude Mythos 5.1. Модель спроєктована для тривалих автономних завдань, масштабних рефакторингів коду та наукових досліджень, продемонструвавши понад двократну перевагу над попередницею в термінальних середовищах і ставши помітно доступнішою завдяки чотириразовому здешевленню кешованого контексту.
Модель з ідентифікатором claude-fable-5-1 уже доступна у вебверсії Claude, у середовищі Claude Code, через офіційний API, а також у хмарних сервісах AWS Bedrock, Google Cloud Vertex AI і Microsoft Azure.
Прорив у термінальних бенчмарках і порівняння з конкурентами
Головний технологічний стрибок Fable 5.1 зафіксовано у складних агентних середовищах, де ШІ має самостійно писати команди в консолі, працювати з файловою системою та аналізувати помилки компіляції.
Як повідомляється в офіційному анонсі Anthropic, результати ключових стандартизованих тестів розподілилися так:
| Бенчмарк | Claude Fable 5.1 | Claude Fable 5 | Claude Opus 5 | GPT-5.6 Sol |
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | 29,0% | 22,4% |
| AutomationBench | 31,4% | 17,1% | 26,9% | 19,6% |
| Terminal-Bench 4.0 | 55,8% | 42,0% | 46,2% | — |
| CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% | 67,2% |
| GDPval-AA v2 (Knowledge Work) | 1853 | 1723 | 1824 | 1711 |
| Humanity’s Last Exam (з інструментами) | 65,0% | 63,8% | 63,6% | — |
| OSWorld 2.0 (Strict / Computer Use) | 41,7% | 36,1% | 39,6% | — |
Найбільший відрив зафіксовано в науковому тесті Terminal-Bench-Science, де Fable 5.1 обійшла Fable 5 у 2,13 раза (52,6% проти 24,7%) і більш ніж удвічі перевершила флагманську GPT-5.6 Sol (22,4%). Водночас у класичних завданнях автодоповнення коду на CursorBench приріст помірний (+4,1% до попереднього покоління).
Повну картину паритету сил експерти зможуть скласти після публікації незалежних замірів на порталі аналітики Artificial Analysis.
Автономність до 38 годин: реальні кейси компаній
На відміну від стандартних чат-ботів, Fable 5.1 оптимізована під сценарії, де агент годинами працює без втручання людини:
- Кейс Millennium: модель локалізувала й усунула плаваючу системну помилку (що виникала 1 раз на мільйон запусків), яку живі інженери не могли відстежити протягом п’яти років. ШІ зіставив дампи пам’яті (core dump) з вихідним кодом зовнішніх бібліотек;
- Кейс MongoDB: агент автономно дослідив репозиторії компанії та за кілька днів зібрав робочий прототип складного сервісу з безперервним самотестуванням;
- Кейс Ramp: модель провела безперервний 38-годинний цикл налагодження пайплайну машинного навчання, самостійно запустивши та проаналізувавши шість паралельних експериментів.
Економіка Fable 5.1: кешування в 4 рази дешевше
Згідно з тарифною сіткою платформи Claude API, базова вартість генерації залишилася на рівні $10 за 1 млн вхідних і $50 за 1 млн вихідних токенів.
Однак вартість читання кешованого контексту (cache reads) знизилася одразу в чотири рази — з $1,00 до $0,25 за 1 млн токенів. Для програмування та роботи з величезними репозиторіями, де агент постійно перечитує одні й ті самі кодові бази, це знижує підсумкові витрати на 25–45% порівняно з Fable 5.
За документацією платформи Claude, модель отримала:
- контекстне вікно обсягом 1 000 000 токенів;
- максимальний розмір однієї відповіді до 128 000 токенів;
- дату відсікання знань (knowledge cutoff) — червень 2026 року;
- адаптивний режим міркувань (Adaptive Reasoning), налаштований за замовчуванням на рівень High у середовищі Claude Code і Medium у вебінтерфейсі.
Різниця між Fable 5.1 і Mythos 5.1
Паралельно представлена закрита модифікація Claude Mythos 5.1. Це та сама базова архітектура, але з розширеними допусками у сфері кібербезпеки та біології для верифікованих корпоративних і урядових дослідників.
У споживчій Fable 5.1 інженери переробили захисні фільтри: кількість хибних блокувань легітимного коду під час пошуку вразливостей у Claude Code знизилася на 60%, хоча створення бойових експлойтів і декомпіляція бінарників, як і раніше, блокуються.
Наукові відкриття: картографування Венери та біоінженерія
Можливості нової архітектури перевірили на реальних наукових завданнях:
- Астрономія: обробивши архівні радарні дані місії NASA Magellan, Fable 5.1 самостійно навчила нейромережу та побудувала деталізовану карту висот третини поверхні Венери з роздільною здатністю 2–3 км (замість колишніх 10–20 км), підвищивши точність рельєфу на 25%. Карту передано у відкритий доступ за ліцензією Creative Commons для підготовки місій NASA VERITAS і ESA EnVision;
- Біоінженерія: версія Mythos 5.1 спроєктувала синтетичні білкові структури з десятикратною перевагою за афінністю зв’язування над лідерами змагань Adaptyv Bio, а також оптимізувала роботу семи відкритих геномних нейромереж, прискоривши їхні обчислення до 2,5 раза.