1 сентября 2026 года Anthropic представила две модели, Claude Fable 5.1 и Claude Mythos 5.1. Формально это одна и та же модель с разными уровнями защиты: Fable 5.1 доступна всем желающим, а Mythos 5.1 выдаётся через программы доверенного доступа, для работы в кибербезопасности и науках о жизни.
Для бизнеса главное здесь не бенчмарки, а строчка в смете. Разберём по порядку.
Цена осталась, стоимость упала
Тарифы не изменились: миллион входящих токенов стоит 10 долларов, миллион исходящих 50. Изменилось другое, повторное чтение из кэша подешевело на 75%, до 25 центов за миллион токенов.
Звучит как деталь для разработчиков, но именно она определяет счёт. Любой рабочий сценарий, будь то бот поддержки, разбор входящих заявок или генерация описаний товаров, раз за разом отправляет модели один и тот же контекст: инструкцию, прайс, правила ответа. Раньше за это платили по полной ставке, теперь по четверти. Anthropic оценивает экономию для типовых нагрузок в 25%, а для сценариев, где модель работает пошагово и сама вызывает инструменты, до 45%.
Миллион токенов контекста
Модель принимает до миллиона токенов за раз и отвечает объёмом до 128 тысяч. На человеческом языке это значит, что перед ней можно положить всю историю переписки с клиентом, выгрузку из CRM и годовой отчёт одновременно, не нарезая на куски.
Так снимается главная головная боль прикладных решений. Раньше половина работы уходила на то, чтобы аккуратно подобрать, какой фрагмент показать модели.
Регулятор усилия
Появилась возможность менять глубину раздумий прямо посреди диалога, не начиная новую сессию. Простой шаг проходит быстро и дёшево, сложный медленно и тщательно.
Для тех, кто строит автоматизацию, это прямая экономия: не нужно гонять дорогой режим на всей цепочке ради одного трудного места.
Маркировка происхождения
Второе нововведение, пометки происхождения контента. Сгенерированный текст помечается так, что принимающая система может проверить, откуда он взялся. Тема скучная ровно до первого спора о том, кто написал документ.
Что с качеством
Anthropic приводит замеры: на Terminal-Bench-Science результат вырос с 24,7% до 52,6%, на Terminal-Bench 4.0 с 42,0% до 55,8%, на CursorBench с 70,5% до 73,4%. Компания также заявляет результаты выше, чем у предыдущих моделей и у GPT-5.6 Sol на ряде тестов.
К бенчмаркам стоит относиться спокойно: они меряют лабораторные задачи, а не вашу. Прирост есть, и он заметнее там, где модель работает долго и пошагово, то есть ровно в тех сценариях, где заодно сильнее всего падает и стоимость.
Нужна такая же реклама для вашего бизнеса?
Разберу нишу, посчитаю бюджет и покажу, из чего сложится цена заявки.



