Одна модель, два уровня защиты

Fable 5.1 и Mythos 5.1 - не две разные модели с разной архитектурой, а одна и та же базовая модель с разными настройками защитных ограничений. Fable 5.1 - это версия для всех: доступна в Claude.ai, через API, а также через AWS, Google Cloud и Microsoft Azure со стандартным набором предохранителей.

Mythos 5.1 предназначена для проверенных пользователей и организаций - её защитные механизмы более гибкие, специально настроены под работу в кибербезопасности и науках о жизни. Доступ открыт только через две программы доверенного доступа: Cyber Verification Program (CVP) для направления кибербезопасности и Life Sciences Verification Program (LSVP), разработанную совместно с правительством США для направления наук о жизни. На момент запуска Mythos 5.1 доступна только организациям из США.

Прирост производительности - цифры самой Anthropic

По данным компании, Fable 5.1 показывает заметный рост на нескольких бенчмарках по сравнению с Fable 5: 52,6% против 24,7% на Terminal-Bench-Science 0.1 (агентные научные исследования), 55,8% против 42,0% на Terminal-Bench 4.0 (агентное программирование), 60,9% против 57,8% на Humanity's Last Exam без использования инструментов, 73,4% против 70,5% на CursorBench 3.2.0 (агентное программирование).

На низких и средних уровнях усилия Fable 5.1 показывает результаты не хуже или лучше Fable 5, при этом стоит существенно дешевле. Важная оговорка: все приведённые цифры - внутренние бенчмарки самой Anthropic, опубликованные компанией при анонсе, независимая проверка сторонними исследователями на момент публикации статьи не проводилась.

Что изменилось в цене

Для типовых рабочих нагрузок Fable 5.1 стоит примерно на 25% дешевле, чем Fable 5, при оплате по токенам. Для сильно агентных задач - тех, где модель самостоятельно выполняет много шагов подряд, - экономия может доходить до 45%.

Отдельно изменилась цена чтения из кэша - она снижена на 75%, до 0,25 доллара за миллион токенов повторно используемого, уже обработанного контекста. Базовые цены за новые токены не поменялись: 10 долларов за миллион входных токенов и 50 долларов за миллион выходных.

Кибербезопасность: меньше ложных срабатываний, поиск уязвимостей без эксплойтов

В части кибербезопасности новые защитные механизмы Fable 5.1 дают на 60% меньше ложных срабатываний, чем раньше. Отчасти это связано с тем, что модель теперь умеет находить уязвимости в программном обеспечении - но именно находить в защитных целях, а не разрабатывать под них эксплойты.

Задачи двойного назначения вроде пентестинга и создания эксплойтов по-прежнему перенаправляются на модели линейки Opus, а не выполняются напрямую через Fable 5.1 - это осознанное ограничение, а не техническая недоработка.

Реальный пример из практики клиента

Anthropic приводит цитату представителя компании Millennium: у команды был участок кода с крайне редким сбоем - примерно один раз на миллион запусков, - который никто в команде не мог объяснить на протяжении четырёх-пяти лет. Claude Fable 5.1 первой нашла причину этого сбоя. Это единичный кейс от клиента, приведённый самой Anthropic, а не независимо подтверждённое исследование - но конкретный и проверяемый пример класса задач, где модель показала себя полезной.

Чем Mythos 5.1 технически отличается от Fable 5.1?
Технически это одна и та же базовая модель - разница только в настройке защитных ограничений. У Mythos 5.1 они более гибкие и специально настроены под работу в кибербезопасности и науках о жизни, доступ к ней открыт только проверенным организациям через программы доверенного доступа.
Можно ли получить доступ к Mythos 5.1 из России?
На момент запуска доступ к Mythos 5.1 ограничен организациями из США - компания заявляет о планах международного расширения совместно с государственными структурами, но конкретных сроков для других стран не называет.
Насколько подешевело обращение к кэшу в API?
Цена чтения из кэша снижена на 75% - до 0,25 доллара за миллион токенов повторно используемого контекста. Базовые цены на новые входные и выходные токены не изменились.
Можно ли доверять заявленным Anthropic процентам прироста производительности?
Это внутренние бенчмарки самой компании, опубликованные при анонсе. Независимая проверка сторонними исследователями на момент публикации статьи не проводилась, поэтому относитесь к цифрам как к заявлению разработчика, а не как к подтверждённому факту.
Может ли Fable 5.1 создавать эксплойты для найденных уязвимостей?
Нет. Модель умеет находить уязвимости в защитных целях, но задачи по разработке эксплойтов и пентестингу перенаправляются на модели линейки Opus - это сознательное ограничение защитных механизмов.
Нужно ли что-то менять в своих запросах к API, чтобы перейти на Fable 5.1?
Модель доступна сразу через отдельный идентификатор API claude-fable-5-1 и на всех потребительских и корпоративных платформах - в источнике не указано о необходимости менять формат самих запросов, только выбрать новый идентификатор модели.
Источники
← Все статьи блога