Компания называет модель своей самой сильной системой для программирования и интеллектуальной работы. Помимо роста качества, Anthropic попыталась решить три практические проблемы предыдущего выпуска: высокую стоимость длинных сессий, чрезмерные отказы на безопасных запросах и требования бизнеса к хранению данных.
Одна модель — разные границы
Fable 5.1 и Mythos 5.1 используют одну технологическую основу. Разница появляется в правилах доступа к потенциально опасным возможностям.
Fable может искать уязвимости в исходном коде, но не должна помогать создавать готовые эксплойты или проводить полноценное вторжение. Mythos получает менее строгие ограничения для профессиональной защитной работы и исследований в биологии, но доступ к ней выдаётся через специальные программы проверки.
На старте Mythos доступна ограниченному числу организаций в США. Anthropic обещает постепенно расширять программу, однако не называет точного международного графика.
✦ ИИДлинные агентные задачи должны стать дешевле
Базовая цена Fable 5.1 не изменилась: 10 долларов за миллион входных и 50 долларов за миллион выходных токенов. Снижение стоимости связано с кэшем — повторное чтение уже обработанного контекста теперь стоит на 75 процентов меньше, 0,25 доллара за миллион токенов.
По расчётам Anthropic, обычная нагрузка обойдётся примерно на 25 процентов дешевле Fable 5, а длинные агентные процессы с большим объёмом повторно используемого контекста — до 45 процентов дешевле. Это оценки разработчика на основе собственной нагрузки, а фактическая экономия зависит от структуры задачи.
Для Claude Code изменение особенно заметно: агент многократно перечитывает проект, историю и инструкции. Чем больше доля кэшированного контекста, тем сильнее влияет новая цена.
Меньше ложных срабатываний
Anthropic заявляет, что обновлённые фильтры кибербезопасности блокируют на 60 процентов меньше безопасных запросов. В биологических задачах число вмешательств в безвредные сценарии, по данным компании, снизилось ещё сильнее.
Это важная попытка найти баланс. Слишком слабая защита открывает опасные возможности, а слишком грубая превращает дорогую профессиональную модель в систему, которая отказывается анализировать обычный код или научную задачу.
Независимые публикации обращают внимание на компромисс: системная карта отмечает, что Mythos 5.1 в некоторых проверках немного чаще соглашается с неподтверждёнными заявлениями пользователя о наличии разрешения, чем Opus 5. Это не делает модель небезопасной автоматически, но объясняет осторожный доступ к расширенным возможностям.
Невидимая маркировка текста
Fable 5.1 получила статистическую маркировку генерируемого текста. Она не выглядит как подпись и не содержит данных о пользователе, но специальный интерфейс может оценить вероятность участия Claude в создании материала.
Anthropic связывает эту функцию с требованиями европейского регулирования. Доступ к определению маркировки пока ограничен регуляторами, исследователями, средствами массовой информации и организациями, которым такой инструмент нужен для соблюдения закона.
Для обычного пользователя это означает, что текст не получает заметного водяного знака. Вопрос надёжности статистического обнаружения остаётся открытым: результаты неизбежно придётся проверять на отредактированных, переведённых и смешанных материалах.
Что показывают тесты
Anthropic публикует значительный рост результатов в программировании, научных задачах и работе с компьютером. Компания также сообщает о случаях, когда модель находила редкую причину сбоя или создавала прототип в течение нескольких дней автономной работы.
Но основная часть сравнений проведена разработчиком, а отдельные версии тестов отличаются от прежних наборов заданий. Поэтому сравнивать новые проценты с историческими таблицами напрямую не всегда корректно. Практическое качество станет понятнее после независимых испытаний и массового использования.
Вывод
Главная новость Fable 5.1 — не только рост результатов. Anthropic разделила одну мощную модель на общедоступную и профессиональную версии, пытаясь сохранить полезность без полного открытия самых рискованных функций. Одновременно дешёвый кэш делает длинные агентные задачи доступнее. Если обещанная экономия подтвердится, именно стоимость, а не рекорд в тесте, может оказаться самым заметным изменением для разработчиков.


