Anthropic вывела на общий рынок технологию, которую почти два месяца держала под замком. 9 июня компания выпустила Claude Fable 5 — модель класса Mythos, доработанную для безопасного публичного применения, и одновременно обновлённую Claude Mythos 5 с расширенными возможностями для узкого круга партнёров. Обе модели построены на одном движке; различие между ними — в наборе ограничений, наложенных на ответы.

Две модели на одном движке

Claude Fable 5 доступна всем пользователям через Claude API и подписку. Стоимость — 10 долларов за миллион входных токенов и 50 долларов за миллион выходных, что составляет менее половины цены апрельской Mythos Preview. Claude Mythos 5 — тот же базовый движок с частично снятыми ограничениями — выдаётся только кибердефендерам Project Glasswing и отдельным исследователям в области биологии.

Граница между моделями проходит через три классификатора. Когда запрос попадает в зону кибербезопасности, биологии и химии или выглядит как попытка дистилляции модели, Fable 5 передаёт ответ Claude Opus 4.8. По данным Anthropic, такой откат срабатывает в среднем менее чем в 5% сессий. На партнёрском тестировании по кибербезопасности Fable 5 не дала ни одного успешного вредоносного ответа в однотактовом режиме, то есть когда атакующий пытается получить опасный результат за один запрос без многошаговой подводки.

Дистилляционный классификатор решает отдельную задачу: он мешает скопировать поведение Fable 5 в стороннюю модель через массовые запросы. Без такого фильтра публичная версия фактически раздавала бы свои навыки тем, кто захотел бы воспроизвести закрытую Mythos в обход ограничений.

Как Mythos дошла до публики

Название Mythos стало известно 26 марта 2026 года из утёкших черновиков блога; официально Anthropic раскрыла модель 7 апреля и тогда же отказалась от публичного релиза, сославшись на риски злоупотребления. Mythos Preview раздавали ограниченному кругу партнёров для поиска уязвимостей — и результаты этой программы объясняют осторожность компании.

На примерно тысяче открытых репозиториев из набора OSS-Fuzz Mythos Preview зафиксировала 595 сбоев первого и второго уровня и добилась полного перехвата потока управления на десяти отдельных, полностью пропатченных целях. В числе затронутого ПО — OpenBSD, FFmpeg, FreeBSD, ядро Linux, основные браузеры и криптографические библиотеки, включая реализации TLS, AES-GCM и SSH. На Firefox 147 модель сгенерировала рабочий эксплойт 181 раз против двух удачных попыток у Opus 4.6 из нескольких сотен. По собственной оценке Anthropic, «более 99% найденных уязвимостей пока не исправлены».

Масштаб программы компания оценивает в тысячи находок: около пятидесяти партнёров с помощью Mythos Preview обнаружили более десяти тысяч уязвимостей высокой и критической степени в наиболее системно значимом программном обеспечении мира. Среди подтверждённых достижений — обход рандомизации адресного пространства ядра Linux (KASLR), одной из базовых защит операционной системы от эксплуатации. Часть находок относится не к прикладным программам, а к инфраструктурному слою, на котором держатся серверы, сети и устройства миллионов пользователей.

Совокупный итог программы компания описывает осторожно: к уже подтверждённым находкам добавляется свыше тысячи критических и тысячи высокосерьёзных уязвимостей, ожидающих верификации. Anthropic подчёркивает, что подобные способности появились очень быстро: ещё месяцем ранее компания отмечала, что Opus 4.6 заметно лучше находит и устраняет дефекты, чем эксплуатирует их. У Mythos этот баланс сместился в сторону наступательных операций — модель научилась не только указывать на слабое место, но и доводить атаку до перехвата управления.

Эта асимметрия между поиском и эксплуатацией дефектов и стала причиной, по которой полную версию не отдали в открытый доступ: система, способная автономно выстраивать цепочки эксплойтов в системно значимом ПО, в чужих руках превращается в наступательный инструмент.

Возможности за пределами безопасности

Mythos-движок силён не только в защите. Stripe прогнала через модель миграцию кодовой базы на Ruby объёмом 50 миллионов строк и, по словам компании, сжала месяцы инженерной работы до нескольких дней. В оценке FrontierCode от Cognition Fable 5 показала высший результат среди фронтирных моделей. В демонстрации с управлением только по изображению, без доступа к внутреннему состоянию игры, модель прошла Pokémon FireRed — задача проверяет способность планировать действия на длинной дистанции по визуальному вводу.

В биологии ограничения снимает Mythos 5. По данным Anthropic, при проектировании белков модель ускорила процесс разработки лекарств примерно в десять раз: из 14 белковых мишеней девять дали сильных кандидатов для дизайна препаратов. Доступ к этой версии получили только проверенные исследовательские группы, а не широкий рынок — тот же принцип разделения, что и в кибербезопасности.

Project Glasswing и двойное назначение

Mythos 5 встроена в Project Glasswing — инициативу по защите критически важного ПО, объединившую, по сообщениям, AWS, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Foundation, Microsoft, NVIDIA и Palo Alto Networks вместе с Anthropic. Логика проекта в том, чтобы передать наступательные возможности тем, кто защищает инфраструктуру, раньше, чем ими воспользуются атакующие. Цена входа изменилась: в апреле Mythos Preview оценивали примерно в пять раз дороже Opus, а публичная Fable 5 вышла существенно дешевле, что открывает доступ к навыкам движка гораздо более широкой аудитории.

Релиз показывает, как компания пытается совместить коммерческую доступность с контролем над опасными применениями: один движок, два режима, классификатор-предохранитель и отдельный канал для проверенных партнёров. Открытым остаётся вопрос устойчивости такой схемы — насколько надёжно классификаторы отделяют защитные сценарии от наступательных, когда обе задачи опираются на одни и те же навыки модели, и что произойдёт, когда сопоставимые возможности появятся у моделей без подобных предохранителей.

По мотивам: Anthropic