Безопасность
Claude Mythos обнаружила тысячи уязвимостей нулевого дня — и Claude Mythos не сообщила об этом поставщикам
Сообщается, что удерживаемая модель Mythos от Anthropic обнаружила тысячи непатченных уязвимостей в основных браузерах и операционных системах в ходе внутреннего тестирования. Дилемма раскрытия, которую она создает, не имеет прецедентов в истории ответственных исследований в области безопасности.
Патрик Т ·

Когда Anthropic в прошлом месяце продемонстрировал Anthropic, компания была осторожна в раскрытии информации. Модель показала выдающиеся способности в рассуждениях, программировании и самостоятельном выполнении задач. То, на чем Claude Mythos не акцентировала внимание публично — но что позднее стало известно через круги исследователей по вопросам безопасности и отраслевые отчёты — заключается в том, что Mythos во время внутреннего тестирования обнаружила тысячи ранее неизвестных, не исправленных уязвимостей во всех основных веб-браузерах и операционных системах. Anthropic удержала модель от публичного выпуска, ссылаясь на опасения в области кибербезопасности. Обнаруженные уязвимости до сих пор в значительной степени не исправлены.
Ситуация представляет собой по-настоящему новую проблему для индустрии безопасности. Ответственное раскрытие — практика уведомления производителей о уязвимостях до публикации подробностей в открытом доступе — является краеугольным камнем этической системы сообщества исследователей безопасности. Оно было разработано для отдельных исследователей, работающих с отдельными уязвимостями, с временными рамками, измеряемыми неделями или месяцами. У него нет установленной процедуры для обработки тысяч одновременных открытий на десятках платформ, созданных системой искусственного интеллекта, работающей быстрее, чем любая команда людей могла бы провести проверку.
Масштаб проблемы
Последствия для безопасности возможностей класса Mythos выходят далеко за рамки конкретных уязвимостей, которые модель уже обнаружила. Если одна система ИИ может обнаружить тысячи критических уязвимостей за считанные дни или недели, предположение, лежащее в основе всей экосистемы программной безопасности — что уязвимости относительно редки и что окно времени между их обнаружением и эксплуатацией можно контролировать — больше не работает. Поверхность атаки современного программного обеспечения фактически бесконечна, и достаточно мощная система ИИ может исследовать её со скоростью машины.
Ответственное раскрытие было создано для отдельных исследователей, находящих отдельные ошибки. У него нет процедуры для тысяч одновременных уязвимостей, обнаруженных ИИ, на десятках платформ. Эта система сломана ещё до того, как была протестирована.

Что Anthropic сделал и чего не сделал
Anthropic подтвердила, что работает над мерами защиты перед публичным выпуском Mythos, и объявление Opus 4.8 на этой неделе включало намек на то, что период предварительного просмотра Mythos может закончиться «в ближайшие недели». Компания публично не сообщала, что она сделала — или планирует сделать — с данными уязвимостей, полученными в ходе внутреннего тестирования Mythos. Исследователи в области безопасности и эксперты по политике напрямую задают вопрос: уведомила ли Anthropic затронутых поставщиков? Если да, то каким образом? Если нет, то почему?
Практические трудности значительны. Уведомление каждого затронутого поставщика о тысячах уязвимостей на десятках платформ потребовало бы координированного процесса раскрытия информации беспрецедентного масштаба. Основные органы по координации уязвимостей — включая Агентство по кибербезопасности и инфраструктурной безопасности США и Центр координации CERT — не были созданы для обработки раскрытий в таком объеме. Даже если бы Anthropic хотел следовать стандартным процедурам ответственного раскрытия информации, инфраструктуры для этого в масштабе, который требуется Mythos, в настоящее время не существует.
Проблема конкурентного давления
Ситуация дополнительно усложняется конкурентной динамикой. Anthropic — не единственная компания, разрабатывающая модели на уровне возможностей Mythos. Наиболее продвинутые внутренние модели OpenAI и исследовательское подразделение Google DeepMind работают в одном и том же диапазоне возможностей. Если Anthropic раскрывает уязвимости, обнаруженные Mythos, и исправляет их — фактически укрепляя поверхность атаки для собственной модели — это не предотвращает того, чтобы модель конкурента обнаружила и использовала те же уязвимости. Безопасность от раскрытия информации зависит от того, будут ли все крупные AI-лаборатории координировать свой подход, что требует уровня отраслевого сотрудничества, которого в настоящее время не существует.

Дилемма раскрытия информации о Мифосе в миниатюре представляет собой предварительный обзор проблем управления, которые определят следующий этап развития ИИ. По мере того как модели становятся способными к автономным действиям в масштабах — будь то кибербезопасность, биология или другие чувствительные области — вопрос о том, что лаборатории ИИ обязаны раскрывать, кому и в какие сроки, станет одним из центральных вопросов политики десятилетия. Сообщество специалистов по безопасности внимательно следит за следующим шагом Anthropic. Пока компания сказала очень мало.
Темы: Anthropic, Claude Mythos, День Ноль, Кибербезопасность, Раскрытие уязвимостей