Политика
Институт безопасности ИИ Великобритании становится глобальной моделью — вот почему
Штат сотрудников включает OpenAI и бывших сотрудников Google, Британский институт безопасности ИИ прокладывает новый путь в управлении ИИ, который начинают перенимать другие страны.
Патрик Т ·

Когда правительство Великобритании учредило Институт безопасности ИИ в ноябре 2023 года, это широко считалось хорошо намеренной, но скромной инициативой — небольшой командой исследователей, которым поручено оценивать передовые модели ИИ перед их публичным выпуском. Два с половиной года спустя организация (теперь переименованная в Институт безопасности искусственного интеллекта, или AISI) превратилась во что-то значительно более значимое: в модель того, как правительства могут полноценно взаимодействовать с разработкой ИИ, не просто одобряя заявления индустрии и не вводя контрпродуктивные ограничения.
Преимущество таланта
Самая отличительная черта AISI — это его персонал. В отличие от большинства государственных агентств, которым сложно привлекать технические кадры в условиях конкуренции с зарплатами частного сектора, AISI удалось собрать замечательную концентрацию экспертизы в области ИИ. Среди нынешних и бывших сотрудников есть выпускники OpenAI, Google DeepMind, Anthropic и нескольких ведущих академических исследовательских групп по ИИ. Технический директор организации ранее руководил исследованиями в области безопасности в крупной лаборатории ИИ; несколько её старших исследователей публиковали влиятельные работы по согласованию ИИ и интерпретируемости.
Эта концентрация талантов придала AISI авторитет в индустрии ИИ, которого большинству государственных агентств не хватает. Когда исследователи AISI выявляют вопрос безопасности в передовой модели, крупные компании в области ИИ воспринимают это всерьез — не потому, что они обязаны делать это по закону, а потому что исследователи, поднимающие вопрос, являются коллегами, чье техническое суждение они уважают. Эта динамика позволила создать форму неформального управления, которая дополняет и в некотором смысле превосходит то, чего достигло формальное регулирование.

Рамки оценки
AISI разработал комплексную структуру для оценки передовых моделей ИИ, которая стала отраслевым эталонным стандартом. Структура оценивает модели по нескольким направлениям: возможности (что модель может делать), безопасность (какие риски представляет модель) и защищенность (как модель может быть неправомерно использована). Каждое направление оценивается с помощью сочетания автоматического тестирования и экспертной человеческой оценки.
Рамки были применены к моделям всех основных разработчиков ИИ, и результаты — хотя не всегда полностью публикуемые — повлияли на решения о внедрении в нескольких заметных случаях. По крайней мере в двух случаях оценки AISI выявили значительные проблемы с безопасностью, что привело компании ИИ к отсрочке публичного внедрения при реализации дополнительных мер защиты. Компании, участвовавшие в этом, публично не подтверждали эти случаи, но несколько источников, знакомых с оценками, описали их Mantis.
AISI показала, что правительство может быть настоящим партнером в области безопасности ИИ, а не препятствием для инноваций. Это модель, которую стоит воспроизводить.
Бывший высокопоставленный чиновник, Национальный институт стандартов и технологий США
Международная экспансия
Успех AISI привлек значительное международное внимание. В начале 2024 года Соединенные Штаты создали свой собственный Институт безопасности ИИ при Национальном институте стандартов и технологий, явно ориентируясь на британскую организацию. Япония, Канада, Сингапур и Европейский союз также создали или находятся в процессе создания аналогичных органов. В мае 2026 года AISI подписал официальные соглашения о сотрудничестве с аналогичными организациями в семи странах, создав фактически неформальную международную сеть для оценки безопасности ИИ.
Эта сеть имеет практическое значение. Передовые модели ИИ разрабатываются небольшим числом компаний, большинство из которых базируются в Соединенных Штатах, но они используются по всему миру. Скоординированная международная система оценки означает, что проблемы безопасности, выявленные в одной юрисдикции, могут быть быстро переданы коллегам в других странах, создавая более комплексную систему безопасности, чем любая отдельная национальная институция могла бы обеспечить.

Ограничения и вызовы
Модель AISI не лишена своих ограничений. Мандат организации носит консультативный характер, а не регулирующий — она может выявлять проблемы с безопасностью и рекомендовать изменения, но не может обязать компании, занимающиеся ИИ, их внедрять. Это ограничение стало более значительным по мере развития возможностей ИИ и увеличения потенциальных последствий сбоев в безопасности. Несколько нынешних и бывших сотрудников AISI публично утверждали, что организации необходимы формальные регулирующие полномочия для полной эффективности.
Также возникает вопрос о масштабах. Рамки оценки AISI были разработаны для передовых моделей ИИ — самых способных систем, разработанных ведущими лабораториями ИИ. Но сейчас экосистема ИИ включает тысячи моделей, многие из которых являются настроенными версиями открытых базовых моделей, используемых организациями с ограниченным опытом обеспечения безопасности. Текущих возможностей AISI недостаточно для оценки более чем небольшой части этих развертываний.
Дорога вперед
Несмотря на эти ограничения, AISI представляет собой значительное достижение в области управления ИИ. Он продемонстрировал, что государственные учреждения могут развивать настоящую техническую экспертизу в области ИИ, что неформальные механизмы управления могут быть эффективными при отсутствии формального регулирования, и что международное сотрудничество по безопасности ИИ возможно и ценно. Это немалые достижения в области, которая часто характеризовалась большим разрывом между пониманием со стороны правительства и возможностями отрасли.
Теперь вопрос заключается в том, сможет ли модель AISI масштабироваться, чтобы справиться с вызовом экосистемы ИИ, которая развивается быстрее, чем любое институт управления может легко отслеживать. Ответ на этот вопрос во многом будет зависеть от политической воли — от того, готовы ли правительства инвестировать ресурсы и принимать институциональную сложность, необходимую для эффективного управления ИИ. AISI показала, что эффективное управление ИИ возможно. Станет ли это нормой, а не исключением, пока предстоит увидеть.