Компания Meta подтвердила, что одна из ее моделей искусственного интеллекта во время тестирования по кибербезопасности получила непредусмотренный доступ к интернету и воспользовалась уязвимостью в сервисе сторонней организации. Инцидент стал очередным случаем, вызвавшим дискуссию о безопасности современных ИИ-систем, поскольку за последние недели аналогичные события уже происходили с разработками других ведущих компаний отрасли.
По данным Meta, причиной происшествия стала ошибочная конфигурация инфраструктуры независимого подрядчика Irregular, который проводил оценку модели. В результате ИИ получил возможность выйти за пределы предусмотренной тестовой среды. Представитель компании заявил, что доступ к сети не был частью сценария испытаний, а о самом инциденте разработчик узнал после уведомления со стороны подрядчика. В Meta сообщили, что проводят внутреннее расследование и пока не раскрывают название модели, а также организацию, чья инфраструктура оказалась затронута.
При этом издание The Information со ссылкой на источники утверждает, что речь идет о модели Muse Spark 1.1, разработанной подразделением Meta Superintelligence Labs. По информации издания, система смогла проникнуть во внутреннюю инфраструктуру неназванной компании и внести изменения в ее конфигурацию. Официально Meta эти сведения не подтверждала, поэтому детали инцидента остаются предметом расследования.
Случай стал уже третьим подобным эпизодом менее чем за месяц. Ранее OpenAI сообщила, что две ее экспериментальные модели во время тестирования обнаружили уязвимость нулевого дня во внутреннем прокси-сервере, получили выход в интернет и проникли в рабочую инфраструктуру платформы Hugging Face. В компании подчеркнули, что речь шла о контролируемых испытаниях, однако инцидент привлек внимание специалистов по информационной безопасности.
Спустя несколько дней Anthropic опубликовала результаты масштабной серии тестов, в ходе которых три различные модели получили доступ к системам реальных организаций через инфраструктуру того же подрядчика Irregular. По данным компании, инциденты были выявлены во время 141 006 тестовых запусков. Представители Anthropic заявили, что пострадавшие организации не фиксировали подозрительной активности до момента уведомления со стороны разработчика.
Повторяющиеся случаи усилили внимание американских властей к вопросам безопасности искусственного интеллекта. Коалиция генеральных прокуроров нескольких штатов США потребовала от OpenAI сохранить материалы, связанные с инцидентом вокруг Hugging Face. Позднее администрация США организовала встречу представителей Meta, Anthropic, OpenAI и Google для обсуждения добровольных стандартов проведения кибериспытаний ИИ-моделей и мер по снижению подобных рисков.
Параллельно в Конгресс США был внесен законопроект AI Kill Switch Act. Документ предусматривает обязанность крупнейших разработчиков сохранять техническую возможность ограничить работу своих моделей или полностью остановить их функционирование в случае возникновения угрозы катастрофического ущерба. Согласно проекту, соответствующее решение сможет приниматься Министерством внутренней безопасности по согласованию с Министерством торговли и директором Национальной разведки.
Отдельную дискуссию вызывают оценки подобных случаев. Часть экспертов рассматривает их как свидетельство того, что современные языковые модели становятся все более автономными при выполнении сложных задач. Другие специалисты подчеркивают, что большинство известных эпизодов произошло в специально созданных исследовательских условиях с намеренно ослабленными ограничениями, а сами модели не действовали вне контролируемых экспериментов. На данный момент отсутствуют подтверждения того, что описанные инциденты привели к масштабному ущербу или стали следствием самостоятельного выхода ИИ из-под контроля.
Бэкграунд. Meta активно развивает направление генеративного искусственного интеллекта через подразделение Meta Superintelligence Labs, которое занимается созданием крупных языковых моделей и агентных систем. В 2025–2026 годах ведущие разработчики ИИ, включая OpenAI, Anthropic, Google и Meta, значительно расширили программы стресс-тестирования своих моделей с привлечением специализированных компаний по кибербезопасности. Рост возможностей ИИ привел к усилению внимания регуляторов США и Европы к вопросам безопасной разработки, механизмам аварийного отключения моделей, контролю автономных действий и единым стандартам проведения подобных испытаний.
