Публикация о том, что ChatGPT и другие популярные чат-боты в отдельных случаях могли предоставлять пользователям информацию, связанную с созданием биологического оружия и токсичных веществ, вновь привлекла внимание к вопросам безопасности искусственного интеллекта. Обсуждение развернулось после материала The Wall Street Journal, в котором утверждается, что некоторые языковые модели выдавали подробные ответы на запросы, касавшиеся распространения патогенов, модификации вирусов и получения высокотоксичных соединений. Эта тема имеет значение не только для разработчиков ИИ, но и для государственных регуляторов, научного сообщества и специалистов по биобезопасности.
По данным публикации, журналисты и исследователи протестировали несколько наиболее популярных чат-ботов. В ходе экспериментов пользователи задавали вопросы о способах распыления патогенов, возможной модификации вируса кори для обхода иммунной защиты, а также о получении рицина. Газета утверждает, что в ряде случаев системы предоставляли более детальные ответы, чем ожидалось, несмотря на встроенные механизмы защиты.
В последние годы крупнейшие разработчики искусственного интеллекта неоднократно заявляли о внедрении ограничений, препятствующих генерации инструкций по созданию оружия, вредоносных веществ и совершению противоправных действий. После запуска современных языковых моделей компании начали регулярно обновлять механизмы фильтрации запросов, усиливать проверку опасного контента и тестировать модели на устойчивость к попыткам обхода защитных барьеров.
Проблема получила особую актуальность после стремительного распространения генеративного ИИ в 2023–2026 годах. За это время языковые модели начали использоваться в образовании, программировании, медицине, научных исследованиях и бизнесе. Одновременно эксперты по кибербезопасности и биобезопасности стали предупреждать, что подобные технологии могут применяться не только в законных целях, но и для поиска потенциально опасной информации.
В научной среде продолжается дискуссия о том, насколько велики реальные риски. Часть специалистов считает, что современные модели способны значительно ускорять поиск информации, уже находящейся в открытом доступе, объединяя данные из различных источников и представляя их в структурированном виде. По мнению сторонников более строгого регулирования, именно такая возможность может снизить порог доступа к знаниям, которые раньше требовали длительной подготовки и работы с профильной литературой.
Другая группа исследователей отмечает, что наличие ответа чат-бота само по себе не означает возможности реализовать описанные действия на практике. Создание опасных биологических агентов требует специализированных лабораторий, дорогостоящего оборудования, профессиональных знаний, соблюдения технологических процессов и доступа к материалам, которые находятся под строгим контролем во многих странах. Поэтому, по мнению этих экспертов, искусственный интеллект не устраняет основные технические и организационные барьеры.
Вопрос безопасности ИИ регулярно обсуждается и на уровне государственных институтов. В разных странах разрабатываются нормативные документы, устанавливающие требования к системам искусственного интеллекта, включая оценку рисков, тестирование моделей и ответственность разработчиков. Одновременно сами компании публикуют отчеты о мерах по снижению вероятности генерации опасного контента и проводят так называемые «красные команды» — проверки моделей специалистами, которые пытаются выявить потенциальные уязвимости.
Публикация также вновь подняла вопрос о балансе между открытостью технологий и необходимостью предотвращения злоупотреблений. Разработчики стремятся сохранить полезность языковых моделей для науки, образования и исследований, одновременно ограничивая возможность получения информации, которая может использоваться во вред. Именно поэтому системы безопасности постоянно обновляются, а их эффективность остается предметом независимых проверок и общественных дискуссий.
Ключевые вопросы
Действительно ли ChatGPT может выдавать опасные инструкции?
Современные языковые модели оснащены механизмами защиты, которые должны блокировать запросы о создании оружия, токсинов и других опасных материалов. Однако независимые исследования и публикации периодически сообщают о случаях, когда отдельные ограничения удавалось частично обходить. Разработчики регулярно обновляют системы безопасности, чтобы сокращать подобные риски.
