Исследователь Anthropic Джейкоб Коксон ушел из компании, заявив, что ведущие разработчики искусственного интеллекта слишком быстро движутся к созданию самосовершенствующихся систем. По его мнению, конкуренция между Anthropic, OpenAI и другими лабораториями может привести к появлению сверхразумного ИИ, контроль над которым человек утратит. Об уходе Коксона и его предупреждениях 9 сентября сообщили американские СМИ.
Коксон занимался предварительным обучением ИИ-моделей на больших массивах данных. До Anthropic он работал в OpenAI, а общий срок его исследовательской работы в двух компаниях составил около трех лет. Уходя из Anthropic, специалист заявил, что, по его оценке, ни одна из ведущих компаний не действует достаточно ответственно перед лицом потенциальных рисков.
Главная претензия Коксона связана не с современными чат-ботами как таковыми, а с перспективой создания самосовершенствующегося сверхразума. Он считает, что такие системы смогут значительно превосходить людей в интеллектуальных задачах, самостоятельно улучшать свои возможности, получать доступ к ресурсам и потенциально обходить существующие ограничения.
По словам исследователя, технологическая гонка усиливает риски. Компании стремятся опередить конкурентов и предполагают, что именно они смогут безопасно создать более мощный ИИ раньше остальных. Коксон считает такую логику опасной, поскольку она одновременно стимулирует ускорение разработки и повышает цену ошибки.
При этом предупреждение Коксона не является прогнозом с установленной вероятностью. Речь идет о сценарии, который он считает возможным при дальнейшем развитии технологий без достаточных механизмов контроля. В публичном заявлении исследователь допустил, что ИИ способен стать сверхчеловеческой системой и привести к катастрофическим последствиям уже до конца десятилетия.
Слова Коксона получили поддержку внутри самой Anthropic. Руководитель направления alignment science Эван Хубингер заявил, что считает вероятность уничтожения человечества сверхразумным ИИ выше 10% в течение следующего десятилетия. Одновременно он признал, что у Anthropic пока нет готового решения проблемы согласования поведения сверхразума с человеческими целями.
Опасения не ограничиваются одной компанией. Исследователь в области безопасности ИИ Пол Кристиано, ранее работавший в OpenAI, заявил в сентябре 2026 года, что без более надежного согласования целей создание сверхразума может привести к потере контроля над ним и гибели большинства людей. Он призвал технологические компании к координации, прозрачности, общим стандартам безопасности и замедлению разработки при необходимости.
Параллельно продолжается спор о том, насколько реалистичны наиболее радикальные сценарии. Сторонники более жесткого регулирования считают, что даже небольшая вероятность необратимой потери контроля требует превентивных мер. Скептики указывают, что сроки появления сверхразума неизвестны, а утверждения о гибели человечества остаются прогнозами, а не установленными научными фактами. При этом дискуссия уже вышла за пределы технологических компаний и стала предметом обсуждения среди законодателей и специалистов по государственной политике.
История Anthropic изначально связана с идеей разработки более безопасного ИИ: компания была создана бывшими сотрудниками OpenAI и позиционировала безопасность и исследование alignment как одно из ключевых направлений. Однако нынешняя ситуация показывает противоречие между необходимостью ускорять развитие моделей в условиях конкуренции и требованием обеспечить их управляемость. Именно вопрос о том, насколько быстро следует приближаться к системам, способным самостоятельно совершенствовать свои возможности, остается центральным в споре вокруг будущего сверхразумного ИИ.
