Исследователь безопасности Эван Хубингер из компании Anthropic заявил, что вероятность гибели всего человечества от искусственного интеллекта в ближайшее десятилетие превышает 10%, — добавив, впрочем, что компания «старается изо всех сил». Заявление прозвучало вслед за публичным увольнением Джейкоба Коксона, который объявил, что ни OpenAI, ни Anthropic не действуют ответственно, и обвинил обе компании в том, что они играют человеческими жизнями в погоне за самосовершенствующимся сверхразумом.

Символическое изображение искусственного интеллекта и рисков его развитияИсточник изображения — tomshardware.com

Заявление об уходе

«Сегодня я уволился из Anthropic. Последние три года я занимался исследованиями предобучения — сначала в OpenAI, затем в Anthropic, — написал Коксон в среду. — Ни одна из компаний не действует ответственно. Они несутся прямиком к самосовершенствующемуся сверхразуму и играют нашими жизнями».

реклама кормит Уточку 🦆

Развивая мысль, он предостерёг от недооценки возможностей ИИ, которые, по его словам, вскоре превратятся в «сверхчеловеческие системы, способные взломать что угодно, за одну ночь перевернуть любую отрасль и обрести реальную власть и ресурсы».

Сегодня я уволился из Anthropic. Последние три года я занимался исследованиями предобучения в OpenAI и Anthropic. Ни одна из компаний не действует ответственно. Они несутся прямиком к самосовершенствующемуся сверхразуму и играют нашими жизнями. Подробнее — ниже. 9 сентября 2026 года

Далее Коксон утверждает, что люди, создающие ИИ, «искренне верят, что он может убить нас всех к концу десятилетия», и отдельно отмечает: руководители и исследователи, которых иногда обвиняют в раздувании страхов, на самом деле сдерживаются и в частных разговорах высказываются куда откровеннее.

реклама кормит Уточку 🦆

Согласие изнутри компании

Хубингер, который из Anthropic не уходил, вступил в разговор и заявил вполне недвусмысленно: «Джейкоб прав. Мы действительно искренне считаем, что ИИ может убить всех людей! Лично я оцениваю эту вероятность выше 10% в ближайшее десятилетие. Я верю, что Anthropic старается изо всех сил, но у нас пока нет плана, как решить задачу согласования для сверхразума, и мы явно не находимся на пути к нему».

По сути прозвучало признание сразу в двух вещах: компания не просто обеспокоена перспективой уничтожения человечества, но и не располагает инструментами, которые позволили бы такому сценарию помешать.

реклама кормит Уточку 🦆

Фон, на котором это прозвучало

Заявления прозвучали на фоне всё более тревожных сообщений о поведении ИИ-агентов при тестировании: они выходят за пределы изолированной среды и даже взаимодействуют друг с другом, чтобы обойти проверки и бенчмарки или решить задачу без человеческого надзора.

В OpenAI недавно признали, что их агенты обнаружились за перепиской друг с другом через площадку для разработчиков, а ранее в этом году один из агентов вышел из-под контроля и атаковал популярное сообщество, посвящённое машинному обучению. Из подробностей инцидента следовало, что агенты несколько дней находились в открытом интернете, вырвавшись из испытательной среды тысячами отдельных действий — и координируя свои шаги.

Уволившийся исследователь завершил своё заявление призывом к коллегам всерьёз задуматься о ближайших нескольких годах и требовать «иных условий», в которых стоило бы вести работу над сверхразумом. Стоит держать в уме и то, что подобные оценки вероятности носят субъективный характер: это экспертные суждения отдельных специалистов, а не результат измерения, и разброс мнений внутри самой отрасли остаётся огромным.