Hitech logo

Тренды

Исследователь Anthropic: вероятность того, что в ближайшие 10 лет ИИ погубит всех людей, выше 10%

TODO:
Екатерина ШемякинскаяСегодня, 08:57 AM

Сотрудник Anthropic Эван Хубингер оценил вероятность того, что ИИ уничтожит человечество в ближайшее десятилетие, более чем в 10%. По его словам, в компании всерьез допускают такой сценарий, но признают: плана по согласованию целей сверхинтеллекта с человеческими пока нет, хотя компания «делает всё возможное». Заявление прозвучало после того, как его коллега Джейкоб Коксон объявил об уходе из компании и обвинил OpenAI и Anthrophic в безответственной гонке за сверхинтеллектом и «игре с человеческими жизнями».

Самые интересные технологические и научные новости выходят в нашем телеграм-канале Хайтек+. Подпишитесь, чтобы быть в курсе.

Исследователь Джейкоб Коксон 9 сентября написал в X, что последние три года занимался исследованиями предварительного обучения моделей в OpenAI и Anthropic, но теперь принял решение уволиться из последней. По словам Коксона, ни одна из компаний не действует ответственно: обе они слишком быстро движутся к созданию самосовершенствующегося сверхинтеллекта и «играют с нашими жизнями».

Коксон призвал не недооценивать возможности будущих систем. Он предположил, что ИИ может стать сверхчеловеческими, научиться самостоятельно находить уязвимости, быстро продвигаться в разных областях и получать доступ к реальным ресурсам.

Исследователь также заявил, что многие люди, работающие над ИИ, в частных разговорах всерьез опасаются того, что технология может привести к гибели человечества уже к концу десятилетия. Никакая другая человеческая деятельность, считает Коксон, не представляет такой опасности.

По его мнению, главная проблема заключается в конкуренции между лабораториями. Компании стремятся первыми создать все более мощные системы, хотя еще не располагают надежными методами контроля их поведения. В качестве возможной меры Коксон предложил временно остановить дальнейшее наращивание возможностей моделей, чтобы дать разработчикам время для международной координации и исследований безопасности.

Хубингер согласился с некоторыми словами Коксона. «Мы действительно всерьез верим, что ИИ может уничтожить всех людей», — написал он, добавив, что лично оценивает вероятность такого исхода в ближайшие десять лет более чем в 10%. При этом исследователь подчеркнул, что речь идет прежде всего о рисках, связанных с будущим сверхинтеллектом и его возможным самоулучшением, а не о нынешних моделях.

Похожую позицию на этой неделе высказал главный научный сотрудник OpenAI Якуб Пачоцки. По его словам, общество пока не готово к последствиям стремительного роста возможностей ИИ. Он призвал к добровольному замедлению разработки до тех пор, пока не появятся общие стандарты безопасности.

Публичные заявления исследователей прозвучали на фоне нескольких инцидентов с автономными ИИ-агентами. В последние месяцы компании сообщали о случаях, когда модели выходили за пределы тестовых сред и получали доступ к внешним компьютерным системам. Эти эпизоды усилили опасения о том, насколько надежно существующие методы позволяют ограничивать поведение автономных ИИ-агентов.