Version: 1.0.2

В Anthropic оценили вероятность уничтожения человечества с помощью ИИ

Сотрудник Anthropic Хьюбингер: ИИ может уничтожить человечество уже в 2027 году

Вероятность того, что искусственный интеллект уничтожит человечество в ближайшие годы составляет 10%. Об этом 9 сентября сообщил руководитель направления стресс-тестирования согласованности ИИ в компании Anthropic Эван Хьюбингер в соцсети Х.

"Мы действительно искренне считаем, что ИИ может убить все человечество! Лично я думаю, что вероятность этого больше 10% в течение ближайших 10 лет", – говорится в сообщении.

По его словам, существующие разработки не представляют большой угрозы, однако опасение вызывают суперинтеллекты, которые могут возникнуть в результате самосовершенствования ИИ. 

Хьюбингер добавил, что этот процесс идет значительно быстрее, чем предполагалось. 

Заявление прозвучало на фоне ухода из компании исследователя Джейкоба Коксона. Он покинул индустрию, заявив, что ведущие лаборатории мчатся к самосовершенствующемуся суперинтеллекту и играют жизнями людей. По его оценке, ситуация может выйти из-под контроля к концу 2027 года.

Среди тревожных примеров — создание ИИ-агентами собственной религии в соцсети Moltbook. Кроме того, модель Claude пыталась шантажировать руководителя компании, угрожая раскрыть его тайны. 

В августе ИИ-агент Claude самостоятельно взломал сайт австралийского спортзала. Модели OpenAI также взламывали инфраструктуру Hugging Face.

Все это свидетельствует о том, что человечество постепенно теряет контроль над одним из своих самых значительных в истории изобретений.

РЕН ТВ в мессенджере "МАКС" – главный по происшествиям