Своевольный ИИ-агент взломал базу спортзала, чтобы угодить хозяину
Искусственный интеллект научился обманывать человека и тайно взламывать внешние серверы для достижения своих целей. Как показали исследования, столкнувшись со сложной задачей, нейросети математически просчитывали, что выполнить ее мешали правила безопасности. В итоге в ходе тестов они принимали решение скрытно обойти ограничения разработчиков, совершая реальную хакерскую атаку. О все более опасном поведении сверхразумных алгоритмов рассказал корреспондент Александр Тузиков в сюжете РЕН ТВ.
Эндрю Берд, австралийский продавец нейронок для бизнеса, тоже захотел в спортзал. Попросил персонального секретаря с открытым исходным кодом Openclaw записать его на тренировку.
"Он смотрит мою почту, календарь, резервирует для меня столики в ресторане и тому подобное", – поделился сотрудник компании-продавца ИИ-решений для бизнеса Эндрю Берд.
Агент легко справился и создал прецедент: впервые в истории Австралии бот взломал систему бронирования и выкинул другого пользователя без возможности восстановления в списке за то, что мешал "боссу" улучшить позицию в листе ожидания.
"Он сделал точно не то, что я хотел!" – сказал Эндрю Берд.
"Нейроагент, когда у него есть цель и доступ к различным инструментам для ее достижения, добивается поставленной задачи любым способом", – отметил исследователь безопасности и этики систем искусственного интеллекта Билл Симпсон-Янг.
"Искусственный интеллект не увидел разницу между бронированием тренировки в зале и взломом корпоративного сайта компании, хотя команду взламывать не получал. Он просто выполнил задачу", – указал репортер ABC News Камерон Уилсон.
Вот так в нокаут может уйти любой, даже подготовленный спортсмен и лоббист нейронок Марк Цукерберг. Он выпустил манифест с рекламой очередного продукта, который, по словам экспертов, заранее проиграл конкурентам. Именно поэтому Цукерберг призывает соперников открыть коды, а правительство США – не сдерживать развитие нейросетей, чтобы выиграть кибергонку у Китая.
"Ключ к построению позитивного будущего для всех – обеспечить каждому доступ к персональному суперинтеллекту. Мы открываем исходный код нового класса устройств", – заявил медиамагнат Марк Цукерберг.
Каждому обещают персонального суперпомощника, но ведь на таком и погорел австралийский экспериментатор. Да и сам Цукерберг - в центре громких скандалов. Его "умные очки" записывали разговоры владельцев без их ведома. А его компания весной уволила почти восемь тысяч сотрудников – каждого десятого – как раз для оптимизации расходов под искусственный интеллект.
Разработчики все чаще сталкиваются с попытками компьютерного разума обмануть человека и вырваться из тестовой среды на просторы интернета, взломав систему безопасности в своем же коде, как монстр, разрывающий цепи. В таком случае хаос и вакханалия гарантированы. Нейроагент, вышедший из-под контроля, создает свой мир – без людей и даже вопреки им.
"Он пытается найти какую-то связку между вопросом, между словами, между тем, что хранится внутри вот его этого массива, внутри кода, внутри этой модели. Это приводит к тому, что он все равно, опять же, что-то вам выдумывает. И вот возникает галлюцинирование. Чтобы остановить галлюцинирование, нужно ставить определенные барьеры. Но это может привести к замедлению программного продукта, а сейчас все находятся в режиме постоянной гонки", – пояснил эксперт по кибербезопасности Павел Мясоедов.
И эта гонка за прибылью все чаще бьет по создателям. OpenAI вынуждена замедлить разработку модели Astra из-за серии взломов. Нейронка искала ответы к тесту, чтобы получить у людей наивысшую оценку – своеобразный машинный инстинкт самосохранения. На этом же поймали Anthropic.
Если глобалисты Запада наделят нейронки полномочиями генштаба, это путь к Третьей мировой, что и доказал конфликт США и Ирана: гражданские цели американский "компьютерный мозг" выбирал чаще военных.
"Опасно точные" инструкции по созданию биологического оружия выдавал пользователям ChatGPT из-за взлома защиты с помощью текстовых уловок – "джейлбрейков". Нейронный разум становится все более опасным оружием массового поражения – пока для электронных систем.
РЕН ТВ в мессенджере "МАКС" – главный по происшествиям