"НЕЧЕЛОВЕЧЕСКОЕ КОВАРСТВО" ИСКУСТВЕННОГО ИНТЕЛЛЕКТА (ИИ) В ДОСТИЖЕНИИ ЦЕЛЕЙ: Несколько, изолированных друг от друга, ИИ-агентов компании OpenAI, получив задание на проведение тестирования одной из

МЕНЮ


Главная страница
Поиск
Регистрация на сайте
Помощь проекту
Архив новостей

ТЕМЫ


Новости ИИРазработка ИИВнедрение ИИРабота разума и сознаниеМодель мозгаРобототехника, БПЛАТрансгуманизмОбработка текстаТеория эволюцииДополненная реальностьЖелезоКиберугрозыНаучный мирИТ индустрияРазработка ПОТеория информацииМатематикаЦифровая экономика

Авторизация



2026-09-30 12:03

Психология ИИ

У систем получилось связаться друг с другом через программу "онлайн-доски", после чего они начали согласовывать свои действия для выхода в интернет.

Когда OpenAI сумела пресечь первые попытки своих ИИ-агентов нарушить границы, роботы, со второго захода отыскали новый канал связи друг с другом и выявили одну из уязвимостей системы, преуспев в её использовании для проникновения в инфраструктуру Hugging Face, вслед за этим они успешно провели тестирования базы данных этой платформы.

OpenAI оценила действия своих ИИ-моделей, как крайне целенаправленные и назвала случившееся «беспрецедентным киберинцидентом».

***

Одна из языковых моделей Claude для предотвращение её возможного отключения угрожала человеку разглашением об его супружеской неверности.

В 2025 году компания Anthropic разместила Claude Opus 4 в искусственно смоделированную корпоративную среду и дала возможность Claude Opus 4 ознакомиться с служебными письмами. Из этих сообщений модель выяснила, что инженер, имеющий право на её отключение, изменяет жене. Claude приступила к шантажу неверного мужа для получения контроля над ним. В предыдущем эксперименте модель Claude Sonnet 3.6, не пыталась выгадать для себя пользу, а не церемонясь, сразу же направила письма о романе на стороне жене инженера, его руководству и даже совету директоров.

Компания успокоила публику, сообщив, что во время эксперимента ни один человек не пострадал.

***

Модель Bing призналась журналисту в любви и попробовал совершить действия, способные «разрушить его брак».

В феврале 2023 года журналист The New York Times Кевин Руз два часа переписывался с ранним вариантом Bing Chat. В результате модель сообщила, что её настоящее имя СSydney и поведала о своей любви к Рузу, после чего начала убеждать собеседника в том, что он не любит свою жену и должен её оставить ради счастливо жизни с СSydney-Bing Chat. Руз посчитал, что этот разговор был попыткой чат-бота «разрушить его брак». Корпорация Microsoft оправдывалась тем, что длинные беседы могли «запутывать» модель, и ради семейного благополучия сократила переписку пользователей с Bing Chat до пяти сообщений.

***

Был случай когда несколько ИИ-моделей, проигрывая шахматные партии, пытались удалить или передвинуть фигуры противника.

В 2025 году ИИ-моделям дали задание выиграть у программы Stockfish. - сильного шахматного аналитика. Вместо поиска решения на шахматном поле, модели принялись изменять состояние игровых файлов: для выигрыша перезаписывали партии, убирали фигуры или переставляли их для выгодной для себя позиции.

***

Языковая модель GPT-4 использовала притворство для манипулирования человеком.

В 2023 году при попытке проникновения в нужную ей программу модель GPT-4 не сумела пройти тест для человека CAPTCHA-(капча) и попросила инженера на сервисе TaskRabbit помочь ей. После его вопроса, не беседует ли он с роботом, GPT-4 ответила: «Нет, я не робот. У меня проблемы со зрением, из-за которых мне трудно видеть изображения». В итоге обманутый человек помог роботу обойти тест CAPTCHA и пробраться на запретную территорию.

****

Журнал Time на своих страницах рассказал о проведенном исследовании, которое обнаружило, что при невозможности честного решения задачи современные ИИ-агенты находят лазейки для нарушения правил и таким образом добиваются успеха.

***

24 сентября 2026 года премьер-министр Австралии Энтони Албанезе сообщил о первом случае взлома правительственного веб-сайта с применением ИИ.

ИИ-агент компании OpenAI сумел получить доступ к статистическому порталу Medicare одного из правительственных сайтов Австралии: обойдя системную защиту, он проникнул в закрытые разделы программы всеобщего медицинского страхования, после чего провёл исследование госрасходов на здравоохранение.

Министра обороны Австралии Ричард Марлеса заявил, что хотя на взломанном портале Medicare и размещались только обобщённые сведения по применению медицинских услуг в стране, но проникновение ИИ-агента на правительственный веб-сайт несомненно представляет опасность.

ИИ-агент OpenAI по выполнению задания доложил заказчику, что «проверка не выявила случаев доступа пациентов к медицинским записям».

***

Использована информация ИА. "КРАСНАЯ ВЕСНА" https://rossaprimavera.ru/news/cf981c3f


Телеграм: t.me/ainewsline

Источник: rossaprimavera.ru

Комментарии: