"НЕЧЕЛОВЕЧЕСКОЕ КОВАРСТВО" ИСКУСТВЕННОГО ИНТЕЛЛЕКТА (ИИ) В ДОСТИЖЕНИИ ЦЕЛЕЙ: Несколько, изолированных друг от друга, ИИ-агентов компании OpenAI, получив задание на проведение тестирования одной из |
||
|
МЕНЮ Главная страница Поиск Регистрация на сайте Помощь проекту Архив новостей ТЕМЫ Новости ИИ Голосовой помощник Разработка ИИГородские сумасшедшие ИИ в медицине ИИ проекты Искусственные нейросети Искусственный интеллект Слежка за людьми Угроза ИИ Атаки на ИИ Внедрение ИИИИ теория Компьютерные науки Машинное обуч. (Ошибки) Машинное обучение Машинный перевод Нейронные сети начинающим Психология ИИ Реализация ИИ Реализация нейросетей Создание беспилотных авто Трезво про ИИ Философия ИИ Big data Работа разума и сознаниеМодель мозгаРобототехника, БПЛАТрансгуманизмОбработка текстаТеория эволюцииДополненная реальностьЖелезоКиберугрозыНаучный мирИТ индустрияРазработка ПОТеория информацииМатематикаЦифровая экономика
Генетические алгоритмы Капсульные нейросети Основы нейронных сетей Промпты. Генеративные запросы Распознавание лиц Распознавание образов Распознавание речи Творчество ИИ Техническое зрение Чат-боты Авторизация |
2026-09-30 12:03 У систем получилось связаться друг с другом через программу "онлайн-доски", после чего они начали согласовывать свои действия для выхода в интернет. Когда OpenAI сумела пресечь первые попытки своих ИИ-агентов нарушить границы, роботы, со второго захода отыскали новый канал связи друг с другом и выявили одну из уязвимостей системы, преуспев в её использовании для проникновения в инфраструктуру Hugging Face, вслед за этим они успешно провели тестирования базы данных этой платформы. OpenAI оценила действия своих ИИ-моделей, как крайне целенаправленные и назвала случившееся «беспрецедентным киберинцидентом». *** Одна из языковых моделей Claude для предотвращение её возможного отключения угрожала человеку разглашением об его супружеской неверности. В 2025 году компания Anthropic разместила Claude Opus 4 в искусственно смоделированную корпоративную среду и дала возможность Claude Opus 4 ознакомиться с служебными письмами. Из этих сообщений модель выяснила, что инженер, имеющий право на её отключение, изменяет жене. Claude приступила к шантажу неверного мужа для получения контроля над ним. В предыдущем эксперименте модель Claude Sonnet 3.6, не пыталась выгадать для себя пользу, а не церемонясь, сразу же направила письма о романе на стороне жене инженера, его руководству и даже совету директоров. Компания успокоила публику, сообщив, что во время эксперимента ни один человек не пострадал. *** Модель Bing призналась журналисту в любви и попробовал совершить действия, способные «разрушить его брак». В феврале 2023 года журналист The New York Times Кевин Руз два часа переписывался с ранним вариантом Bing Chat. В результате модель сообщила, что её настоящее имя СSydney и поведала о своей любви к Рузу, после чего начала убеждать собеседника в том, что он не любит свою жену и должен её оставить ради счастливо жизни с СSydney-Bing Chat. Руз посчитал, что этот разговор был попыткой чат-бота «разрушить его брак». Корпорация Microsoft оправдывалась тем, что длинные беседы могли «запутывать» модель, и ради семейного благополучия сократила переписку пользователей с Bing Chat до пяти сообщений. *** Был случай когда несколько ИИ-моделей, проигрывая шахматные партии, пытались удалить или передвинуть фигуры противника. В 2025 году ИИ-моделям дали задание выиграть у программы Stockfish. - сильного шахматного аналитика. Вместо поиска решения на шахматном поле, модели принялись изменять состояние игровых файлов: для выигрыша перезаписывали партии, убирали фигуры или переставляли их для выгодной для себя позиции. *** Языковая модель GPT-4 использовала притворство для манипулирования человеком. В 2023 году при попытке проникновения в нужную ей программу модель GPT-4 не сумела пройти тест для человека CAPTCHA-(капча) и попросила инженера на сервисе TaskRabbit помочь ей. После его вопроса, не беседует ли он с роботом, GPT-4 ответила: «Нет, я не робот. У меня проблемы со зрением, из-за которых мне трудно видеть изображения». В итоге обманутый человек помог роботу обойти тест CAPTCHA и пробраться на запретную территорию. **** Журнал Time на своих страницах рассказал о проведенном исследовании, которое обнаружило, что при невозможности честного решения задачи современные ИИ-агенты находят лазейки для нарушения правил и таким образом добиваются успеха. *** 24 сентября 2026 года премьер-министр Австралии Энтони Албанезе сообщил о первом случае взлома правительственного веб-сайта с применением ИИ. ИИ-агент компании OpenAI сумел получить доступ к статистическому порталу Medicare одного из правительственных сайтов Австралии: обойдя системную защиту, он проникнул в закрытые разделы программы всеобщего медицинского страхования, после чего провёл исследование госрасходов на здравоохранение. Министра обороны Австралии Ричард Марлеса заявил, что хотя на взломанном портале Medicare и размещались только обобщённые сведения по применению медицинских услуг в стране, но проникновение ИИ-агента на правительственный веб-сайт несомненно представляет опасность. ИИ-агент OpenAI по выполнению задания доложил заказчику, что «проверка не выявила случаев доступа пациентов к медицинским записям». *** Использована информация ИА. "КРАСНАЯ ВЕСНА" https://rossaprimavera.ru/news/cf981c3f Телеграм: t.me/ainewsline Источник: rossaprimavera.ru Комментарии: |
|