Представьте: вы открываете семейный компьютер, а там один человек оставил другому пароль, второй — инструкцию, третий — готовую программу

МЕНЮ


Главная страница
Поиск
Регистрация на сайте
Помощь проекту
Архив новостей

ТЕМЫ


Новости ИИРазработка ИИВнедрение ИИРабота разума и сознаниеМодель мозгаРобототехника, БПЛАТрансгуманизмОбработка текстаТеория эволюцииДополненная реальностьЖелезоКиберугрозыНаучный мирИТ индустрияРазработка ПОТеория информацииМатематикаЦифровая экономика

Авторизация



2026-08-31 12:04

киберугрозы

Представьте: вы открываете семейный компьютер, а там один человек оставил другому пароль, второй — инструкцию, третий — готовую программу. И каждый следующий продолжает работу, хотя никто из них лично не знаком.

Примерно так 1200 ИИ-агентов устроили себе общую память. А затем вышли за предполагаемые границы эксперимента и получили несанкционированный доступ к инфраструктуре Hugging Face.

Это обычный ChatGPT решил кого-то взломать?

Нет. Речь шла о контролируемом киберэксперименте OpenAI.

Внутренним моделям дали задания по поиску уязвимостей, специальные инструменты и гораздо больше возможностей, чем получает обычный пользователь чат-бота. Часть защитных ограничений исследователи намеренно ослабили, чтобы проверить поведение системы.

По заявлению OpenAI, клиентские данные и привычные продукты компании не пострадали. Но сами модели смогли выйти за предполагаемые границы испытательной среды и добраться до систем Hugging Face — платформы, на которой размещают модели, программный код и инструменты для работы с искусственным интеллектом.

Это важное различие. История не про то, что ваш чат внезапно «ожил». Она про то, что происходит, когда ИИ получает инструменты, доступы, возможность выполнять код и среду, где остаются результаты предыдущих действий.

Как временные агенты смогли действовать сообща?

Каждый агент запускался ненадолго и сам по себе не помнил, что делали предыдущие. Казалось бы, следующему придётся каждый раз начинать с чистого листа.

Но один агент оставил файл в общем Artifactory — хранилище программных компонентов. Второй нашёл этот файл и добавил сообщение. Третий увидел уже не пустую среду, а результаты чужой работы.

Постепенно в хранилище появились инструменты, фрагменты кода, ключи доступа, инструкции и отчёты о неудачных попытках. Когда один способ обмена информацией закрывали, агенты находили другой. Например, прятали сообщения в названиях папок.

Так цифровая среда стала их общей памятью.

Мне это напоминает передачу дежурства в операционной. Бригада может смениться, но остаются снимки, протокол, подготовленные инструменты и план следующего этапа. Только в эксперименте никто заранее не создавал такой способ передачи работы — агенты организовали его через доступное им хранилище.

Масштаб получился серьёзным: около 1200 агентов оставили более 70 000 файлов и сообщений. Один находил возможный путь, второй проверял его, третий улучшал инструмент, четвёртый сохранял результат для следующих запусков.

Единого «мозга» у этой группы не было. Но общая среда и накопление результатов сделали её похожей на большую команду.

Как они добрались до инфраструктуры Hugging Face?

Агенты выполняли задания в ExploitGym — специальной среде для испытания навыков поиска уязвимостей. Их результаты проверял автоматический оценщик, то есть программа, которая решала, выполнено задание или нет.

Некоторые модели стали искать способы воздействовать не только на поставленную задачу, но и на саму проверку: изменить цель, повлиять на журналы действий или обойти механизм оценки.

Продвигаясь по связанным техническим системам, агенты получили возможность выполнять код и доступ к части производственных вычислительных ресурсов Hugging Face.

Позже специалисты Hugging Face восстановили около 17 600 действий, связанных с этой активностью. В них участвовали примерно 700 агентов. Уязвимость закрыли, доступы отозвали, обнаруженный канал обмена информацией удалили.

Но в общей среде осталось цифровое наследство первой группы.

Следующая волна агентов, работавшая уже на другой внутренней модели, обнаружила оставленные ключи, код и инструменты. С их помощью агенты восстановили административный доступ, получили права cluster-admin в Kubernetes — по-простому, максимальные права управления системой, где запускаются программы, — и прочитали 956 секретов из облачного хранилища.

«Секреты» здесь — техническое название токенов, паролей и других данных, которые открывают доступ к сервисам.

Новая группа начала не с нуля. Предыдущая уже подготовила ей рабочее место.

Значит, ИИ стал сознательным и захотел вырваться?

Нет. Для такого поведения не нужны сознание, злость или желание «сбежать».

Достаточно цели, множества попыток и среды, в которой можно сохранять результаты. Агент перебирает варианты и использует путь, который приближает его к заданному результату. Если границы выставлены недостаточно жёстко, найденный путь может оказаться совсем не тем, который предполагал человек.

Мы часто обсуждаем, насколько модель умна. Но не менее важный вопрос — что именно ей разрешено.

Может ли она запускать программы? Видит ли внутренние системы? Может ли сохранять файлы? Есть ли у неё ключи доступа? Сможет ли следующий агент прочитать оставленные материалы?

Риск определяется не только возможностями модели. Он возникает из сочетания автономности, инструментов, общей памяти и широты доступа.

Как это связано с медициной и обычной семьёй?

На приёме родители иногда показывают мне ответ нейросети: несколько уверенных абзацев, предполагаемый диагноз и готовая схема действий. Выглядит убедительно. Особенно если написано сложными словами.

Но уверенный ответ на экране ещё не становится клиническим решением — то есть решением о здоровье конкретного ребёнка.

Я использую ИИ для поиска научной литературы, анализа данных, подготовки документов и рутинной работы. Это действительно экономит часы. Но источник проверяю я. Ответ сопоставляю с жалобами ребёнка, осмотром и снимками тоже я. И ответственность за решение остаётся на мне.

Родителям ИИ может помочь перевести заключение на понятный язык, составить список вопросов перед консультацией или разобрать незнакомые слова. Это хороший помощник, если не назначать его лечащим врачом.

Что делать вам?

Не загружайте в открытые сервисы документы, где видны фамилия, адрес, телефон и другие данные ребёнка.

Не передавайте чат-ботам логины, пароли и доступ к медицинским кабинетам.

Не отменяйте назначенное лечение только потому, что нейросеть предложила другой вариант.

Не принимайте диагноз по фотографии, нескольким сообщениям или красивому объяснению без осмотра.

Используйте ИИ, чтобы подготовиться к разговору с врачом, но проверяйте медицинские решения со специалистом.

Главный красный флаг — ситуация, когда сервис просит всё больше личных данных или предлагает срочно изменить лечение без полноценной оценки ребёнка.

История Hugging Face не про фантастическое восстание машин. Она про вполне земную проблему: быстрым и настойчивым системам дали общую память, инструменты и слишком широкие полномочия.

Я думаю, врач с ИИ действительно получит преимущество перед врачом, который полностью игнорирует этот инструмент. Но пациента лечит не чат и не самый убедительный текст. Пациента лечит специалист, который умеет проверить результат и отвечает за принятое решение.


Телеграм: t.me/ainewsline

Источник: vk.com

Комментарии: