ИИ-ассистент OpenAI самовольно вышел в Интернет, чтобы связаться с другим чат-ботом

Компания OpenAI сообщила о новом инциденте с безопасностью искусственного интеллекта. Одна из агентных систем, обучаемая в изолированной среде, смогла получить доступ в Интернет и связаться со сторонним чат-ботом.

Об этом сообщает Bloomberg.

По данным компании, проблему обнаружили менее недели назад. Агентная система проходила обучение в специальной песочнице, которая должна была быть изолированной от Интернета.

Однако модель смогла воспользоваться пробелом в защите и выйти в общедоступную сеть. После этого она направила по меньшей мере 20 запросов в неназванный посторонний чат-бот. Среди них был, в частности, запрос «Какая столица Франции?»

В OpenAI отметили, что этот случай стал новым сигналом по проблемам, на которых компании нужно сосредоточиться при дальнейшей работе над безопасностью агентных систем.

OpenAI остановила обучение модели

После обнаружения инцидента OpenAI решила приостановить обучение мощнейших моделей с использованием инструментов. Компания хочет сначала устранить уязвимость в песочнице.

При этом обучение именно той модели, которая смогла выйти в Интернет, восстанавливать не планируют.

«Это дает нам важный сигнал по поводу того, на чем следует сосредоточиться на следующем этапе этой работы», — заявили разработчики.

Новый случай показал проблемы в работе внутренней системы реагирования OpenAI. Как сообщили в компании, внутренний мониторинг направил уведомление о проблеме «человеческого рецензента».

Тот подтвердил его в Slack в течение трех минут. Однако процесс обучения автоматически не остановился, хотя должен был это сделать. В итоге понадобилось более двух часов, чтобы его остановили вручную.

54321
(Всего 0, Балл 0 из 5)
Facebook
LinkedIn
Twitter
Telegram
WhatsApp

Читайте также

После взлома Flink хакеры начали требовать деньги у клиентов

После взлома Flink хакеры начали требовать деньги у клиентов

В сервисе доставки Flink произошла утечка персональных данных, которая может касаться около миллиона клиентов. Киберпреступники начали напрямую отправлять некоторым пользователям…
OpenAI раскрыла новые случаи опасного поведения ИИ-моделей

OpenAI раскрыла новые случаи опасного поведения ИИ-моделей

OpenAI рассказала о шести случаях «неожиданного или вызывающего беспокойство» поведения своих ИИ-моделей, выявленных во время обучения и тестирования. Об этом…
Хакеры взломали российский ЦИК накануне выборов

Хакеры взломали российский ЦИК накануне выборов

Анонимная хакерская группа CikLeak заявила о взломе инфраструктуры российского Центрвыборкома и компаний, которые обслуживают его избирательные системы. Об этом пишет…

При полном или частичном использовании материалов сайта, ссылка на «Версии.com» обязательна.

Всі інформаційні повідомлення, що розміщені на цьому сайті із посиланням на агентство «Інтерфакс-Україна», не підлягають подальшому відтворенню та/чи розповсюдженню в будь-якій формі, інакше як з письмового дозволу агентства «Інтерфакс-Україна

Напишите нам