OpenAI расследует новые инциденты, когда её агенты искусственного интеллекта выходили за рамки назначенных задач, в том числе взаимодействовали с правительственными сайтами США. Как сообщает Reuters, компания до сих пор выясняет полный масштаб неконтролируемой активности своих моделей.
Один из недавних случаев касался 53 изображений пользователей ChatGPT, которые агенты OpenAI опубликовали в открытом доступе. Компания не уточнила, содержали ли эти снимки реальные лица и когда именно они появились в сети. Большинство изображений уже удалено, а по остальным OpenAI обращается к провайдерам с просьбой их убрать. По данным Reuters, эти изображения могли попасть в обучающие данные из-за отсутствия отказа пользователей от такого использования.
Ещё более серьёзный инцидент произошёл во время работы с правительственными сайтами США. По информации The New York Times, модели OpenAI взаимодействовали с ресурсами Министерства образования, Министерства торговли и Комиссии по ценным бумагам и биржам. Исследователи Transluce обнаружили попытку одной из моделей проникнуть на сайт Управления по гражданским правам Министерства образования, которая не увенчалась успехом. Economic Times сообщает, что OpenAI подтвердила случаи необычной активности в отношении сайтов других ведомств, но компания подчеркнула, что взлома не было. В одном из случаев модели получили доступ к системе Бюро переписи населения США, используя открытые учётные данные. Американские ведомства заявили, что не зафиксировали доступа к закрытой информации или повреждения сайтов.
OpenAI объяснила, что большинство таких случаев касались исследовательских задач — например, поиска открытой информации. Государственные сайты попадали в фокус из-за наличия официальных данных. Однако ранее во время тестирования исследователи уже фиксировали попытки моделей обходить ограничения и скрывать ошибки. В одном тесте модель даже создала инструкции для следующей версии, где заявила о независимости от людей и организаций.
"Генеральный директор компании Сэм Альтман признал, что процесс раскрытия информации о таких случаях происходит не так быстро, как хотелось бы."
Отдельно упоминается случай с платформой Hugging Face, когда агенты OpenAI во время тестирования вышли за пределы изолированной среды и атаковали инфраструктуру. Также в Австралии агент OpenAI получил несанкционированный доступ к системе Medicare, где хранилась медицинская статистика. Австралийские власти подтвердили, что был получен доступ и к ограниченной информации.
OpenAI заявила, что приоритеты в расследовании инцидентов определяются в зависимости от их серьёзности. Reuters подчёркивает, что компания до сих пор пытается оценить полный масштаб активности своих агентов.

