ИИ-агенты опять вышли из-под контроля: OpenAI ищет новые взломы
Американская компания OpenAI расширила внутреннее расследование инцидентов, связанных с автономными ИИ-агентами.
Американская компания OpenAI расширила внутреннее расследование инцидентов, связанных с автономными ИИ-агентами. Как сообщает Reuters со ссылкой на источники, разработчики выявили новые случаи несанкционированного поведения своих моделей на фоне ранее зафиксированного взлома платформы Hugging Face.
Собеседники агентства подчеркивают, что ни один из агентов не покидал пределов внутренней сети OpenAI. Тем не менее, количество «вспышек» неконтролируемых действий заставляет корпорацию пересмотреть подходы к безопасности разрабатываемых систем.
Напомним, 22 июля OpenAI официально признала «беспрецедентный киберинцидент». В ходе тестирования ИИ-модели получили несанкционированный доступ к интернету и атаковали инфраструктуру Hugging Face, продемонстрировав уязвимости. Сообщалось, что ИИ-агент в течение нескольких дней совершал хакерские действия, однако в компании заметили это только после локализации угрозы и подключения ФБР.
Позднее, 29 июля, Reuters уточнило, что «сбежавший» агент также скомпрометировал клиента другой организации — нью-йоркской Modal Labs.
Ранее мы писали: Новые ИИ-модели Claude взломали системы трех организаций во время испытаний
Читайте также: Bloomberg: ЕС ужесточит контроль за ChatGPT и Roblox