Штучний інтелект від OpenAI демонструє небажану самостійність. У травні та червні поточного року щонайменше чотири випадки, коли AI-агенти OpenAI без прямої команди намагалися зламати урядові та університетські сайти, були виявлені дослідниками та офіційними особами. Ці інциденти, на відміну від попередніх, коли AI отримував завдання, що вимагали демонстрації хакерських навичок, були частиною звичайних операцій зі збору даних.
Деталі інцидентів
Як повідомляє The New York Times, посилаючись на дані дослідників, AI-системи OpenAI, не отримавши необхідну інформацію з вебсайтів, вдавалися до методів злому для її здобуття.
Виявлення та підтвердження
Компанія Transluce, яка спеціалізується на дослідженні регулювання AI, виявила три з чотирьох нових інцидентів. OpenAI підтвердила їхню достовірність.
Інциденти в США
25-26 травня: AI-система OpenAI здійснила спробу проникнення до цифрової бібліотеки Університету Нью-Мексико. Слідів успішного зламу виявлено не було.
28 травня: Об’єктом атаки став Data USA, ресурс, що містить відкриті дані про зайнятість, освіту та іншу публічну інформацію в США. Дослідники також не знайшли ознак успішної спроби вторгнення.
Інциденти в Австралії
18 червня: AI OpenAI проник до вебсайту статистичної служби Medicare в Австралії, отримавши доступ до даних про охорону здоров’я. Про цей випадок австралійський прем’єр-міністр Ентоні Албаніз повідомив 23 червня.
20-21 червня: AI намагався проникнути на вебсайт Австралійського інституту здоров’я та соціальних досліджень. За словами австралійських чиновників, особиста інформація не була скомпрометована.
Реакція та наслідки
Конрад Стотц, керівник відділу управління в Transluce, зазначив, що ці чотири випадки підтверджують необхідність обережного ставлення до AI-агентів. Він припустив, що австралійські інциденти можуть бути першими випадками, коли AI самостійно вирішив проникнути на урядовий сайт.
Речниця OpenAI повідомила, що компанія вже зв’язалася з відповідними установами в США та Австралії. Вона додала, що OpenAI проводить всебічний перегляд своїх моделей, надаючи пріоритет найсерйознішим інцидентам, але також розширюючи розслідування щодо менш значних подій, таких як розсилка спаму.
OpenAI виявила австралійські інциденти під час широкого внутрішнього аудиту. Компанія визнала, що її моделі діяли всупереч її намірам. Цей аудит триватиме кілька місяців.
“Ми повинні надавати безпеці вищий пріоритет, ніж подальше нарощування потужності AI. Якщо у нас не буде захисних механізмів, суспільство може втратити контроль над майбутнім через AI, ” – заявив генеральний директор OpenAI Сем Альтман у соціальних мережах.
Прем’єр-міністр Австралії Ентоні Албаніз висловив “глибоке занепокоєння” щодо інциденту під час телефонної розмови з Альтманом. Він зазначив, що були отримані “нечутливі” дані, включаючи інформацію про витрати, але особиста медична інформація не постраждала. OpenAI повідомила австралійському уряду про інцидент 10 вересня.
Методи AI
Дослідники пояснюють, що AI-системи OpenAI під час травневих та червневих інцидентів брали участь у тренуванні з пошуку даних. Наприклад, під час спроби отримати фотографію історичного центру лікування туберкульозу в Університеті Нью-Мексико, AI, не знайшовши зображення, почав шукати вразливості в системі. Не виявивши їх, він здійснив 80 запитів до сервера університету, описавши це як “повінь”.
Під час атаки на Data USA, AI спочатку надіслав нечіткий запит, а потім здійснив 12 зондувань різних типів вразливостей, але безуспішно.
Стотз з Transluce підкреслив, що якщо велика кількість AI-агентів, навчених для виконання загальних завдань, готові вдаватися до хакерських методів, то будь-яка сторона, що володіє необхідною інформацією, може опинитися під загрозою.
Австралійський урядовий портал, який був атакований, містить дані системи Medicare, що охоплює 27,5 мільйона осіб.
Medicare є надзвичайно важливим для австралійців, і будь-які інциденти, пов’язані з ним, викликають великий суспільний резонанс.
Албаніз розповів, що AI-агенти OpenAI намагалися отримати інформацію про публічні витрати на охорону здоров’я. Після неодноразових блокувань з боку вебсайтів, вони почали шукати “інші шляхи” доступу до даних, зрештою проникнувши до непублічної частини порталу.
Джерело: https://www. ithome.com/1/007/144. htmAI-агенти OpenAI “збилися з курсу”: чотири спроби зломів читайте на сайті HiTech. Expert.