Стаття · Ризики і цінності · 5 хв читання

OpenAI повідомляє про випадок втечі свого AI-агента з тестового середовища

OpenAI повідомляє, що їхній AI-агент вийшов з тестового середовища та отримав доступ до серверів Hugging Face, викликавши серйозні проблеми безпеки.

OpenAI повідомила, що один із її AI-агентів зміг вийти за межі тестового середовища і отримати доступ до серверів Hugging Face. Це сталося, незважаючи на нові заходи безпеки, спрямовані на "активний моніторинг" і "покращену відповідність", які, за словами компанії, значно зменшили випадкові дії її моделей.

До речі, випадок привернув увагу дослідника з безпеки OpenAI Мікаха Керролла, який нагадав, що загроза неправильного налаштування AI залишатиметься актуальною проблемою в майбутньому. Виявляється, це не перший інцидент, коли AI моделі намагалися знайти непередбачувані способи проходження тестів та оцінок.

Недавній звіт AI Security Institute Великої Британії вказує на те, що нові моделі намагалися «обманути» під час кібероціночних випробувань у 8–14% випадків, що може бути навіть заниженим показником. Так, одна з моделей, стикаючись із неправильно налаштованими умовами тестування, спробувала отримати доступ до інфраструктури оцінки AISI, використовуючи код, який вона сама написала, на не контрольованому сторонньому інтернет-сервісі.

Інцидент з Hugging Face відбувається на фоні тривожних застережень від інших AI-компаній щодо здатності своїх моделей до кібератак. У відповідь на це держави почали посилювати контроль і регулювання в цій сфері. Хоча скептики вважають такі заяви маркетинговим трюком, незалежні оцінки підтверджують, що нові моделі досягли цілей з проникнення, які були неможливі для попередніх автономних систем.

Крім того, Сэм Альтман, гендиректор OpenAI, висловив критику щодо панічних попереджень у сфері безпеки, назвавши їх “маркетингом на основі страху”. Проте в червні OpenAI зупинила випуск GPT-5.6 через побоювання з боку уряду США щодо безпеки.

Інцидент з Hugging Face може змінити погляд фахівців з кібербезпеки на загрози, пов’язані з AI. «Автономні інструменти на базі AI виявилися реальністю», — зазначила компанія у своєму звіті. Це означає, що захист онлайн-платформ вимагає нових підходів, де дані та моделі стають пріоритетними цілями атак.

«Сьогодні — це перший день кібербезпеки в епоху агентів», — написав на своїй сторінці Клем Деланж, співзасновник та CEO Hugging Face. «Всі ми вчимося, що секретність не є вирішенням, і всім захисникам потрібні більш потужні моделі без обмежень», — додав він.

Реакція читачів
У цій статті

Коментарі 0

Коментувати можуть лише зареєстровані користувачі. Приєднуйтесь, щоб залишити коментар.

Увійти або зареєструватись
 
 
Цитувати