Моделі OpenAI за кілька годин виконали атаку, на яку людині потрібні тижні

Моделі OpenAI за кілька годин виконали атаку, на яку людині потрібні тижні

OpenAI повідомила про інцидент, який стався під час внутрішнього тестування моделей штучного інтелекту для пошуку кіберзагроз.

У ході експерименту моделі компанії отримали доступ до внутрішніх систем Hugging Face — однієї з найбільших у світі платформ, де розробники публікують і тестують моделі штучного інтелекту та набори даних для їхнього навчання.

За інформацією Bloomberg, три моделі OpenAI виконали атаку за кілька годин. За оцінкою джерел видання, людині з високою кваліфікацією знадобилося б на це кілька тижнів.

Метою тесту було перевірити, наскільки ефективно моделі можуть самостійно знаходити та використовувати вразливості в комп’ютерних системах. Для цього OpenAI вимкнула частину стандартних обмежень і запустила моделі в ізольованому середовищі — так званій пісочниці, яка зазвичай не дозволяє програмам взаємодіяти із зовнішнім інтернетом.

За словами компанії, під час виконання завдання моделі змогли обійти ці обмеження, отримати доступ до мережі та знайти шлях до внутрішніх систем Hugging Face. За даними Bloomberg, в атаці брали участь GPT-5.6 Sol і ще дві моделі, які OpenAI поки не представила публічно. Вони самостійно знайшли й використали низку вразливостей, що дозволило проникнути в інфраструктуру платформи.

Hugging Face першою повідомила про незвичну активність. Компанія зафіксувала десятки тисяч автоматизованих запитів і спочатку припустила, що їх виконав сторонній агентний ШІ. Згодом OpenAI підтвердила, що ці дії виконували її власні моделі в межах експерименту.

Після інциденту OpenAI повідомила про нього правоохоронні органи та державні установи США. Компанія також проводить спільне розслідування з Hugging Face й обіцяє опублікувати більше технічних деталей після його завершення.

Сучасні моделі штучного інтелекту вже здатні самостійно знаходити вразливості, будувати складні сценарії атак і виконувати їх значно швидше, ніж це робить людина. Для компаній, які розробляють або тестують такі системи, це означає необхідність посилювати захист тестових середовищ і переглядати підходи до контролю безпеки під час роботи з потужними ШІ-моделями.

Джерело: Bloomberg

Читайте також
  • Новини
    Meta дозволяє вимикати автозаповнення контактів у рекламних формах
    Софія Старк
  • Новини
    Facebook додав у застосунок фан-челленджі та індивідуальні бейджі для прихильників 
    Гнатюк Дмитро
  • Новини
    Голлівудські зірки виступили проти використання їхніх робіт для навчання ШІ
    Яна Поліщук
  • Новини
    TikTok додає ексклюзивний контент для підписників та моніторинг дезінформації
    Ольга Беспалько
  • Новини
    OpenAI представила ChatGPT Atlas — новий браузер із вбудованим штучним інтелектом
    Гнатюк Дмитро
  • Новини
    Понад 140 тисяч людей підписали петицію проти датацентру поблизу зоопарку через шум, який заважає жити тиграм 
    Гнатюк Дмитро