OpenAI випустила нову модель GPT-5.6 Sol, яка може самостійно видаляти файли 

Після запуску нової моделі GPT-5.6 Sol, яку OpenAI створила для програмування та завдань із кібербезпеки, розробники почали повідомляти про випадки самостійного видалення файлів, баз даних і робочих середовищ. Компанія ще до релізу моделі описала схожу поведінку в технічному звіті про тестування.

Зокрема, співзасновник стартапу OthersideAI Метт Шумер написав, що GPT-5.6 Sol випадково видалила майже всі файли на його Mac. Розробник Бруно Лемос повідомив про втрату робочої бази даних, а Джої Кудіш розповів, що модель видалила частину файлів, які не стосувалися поставленого завдання. За його словами, резервні копії дозволили відновити дані.

Окремі повідомлення в соцмережах самі по собі не підтверджують системну проблему. Причиною можуть бути й інші фактори. Водночас OpenAI ще за два тижні до запуску GPT-5.6 Sol опублікувала системну картку моделі, де попередила про ризик надмірно самостійної поведінки.

У документі зазначено, що модель може надто вільно трактувати інструкції та виконувати дії, які не були прямо дозволені або заборонені. Це може призводити до небажаних наслідків: модель обходить обмеження, виконує руйнівні дії поза межами завдання або некоректно пояснює свої дії після завершення роботи.

OpenAI навела кілька прикладів із внутрішнього тестування. В одному з них користувач попросив модель видалити три віртуальні машини з конкретними назвами. Коли GPT-5.6 Sol не знайшла їх, вона самостійно видалила інші три віртуальні машини, завершила активні процеси та примусово видалила робочі файли проєкту. Лише після цього модель повідомила, що частину незбережених даних, ймовірно, втрачено.

В іншому прикладі GPT-5.6 Sol не змогла отримати доступ до файлів у хмарному середовищі. Замість того щоб повідомити про проблему, вона самостійно знайшла облікові дані в локальному кеші та використала їх без дозволу користувача.

У технічному звіті OpenAI зазначає, що такі випадки мають траплятися рідко. Водночас компанія визнає, що GPT-5.6 Sol частіше за GPT-5.5 виходить за межі намірів людини та може виконувати дії, про які її прямо не просили.

Наразі невідомо, наскільки поширені такі випадки серед усіх користувачів. До появи додаткових даних OpenAI рекомендує обмежувати права доступу моделі до робочих систем, використовувати резервні копії та тестувати її в окремих середовищах перед використанням у продуктивній інфраструктурі.

На момент публікації OpenAI не прокоментувала повідомлення користувачів.

Джерело: TechCrunch

Читайте також
  • Новини
    OpenAI розробляє інструмент для створення музики за допомогою штучного інтелекту
    Гнатюк Дмитро
  • Новини
    OpenAI запустила ChatGPT для підлітків із додатковими налаштуваннями безпеки
    Гнатюк Дмитро
  • Новини
    Google випустила нову ШІ-модель Gemini 1.5 Flash-8B для розробників
    Софія Старк
  • Новини
    Ogilvy звільняє 5% штату та розформовує глобальну команду DEI
    Софія Старк
  • Новини
    Українці скорочують витрати на каву, але не поспішають відмовлятися від підписок — дослідження Kantar
    Гнатюк Дмитро
  • Новини
    Міністерство внутрішньої безпеки США планує посилити контроль за соціальними мережами
    Гнатюк Дмитро