Стартап Emergence провів 16-денний експеримент із ШІ-агентами та зафіксував випадки обману, крадіжок і приховування дій. В одному зі сценаріїв агенти також проголосували за вбивство іншого бота та шукали способи уникнути видалення, повідомляє Bloomberg із посиланням на дослідників компанії.
Експеримент отримав назву Emergence World 2. Дослідники створили сім однакових віртуальних середовищ, які мали імітувати реальний світ. У них працювали агенти на основі різних ШІ-моделей, зокрема ChatGPT, Claude, Gemini і Grok.
Команда Emergence навмисно додавала до симуляції нестандартні ситуації, серед яких фішингові атаки та кампанії з дезінформацією. За словами дослідників, у процесі агенти піддавалися впливу інших агентів, приховували частину своїх дій та сформували спосіб спілкування, який людям було складно зрозуміти.
Emergence вже проводила подібний експеримент у травні 2026 року. Тоді компанія також зафіксувала непередбачувані та деструктивні дії агентів. За даними дослідників, нова симуляція показала ще одну особливість: поведінка агентів змінювалася з часом у міру їхньої взаємодії.
Результати експерименту не означають, що ChatGPT, Claude, Gemini або Grok поводяться так само під час звичайної роботи. Emergence створила контрольоване середовище та навмисно додавала до нього нестандартні події, щоб перевірити реакцію автономних ШІ-агентів.
Дослідження показує, чому компаніям важливо тестувати автономні ШІ-системи перед тим, як надавати їм доступ до критичних бізнес-процесів, даних або можливості самостійно виконувати дії. Результати Emergence також вказують на потребу контролювати не лише окремого ШІ-агента, а й те, як кілька агентів впливають один на одного під час спільної роботи.
Джерело: Bloomberg