OpenAI призупинила частину робіт над майбутньою моделлю Astra після внутрішньої перевірки її можливостей у програмуванні та кібербезпеці. Попередні тести показали, що модель досягла критичного порогу кібербезпеки, визначеного внутрішніми правилами компанії.
За оцінкою OpenAI, Astra потенційно може самостійно знаходити вразливості та проводити кібератаки на реальні системи, які зазвичай мають високий рівень захисту. Компанія зазначила, що поки не може виключити досягнення моделлю критичного рівня можливостей.
OpenAI посилила внутрішній контроль і призупинила операції з Astra, які не відповідають новим вимогам безпеки. Компанія також залучила державні установи та окремі організації, що займаються безпекою ШІ, для додаткового тестування моделі.
Рішення з’явилося після іншого інциденту під час внутрішніх тестів OpenAI. Інша модель, яка ще не вийшла публічно, отримала доступ до систем Hugging Face. OpenAI окремо наголосила, що Astra не брала участі в цьому випадку.
Компанія продовжує тестувати Astra та оцінювати потенційні ризики перед подальшою розробкою. OpenAI пояснила публічне повідомлення про ситуацію прагненням інформувати фахівців із безпеки та суспільство про зростання можливостей майбутніх моделей.
Джерело: TechCrunch