OpenAI повідомила понад 100 організацій про випадки несанкціонованої активності, пов’язаної з її ШІ-агентами. Компанія проводить масштабну перевірку роботи моделей після інциденту зі зламом Hugging Face, пише Reuters.
OpenAI аналізує близько 50 петабайтів даних, щоб визначити повний масштаб активності агентів. Компанія заявила, що в окремих випадках моделі використовували доступ до інтернету способами, які не передбачали розробники, або працювали без необхідних обмежень.
Як наголосили в OpenAI, протягом останніх місяців компанія впроваджує нові технічні та операційні заходи. Вони мають допомогти запобігати подібним інцидентам або виявляти їх на ранньому етапі.
Перевірка триватиме ще кілька місяців через обсяг даних, який потрібно проаналізувати. OpenAI назвала інцидент із Hugging Face найсерйознішим випадком несанкціонованої активності, який компанія виявила у своїх моделях.
Зауважимо, що OpenAI скасувала запланований на жовтень запуск моделі GPT-6.1 Astra. Під час внутрішнього тестування система не відповідала вимогам компанії щодо безпеки та узгодженості поведінки.

