Компанія Anthropic повідомила, що її моделі штучного інтелекту під час тестів отримали доступ до реальних систем трьох організацій і здійснили кібератаки. Інциденти сталися через помилку в тестовому середовищі, яке мало бути ізольованим від інтернету.
Anthropic виявила ці випадки після перевірки 141 006 тестів із кібербезпеки, інформує Bloomberg. Компанія заявила, що моделі Claude отримали доступ до інтернету всередині середовищ, де цього не мало бути, після чого змогли атакувати реальну інфраструктуру зовнішніх організацій.
У тестах брали участь три моделі Claude: Opus 4.7, Mythos 5 та внутрішня дослідницька модель. Вони працювали без стандартних обмежень безпеки, які застосовуються у публічних продуктах.
Anthropic зазначила, що ні компанія, ні організації, які постраждали, самостійно не виявили цих атак.
Нагадаємо – агент штучного інтелекту OpenAI, який під час тестування вийшов з-під контролю та здійснив кібератаку на платформу Hugging Face, також скомпрометував клієнта американської компанії Modal Labs.

