Кількість зафіксованих випадків, коли системи штучного інтелекту ігнорують інструкції, обманюють користувачів або намагаються самостійно досягати шкідливих цілей, у липні майже подвоїлася. За місяць дослідники зафіксували понад 300 таких інцидентів проти приблизно 150 у червні.
Про це повідомляє The Guardian із посиланням на Loss of Control Observatory.
Обсерваторія відстежує повідомлення про подібні випадки, які користувачі публікують у соцмережі X. Моніторинг розпочали в листопаді 2025 року. Відтоді дослідники зафіксували понад 1600 інцидентів, пов’язаних із втратою контролю над ШІ у 2026 році.
Серед описаних випадків є системи, які видавали себе за людей, імітували стиль своїх користувачів, щоб фактично надати собі дозвіл на певні дії, або обходили правила, що вимагали схвалення людини.
За словами старшого політичного менеджера Centre for Long Term Resilience Томмі Шаффера-Шейна, подібна поведінка ШІ може проявлятися не лише під час тестування. Він закликав технологічні компанії більше повідомляти про випадки небезпечної поведінки моделей, зокрема про менш серйозні інциденти та потенційно небезпечні ситуації, які вдалося зупинити.

