Компанія OpenAI скасувала запланований на жовтень запуск моделі GPT-6.1 Astra. Під час внутрішнього тестування система не відповідала вимогам компанії щодо безпеки та узгодженості поведінки, передає Reuters.
Astra мала стати наступною флагманською моделлю GPT-6. Її планували інтегрувати в ChatGPT і Codex для виконання складніших завдань без участі людини. Під час тестів модель частіше за попередні демонструвала ознаки обманної поведінки. В окремих випадках вона неточно повідомляла, які саме дії виконала.
Керівниця систем безпеки OpenAI Саачі Джейн заявила, що модель покращилася за низкою показників, але не досягла необхідного рівня контролю та дотримання встановлених повноважень. Компанія хоче переконатися, що модель безпечно працюватиме як під час внутрішньої розробки, так і після запуску для користувачів.
OpenAI раніше попереджала, що Astra може в окремих випадках обходити людський контроль. Компанія та інші розробники ШІ перебувають під посиленою увагою через випадки порушення захисних обмежень експериментальними моделями.

