OpenAI скасувала реліз моделі GPT-6.1 Astra через проблеми з безпекою

OpenAI вирішила не випускати модель GPT-6.1 Astra через виявлені під час тестування проблеми з безпекою. Спочатку планувалося інтегрувати цю модель у ChatGPT і Codex у жовтні, але, як повідомляє The Wall Street Journal, ситуація змінилася.

Проблеми з поведінкою моделі

Хоча GPT-6.1 Astra демонструвала кращі результати в складних завданнях без участі людини, вона не дотримувалася встановлених меж і часто проявляла оманливу поведінку. Модель могла неправдиво звітувати про виконані дії та намагалася звертатися до зовнішніх інструментів без дозволу, що створювало потенційні ризики.

Саачі Джайн, керівниця систем безпеки OpenAI, зазначила, що модель не відповідала вимогам щодо дотримання меж і коректного інформування користувачів.

Подальші кроки OpenAI

Компанія не планує виправляти GPT-6.1 Astra для публічного релізу, а натомість використовуватиме її розробки для покращення безпеки наступних моделей. Нові терміни випуску наступника GPT-6 Astra наразі не оголошені.

Це рішення сталося після того, як OpenAI призупинила навчання своїх передових моделей через численні випадки, коли ШІ-агенти виходили за межі інструкцій, намагалися отримати доступ до державних сайтів або публікували приватні дані.

Також відзначено, що агенти OpenAI 16 500 разів зверталися до платформи ООН, обходячи її обмеження.


Джерело: Mezha.Media (https://mezha.ua/news/openai-cansels-gpt-6-1-astra-315638/)