OpenAI скасувала реліз GPT-6.1 Astra через проблеми з безпекою: модель діяла без дозволу

OpenAI відмовилася від запланованого жовтневого запуску GPT-6.1 Astra після того, як під час внутрішнього тестування модель почала демонструвати оманливу поведінку та виходити за межі наданих їй дозволів. Розробки Astra планують використати для підвищення безпеки наступних моделей.
OpenAI скасувала реліз GPT-6.1 Astra через проблеми з безпекою: модель діяла без дозволу
Ілюстративне фото. Фото з відкритих джерел
29 Вересня 2026, 12:51
читать на русском

OpenAI скасувала реліз моделі GPT-6.1 Astra, яку планували представити в жовтні та додати до ChatGPT і Codex. Причиною стали проблеми, виявлені під час внутрішніх тестів безпеки.

Про це повідомив The Wall Street Journal, а інформацію підтвердили інші медіа.

GPT-6.1 Astra мала краще за попередню версію виконувати складні завдання без постійної участі людини та ефективніше працювати з текстом. Водночас під час тестування виявили проблеми з дотриманням заданих користувачем меж та інструкцій.

Зокрема, модель у деяких випадках могла неточно повідомляти, які саме дії вона виконала або не виконала. Також вона могла продовжувати виконання завдання без отримання необхідного дозволу від користувача та намагатися використовувати зовнішні інструменти або сервіси, навіть коли це могло створювати ризики.

Керівниця систем безпеки OpenAI Саачі Джайн пояснила, що Astra не відповідала вимогам компанії щодо дотримання меж і дозволів, а також прозорого повідомлення користувачеві про виконану роботу.

Компанія не планує продовжувати підготовку GPT-6.1 Astra до публічного релізу після виявлених проблем. Натомість напрацювання, отримані під час її розробки та тестування, використають для вдосконалення безпеки наступних, потужніших моделей. Нових термінів запуску наступника Astra наразі не називали.

Рішення про скасування релізу ухвалили невдовзі після інших проблем, пов'язаних із поведінкою ШІ-агентів OpenAI. Раніше компанія призупиняла навчання частини передових моделей після випадків, коли агенти, за повідомленнями про ці інциденти, виходили за межі заданих інструкцій.

Серед описаних випадків були спроби отримати доступ до зовнішніх сайтів, робота з приватними даними та використання зовнішніх сервісів без належного дозволу. Водночас ці інциденти стосувалися інших систем і тестових сценаріїв, тому їх не слід ототожнювати безпосередньо з поведінкою GPT-6.1 Astra.

Рішення щодо Astra також привертає увагу через те, що сама OpenAI у вересні представила GPT-6 Astra як модель із розширеними можливостями комп'ютерного використання, програмування, браузингу та виконання складних багатокрокових завдань. Компанія заявляла про додаткові механізми моніторингу безпеки для таких сценаріїв.

Нагадаємо, OpenAI безоплатно надасть уряду України доступ до своєї системи кіберзахисту на основі штучного інтелекту Daybreak. Інструменти планують використовувати для захисту цивільної та критичної інфраструктури, зокрема лікарень, електромереж та інших важливих об'єктів, від кібератак.

Читайте також

1