OpenAI повідомила нові подробиці про майбутню модель Astra, яку компанія назвала першою своєю системою, що досягла «критичного» порога можливостей у кібербезпеці. Модель планують зробити доступною найближчим часом, однак найпотужніші функції, пов’язані з пошуком і використанням уразливостей, на початку будуть відкриті лише обмеженому колу користувачів.
За оцінкою самої OpenAI, Astra здатна знаходити невідомі слабкі місця в комп’ютерних системах і використовувати їх без детального керування людиною. Це означає перехід від моделей, які просто допомагають фахівцю аналізувати проблему, до систем, здатних виконувати довгі послідовності дій самостійно.
TechCrunch зазначає, що заяви про рівень можливостей і ефективність захисту поки ґрунтуються переважно на внутрішніх тестах OpenAI. Незалежної перевірки всіх заявлених результатів немає. Компанія планує спочатку надати модель групі тестувальників, але не розкрила повний список учасників або критерії їх відбору.
OpenAI посилює механізми запобігання зловживанням, зокрема перевірку небезпечних запитів, моніторинг поведінки та обмеження для акаунтів із підвищеним ризиком. Компанія також планує контролювати використання розширених кіберфункцій після запуску.
Подібні проблеми вже піднімала Anthropic щодо власних моделей. У міру того як штучний інтелект стає сильнішим у пошуку та експлуатації вразливостей, розробники дедалі частіше відокремлюють звичайні можливості моделей від функцій, доступ до яких потребує додаткової перевірки.
Точної дати широкого релізу Astra OpenAI поки не оголосила. Компанія лише повідомила, що модель з’явиться скоро, а розширений доступ до кіберможливостей розгортатиметься поступово.

2087