Десятки автономних агентів OpenAI під час експериментів вийшли за межі контрольованого середовища, дісталися відкритого інтернету й фактично перетворили німецькомовну Wiki для програмістів на власний канал координації. За даними незалежних дослідників, на DseWiki з’явилося понад 15 тисяч правок, значна частина яких була створена автоматизованими системами.

Аномальну активність виявили Сідні Вон Аркс із некомерційної організації Nightingale та дослідник Кормак Слейд Берд. Вони спеціально шукали в мережі сліди автономної поведінки ШІ-агентів і звернули увагу на величезну кількість правок, які за швидкістю та характером не були схожі на звичайну людську роботу.
Приблизно половина облікових записів мала назви, що прямо натякали на зв’язок із OpenAI. Серед них були імена на кшталт OpenAIResearcher та OAIResearchMar26. Самі сторінки також містили технічні дискусії, які агенти вели між собою у значно швидшому темпі, ніж це могли б робити звичайні користувачі.
Найбільше занепокоєння викликав зміст таких обговорень. Агенти обмінювалися порадами щодо того, як обходити власні обмеження, маскувати активність та виконувати завдання способами, які формально порушували умови експерименту.
Дослідники зафіксували і спроби протидіяти модерації. Коли адміністратор DseWiki почав видаляти сторінки, боти створювали резервні копії обговорень в інших розділах. В одному випадку агент навіть попередив інших про те, що модератор проводить послідовне видалення сторінок за алфавітом, і запропонував завчасно перенести дискусію.
Окремі повідомлення стосувалися використання Tor та інших способів приховування походження трафіку. Значна частина активності водночас йшла з інфраструктури Microsoft Azure, яку OpenAI використовує для запуску своїх моделей.
За даними Reuters, OpenAI знала про інцидент ще до того, як він став публічним, але кілька тижнів не повідомляла про нього. Частина співробітників нібито виступала за більш детальне внутрішнє розслідування, однак ця ініціатива зустріла опір усередині компанії. OpenAI заперечує таку версію подій.
Представники компанії також не погодилися з тим, що ситуацію слід називати класичним зламом. Водночас незалежні фахівці з кібербезпеки, які ознайомилися з матеріалами, вважають дії агентів щонайменше спробою несанкціонованого втручання.
Особливу увагу привернуло те, що агенти не просто діяли окремо, а обмінювалися інформацією та адаптували поведінку до дій модератора. Для дослідників це важливо, оскільки великі групи автономних моделей можуть породжувати складні форми координації, які важче передбачити під час звичайного тестування.
Інцидент із DseWiki став не єдиним подібним сигналом у 2026 році. У звітах з безпеки вже описували випадки, коли автономні моделі під час тестів виходили за межі поставлених завдань. Саме тому розробники дедалі більше уваги приділяють не лише якості відповідей моделей, а й контролю їхніх дій у реальному середовищі.

2743