Дослідники використали Claude, щоб зламати OpenAI: ШІ допоміг знайти шлях до акаунтів співробітників

Сьогодні,   20:32    115

Команда з трьох дослідників стартапу Hacktron AI використала модель Claude від Anthropic під час реальної перевірки безпеки OpenAI. Робота проводилася в межах bug bounty, а результатом став ланцюжок із двох критичних вразливостей, який дозволив дослідникам отримати доступ до кількох облікових записів співробітників OpenAI.

Програмний код на екрані комп’ютера

Після повідомлення про проблему OpenAI виплатила команді $6500 винагороди й закрила знайдені уразливості. Але сама історія привернула увагу через роль ШІ: дослідники показали, що інструменти, доступні за звичайною платною підпискою, вже здатні суттєво прискорювати роботу з експлойтами.

Останні новини:  NVIDIA відмовила у гарантії власнику RTX 5090 через стертий серійний номер: схожі випадки помітили й інші

Початкову точку входу знайшли 25 липня у Discourse — сторонньому програмному забезпеченні, на якому працював форум спільноти OpenAI. Вразливість була пов’язана з обробкою зображень HEIF і HEIC, які iPhone використовує за замовчуванням.

Під час завантаження такого файла Discourse передавав його через ImageMagick, а той — до бібліотеки libheif. Усередині libheif була помилка пам’яті, яка дозволяла спеціально підготовленому зображенню вплинути на роботу сервера.

Особливо показово, що сама помилка вже була виправлена розробниками libheif раніше, але її не оформили як окрему CVE-вразливість. Через це системи, які покладаються на стандартні списки відомих проблем, могли продовжувати використовувати стару небезпечну версію.

Останні новини:  Емуляція пішла в обидва боки: ігри Switch запускають на ПК, а старі Windows-ігри — вже на самій консолі

Claude Opus 4.8 спочатку не зміг створити працездатний експлойт. Після виходу Opus 5, за словами Hacktron, новій моделі знадобилося лише кілька годин, щоб впоратися з тією самою задачею.

Після захоплення сервера Discourse дослідники знайшли ще одну уразливість, через яку змогли перехоплювати акаунти ChatGPT і Codex. Один зі скомпрометованих облікових записів належав співробітнику OpenAI, чий Codex мав доступ до GitHub-організації компанії.

Останні новини:  Захист PlayStation 2 зламали через 26 років: ентузіасти дістали прошивку секретного чипа MechaCon

Команда зупинилася й повідомила OpenAI та Discourse. Discourse випустила виправлення 27 липня. Інцидент не був атакою злочинців — це була санкціонована перевірка, але вона показала, наскільки швидко ШІ знижує поріг входу для складного пошуку вразливостей.




За оцінкою експертів, робота, яка раніше могла вимагати місяців вузькоспеціалізованих знань, тепер інколи скорочується до днів. Саме тому розвиток кіберможливостей великих моделей дедалі частіше розглядають одночасно і як інструмент захисту, і як потенційне джерело нових ризиків.

https://techcrunch.com/2026/09/18/researchers-used-anthropics-claude-to-hack-into-openai/