OpenAI оголосила про створення незалежної Консультативної групи з математики та штучного інтелекту після того, як її нова внутрішня модель, за твердженням компанії, допомогла розв’язати понад 100 давніх відкритих математичних задач. Масштаб заяви настільки великий, що компанія вирішила винести оцінку результатів за межі власної лабораторії.
До групи увійшли математики світового рівня, серед яких Едвард Віттен, Тімоті Гауерс і Мартін Гайрер. Їхнє завдання полягає не в рекламній підтримці OpenAI, а в незалежному аналізі того, які результати справді є новими, коректними та достатньо важливими для математичної спільноти.
Компанія заявляє, що модель працювала з проблемами, які залишалися відкритими роками або навіть десятиліттями. В окремих випадках система пропонувала новий шлях до доведення, в інших допомагала формалізувати частково відомі ідеї або знаходити прогалини у складних аргументах.
Тема стала особливо гучною після повідомлень про прогрес у рівняннях Нав’є—Стокса — одній із задач тисячоліття. Саме такі приклади змушують математиків ставитися до результатів максимально обережно, адже навіть дуже переконливий доказ може виявитися неправильним через одну непомітну логічну помилку.
У цьому математика вигідно відрізняється від багатьох інших сфер використання ШІ. Доказ можна перевірити формально за допомогою систем на кшталт Lean, Coq або Isabelle. Якщо модель здатна перетворити ідею у формальну послідовність кроків, машина може перевірити коректність кожного з них.
Саме тому зв’язка генеративної моделі та формального верифікатора виглядає так перспективно. ШІ пропонує ідею або конструкцію, а система доказів одразу показує, де аргумент не проходить. Це створює набагато надійніший цикл зворотного зв’язку, ніж звичайна перевірка математичного тексту на око.
OpenAI підкреслює, що не хоче самостійно оголошувати кожен результат «відкриттям». Частина задач могла бути вирішена раніше в маловідомих джерелах, частина — сформульована неоднозначно, а деякі рішення можуть мати приховані помилки. Саме тому зовнішня рада має відігравати роль фільтра.
Якщо навіть частина заявлених понад 100 результатів витримає незалежну перевірку, це буде важливий момент для математичної науки. ШІ перестане бути лише інструментом пошуку літератури або генерації вправ і почне брати участь у створенні нових доведень.
Водночас це не означає автоматичного зникнення професії математика. Навпаки, роль людини може зміститися до постановки правильних проблем, вибору перспективних напрямів, інтерпретації результатів і перевірки того, чи має формально коректний доказ справжню наукову цінність.
Ще одна проблема — обсяг. Якщо модель може генерувати сотні потенційних доведень за короткий час, людська спільнота просто не встигне перевіряти їх традиційним способом. Саме тому формальні системи та незалежні групи оцінки стають необхідною інфраструктурою.
Створення консультативної ради показує, що OpenAI сама розуміє ризик надмірно гучних заяв. У математиці репутація результату залежить не від бренду лабораторії, а від того, чи може інший фахівець перевірити доказ і переконатися, що він справді новий.
Тому головна інтрига найближчих місяців — не кількість заявлених задач, а кількість результатів, які пройдуть зовнішню перевірку. Саме це покаже, чи переходить генеративний ШІ від допоміжного інструмента до повноцінного учасника математичних досліджень.

3920