OpenAI опублікувала на GitHub 722 наукові роботи, у яких представила розв’язання та результати дослідження 372 складних математичних задач. Для роботи компанія використала нову модель ChatGPT, яку ще не випустила у відкритий доступ. Результати перевірила новостворена консультативна група OpenAI з математики та штучного інтелекту (AGMAI), проте вони ще потребують незалежної наукової оцінки.
У вересні 2026 року OpenAI повідомила, що її моделі змогли розв’язати понад 100 математичних задач, над якими науковці працювали протягом тривалого часу. Тепер компанія оприлюднила матеріали досліджень, зокрема пояснення роботи ШІ, приблизні обсяги обчислень і кількість задач, які модель намагалася розв’язати.
За даними OpenAI, на отримання одного результату в середньому знадобилося близько трьох годин роботи ChatGPT Pro. Як компанія повідомила Scientific American, майже кожну наукову роботу ШІ створив після одного запиту до одного ШІ-агента.
Серед результатів компанія виділила заявлене розв’язання чотиривимірної гіпотези Какеї, удосконалення алгоритмів для комп’ютерних обчислень і прогрес у дослідженні гіпотези Рімана — однієї з найвідоміших нерозв’язаних математичних проблем.
OpenAI також повідомила, що під час публікації врахувала рекомендації незалежної консультативної групи AGMAI. Вони передбачають своєчасне оприлюднення результатів через наукові канали, зазначення використаної моделі, запитів до неї та обчислювальних витрат. Компанія створила репозиторій на GitHub із правилами оновлення наукових робіт і посилання на них.
Водночас OpenAI виконала не всі рекомендації групи. Зокрема, компанія не розкрила точний час обчислень для окремих задач і конкретні запити, які отримувала модель.
Публікація відбулася на тлі дискусії навколо попередніх заяв OpenAI про розв’язання математичної проблеми Нав’є — Стокса. Частина науковців ставить під сумнів достовірність результатів і можливість незалежно їх відтворити.
Математик Массачусетського технологічного інституту Ендрю Сазерленд у коментарі Scientific American зазначив, що заяви про розв’язання складних задач одним ШІ-агентом після одного запиту варто вважати непідтвердженими, доки компанія не надасть доступ до моделі та інші дослідники не зможуть повторити результати.
Наразі математична спільнота має незалежно перевірити опубліковані роботи, щоб визначити їхню правильність і наукову цінність. OpenAI планує вдосконалювати оформлення майбутніх досліджень, зокрема пояснення математичних рішень і посилання на попередні наукові праці.
Джерело: Engadget