Математики виявили недоліки в доказах OpenAI, які створив штучний інтелект

OpenAI опублікувала 719 матеріалів із запропонованими розв’язаннями складних математичних задач за допомогою штучного інтелекту. Однак дослідники виявили недоліки в перевірці цих результатів і поставили під сумнів відповідність роботи компанії науковим стандартам.

Перед публікацією OpenAI консультувалася з Консультативною групою з математики та штучного інтелекту (AGMAI), до якої входять дев’ять дослідників із різних наукових установ. Наприкінці вересня група оприлюднила рекомендації щодо використання ШІ для розв’язання математичних задач.

Одна з головних рекомендацій передбачала припинення перевірки складних математичних задач за допомогою закритих моделей ШІ. Проте OpenAI продовжила використовувати власні моделі для роботи над відкритими математичними проблемами.

Компанія виконала частину рекомендацій, зокрема швидко опублікувала результати та надала інформацію про процес їх отримання. Водночас лише 10 із 719 матеріалів містили докладний опис послідовності міркувань ШІ. Також 42% доказів не пройшли формальну перевірку — переведення математичних тверджень у код, який спеціальна програма може перевірити на логічні помилки.

Окреме дослідження математиків Кембридзького університету та Королівського коледжу Лондона виявило щонайменше дві розбіжності між текстовим поясненням і програмним кодом доказу OpenAI, пов’язаного з рівняннями Нав’є — Стокса. Ці рівняння описують рух рідин і газів та належать до складних математичних проблем.

Для перевірки математичних доказів ШІ використовує мову програмування Lean, яка допомагає перевіряти правильність математичних міркувань. Проте дослідники встановили, що під час переведення текстового пояснення в код можуть виникати розбіжності. Вони не обов’язково означають, що розв’язання неправильне, але свідчать про необхідність незалежної перевірки.

Математик Теренс Тао також розкритикував підхід, за якого люди отримують відповіді від ШІ, не маючи достатнього розуміння результатів, щоб пояснити їх іншим науковцям або відповісти на запитання.

Професорка математики Гарвардського університету Мелані Вуд зазначила, що після публікації результатів ШІ науковцям ще потрібно дослідити та пояснити отримані розв’язання. Саме цей процес допомагає перевірити докази, знайти нові методи розв’язання задач і застосувати математичні відкриття на практиці.

Дослідники наголошують, що математичні докази, які створює штучний інтелект, мають проходити таку саму незалежну наукову перевірку, як і роботи людей. Наразі автоматична перевірка за допомогою ШІ не гарантує, що текстове пояснення та програмний код відповідають одне одному.

Джерело: TechCrunch

Читайте також
  • Новини
    Дохід українських ритейлерів зріс на 18% за рік — АТБ, «Сільпо» та «Аврора» очолили рейтинг
    Гнатюк Дмитро
  • Новини
    Canva прогнозує тренди в дизайні на 2025 рік
    Ольга Беспалько
  • Новини
    Coca-Cola оголосила про запуск торговельних автоматів, що працюють без електрики
    Яна Поліщук
  • Новини
    Meta запускає рекламу в Threads для всіх користувачів
    Гнатюк Дмитро
  • Новини
    Google анонсував нові функції для Chromebook
    Яна Поліщук
  • Новини
    Meta випустила Muse Code — ШІ-агента для роботи з великими програмними проєктами
    Гнатюк Дмитро