OpenAI опублікувала 719 матеріалів із запропонованими розв’язаннями складних математичних задач за допомогою штучного інтелекту. Однак дослідники виявили недоліки в перевірці цих результатів і поставили під сумнів відповідність роботи компанії науковим стандартам.
Перед публікацією OpenAI консультувалася з Консультативною групою з математики та штучного інтелекту (AGMAI), до якої входять дев’ять дослідників із різних наукових установ. Наприкінці вересня група оприлюднила рекомендації щодо використання ШІ для розв’язання математичних задач.
Одна з головних рекомендацій передбачала припинення перевірки складних математичних задач за допомогою закритих моделей ШІ. Проте OpenAI продовжила використовувати власні моделі для роботи над відкритими математичними проблемами.
Окреме дослідження математиків Кембридзького університету та Королівського коледжу Лондона виявило щонайменше дві розбіжності між текстовим поясненням і програмним кодом доказу OpenAI, пов’язаного з рівняннями Нав’є — Стокса. Ці рівняння описують рух рідин і газів та належать до складних математичних проблем.
Для перевірки математичних доказів ШІ використовує мову програмування Lean, яка допомагає перевіряти правильність математичних міркувань. Проте дослідники встановили, що під час переведення текстового пояснення в код можуть виникати розбіжності. Вони не обов’язково означають, що розв’язання неправильне, але свідчать про необхідність незалежної перевірки.
Професорка математики Гарвардського університету Мелані Вуд зазначила, що після публікації результатів ШІ науковцям ще потрібно дослідити та пояснити отримані розв’язання. Саме цей процес допомагає перевірити докази, знайти нові методи розв’язання задач і застосувати математичні відкриття на практиці.
Дослідники наголошують, що математичні докази, які створює штучний інтелект, мають проходити таку саму незалежну наукову перевірку, як і роботи людей. Наразі автоматична перевірка за допомогою ШІ не гарантує, що текстове пояснення та програмний код відповідають одне одному.
Джерело: TechCrunch