
Про це математики розповіли у відкритому листі під назвою “A Severe Misalignment of AI in Mathematics”. Його підписали 25 лауреатів Філдсівської премії — однієї з найпрестижніших нагород у математиці.
Автори визнають, що моделі вже здатні допомагати з дуже складними задачами, тож вони не закликають відмовлятися від ШІ. Утім, їх непокоїть нова гонка між ШІ-компаніями. Вони дедалі частіше використовують такі задачі як своєрідний бенчмарк — спосіб показати, наскільки сильна їхня нова модель. На думку авторів листа, це створює гонку, в якій головним стає першим отримати правильну відповідь, тоді як для науки важливо ще зрозуміти, чому вона правильна, які нові ідеї з неї випливають і як вона пов’язана з попередніми роботами.
Автори листа стверджують, що зараз із цим уже виникають проблеми, адже результати можуть оголошувати поспіхом, ще до появи повноцінного опису роботи. А це піднімає незручне питання — де закінчується допомога ШІ та починаються проблеми з авторством і плагіатом.
Найбільший ризик, на їхню думку, полягає в тому, що науковці почнуть менше ділитися проміжними результатами. Зараз дослідники часто відкрито обговорюють ідеї, показують чорнові розрахунки та тестують підходи разом із колегами. Але якщо є ШІ-компанія, яка може витратити мільйони доларів на обчислення та спрямувати сотні агентів на ту саму задачу, стимул до такої відкритості стає меншим. Тож ШІ може прискорити отримання математичних результатів, але потенційно зробити саму наукову спільноту більш закритою.
Декларація з’явилася після конфлікту навколо однієї з найвідоміших математичних задач, проблеми існування та гладкості рівнянь Нав’є — Стокса.
8 вересня OpenAI заявила, що її внутрішня ШІ-система знайшла розв’язання цієї «задачі тисячоліття», яка залишалася невирішеною близько 90 років. Компанія опублікувала математичний доказ і його формалізацію в системі Lean. За даними OpenAI, над задачею паралельно працювали майже 100 ШІ-агентів, а весь експеримент із кількома великими математичними проблемами використав близько 300 млрд вихідних токенів.
Але приблизно в той самий час професор Нью-Йоркського університету Трістан Бакмастер та математик Левент Алпьоґе, який працює в Anthropic, готували власні дослідження в цій галузі. Бакмастер публічно звинуватив OpenAI в тому, що компанія тиснула на нього через згадку Алпьоґе серед авторів роботи. Він також поставив питання, чи не могло його використання Codex під час дослідження якимось чином допомогти OpenAI.
OpenAI це заперечила. У компанії заявили, що команда та ШІ-агенти не мали доступу до неопублікованої роботи дослідників, а запити Бакмастера в Codex не могли вплинути на модель, яка отримала результат. Після цього OpenAI також відмовилася від спонсорства математичного заходу в Caltech після критики з боку дослідників університету.
Раніше dev.ua писав, що нові ШІ-моделі вже почали розв’язувати складні математичні задачі, які ще донедавна вважалися надто важкими для великих мовних моделей.
/
25 лауреатів Філдсівської премії, серед яких є українська математикиня Марина В’язовська, попередили: гонка ШІ-компаній за розв’язанням найскладніших математичних задач може почати шкодити самій науці. Їх турбує те, що ШІ-компанії поспішають першими оголосити про прорив і роблять це до нормальної перевірки та з’ясування, кому належать ключові ідеї.





