Математичарите со договор: Решенијата на OpenAI не ги исполнуваат научните стандарди

Научната заедница алармира дека брзањето носи грешки во кодот и го заобиколува суштинското разбирање на математичките проблемите.

Американската компанија OpenAI објави стотици наводни решенија за некои од најтешките светски математички проблеми, но веднаш се соочи со сериозни критики од водечки истражувачи. Иако лабораторијата тврдеше дека се консултирала со елитна советодавна група математичари за да избегне контроверзии, независните научници предупредуваат дека новите решенија на OpenAI не ги исполнуваат научните стандарди и ја игнорираат потребата од суштинско човечко разбирање.

Советодавната група за математика и вештачка интелигенција (AGMAI), чиј домаќин е Институтот за напредни студии при Универзитетот Принстон, брои девет истакнати истражувачи од светски институции. Кон крајот на септември ова тело објави прецизни насоки за лабораториите што развиваат напредни модели. Првото и основно барање на научниците беше прекин на тестирањето на напредни математички проблеми на комерцијални модели со затворен код. OpenAI постапи токму спротивно: во официјалното соопштение компанијата директно наведе дека отворените математички проблеми ги оценува со сопствените приватни модели.

Групата AGMAI оцени дека математичката заедница треба сама да процени колку се почитувани нејзините препораки. Компанијата исполни само дел од условите, како брзо објавување на резултатите, но потфрли кај транспарентноста на процесот. Од вкупно 719 ракописи што ги пласираше OpenAI, само десет содржат детален приказ за синџирот на размислување на моделот. За трудовите што луѓето не можат лесно да ги разберат, математичарите препорачаа задолжителна формализација. Наспроти тоа, 42 отсто од решенијата не поминаа низ таков процес.

Паралелно со ова, истражувачи од Универзитетот во Кембриџ и Кралскиот колеџ во Лондон објавија труд кој директно ги доведува во прашање ваквите методи. Моделите најпрво генерираат објаснување на природен јазик, а потоа го преведуваат во специјализираниот програмски јазик Lean за машинска потврда на точноста. Анализата на британските математичари откри најмалку две значајни отстапувања меѓу текстуалниот доказ и кодот што OpenAI го понуди за проблем поврзан со равенките на Навие-Стокс, кои го опишуваат движењето на течностите. Авторите порачуваат дека автоматски формализираните докази не смеат да се прифаќаат без строга рецензија од научната заедница.

Истакнатиот математичар Теренс Тао јавно го критикуваше ваквиот развој на настаните. Тој посочи дека проблемите автономно ги решаваат лица кои само внесуваат инструкции во моделите, без интерес за пошироката научна област откако ќе ја исполнат целта. Ваквите оператори не го разбираат излезот на машината доволно за да одговорат на стручни прашања или да одржат предавање. Професорката по математика од Универзитетот Харвард, Мелани Вуд, исто така нагласи дека во моментот кога машината ќе исфрли решение нема човечко разбирање, па вистинската научна работа допрва почнува.

е-Трн да боцка во твојот инбокс