Tenhle příběh má dvě vrstvy a obě jsou trochu divoké. OpenAI tvrdí, že jeho dosud nevydaný model našel řešení jednoho z Millennium Prize Problems, tedy sedmi mimořádně těžkých matematických problémů, za jejichž vyřešení je vypsán milion dolarů. Jenže místo čisté oslavy se rychle řeší i to, zda se firma nezachovala způsobem, který by mezi matematiky normálně neprošel.
88 hodin a roj deseti tisíc agentů
Šlo o problém Navierových–Stokesových rovnic, které popisují pohyb tekutin. Zní to skoro jako školní fyzika s vodou v potrubí, jenže právě v obecné podobě se matematici desítky let snaží dokázat, zda mají jejich řešení ve třech rozměrech vždy rozumné vlastnosti, nebo se mohou „rozbít“ do nekonečna. Problém odolával přibližně 90 let.
OpenAI napsalo, že jeho interní model dostal na úkol roj asi 10 000 AI agentů a k výsledku se dostal za 88 hodin. Agent tu znamená samostatně běžící instanci AI, která může dostat dílčí úkol, zkoušet postupy a předávat výsledek dál. Představa deseti tisíc takových digitálních kolegů je fascinující a upřímně i trochu únavná: já občas ztratím nit mezi dvěma otevřenými kartami.
Firma svou práci označuje za podstatný pokrok, ale milionová cena zatím nikomu nepřipadla. Ocenění spravuje Clay Mathematics Institute a z podkladu neplyne, že by důkaz nezávisle posoudil nebo uznal. OpenAI navíc říká, že o odměnu usilovat nechce. To je důležitý rozdíl: máme oznámený výsledek společnosti, ne hotový verdikt matematické komunity.
Proč se okolo důkazu mluví hlavně o etice
Den před oznámením zveřejnil profesor New York University Tristan Buckmaster práci k příbuznému problému, na níž spolupracoval s Leventem Alpögem. Ten pracuje v Anthropic, ale na této práci prý nezastupoval svého zaměstnavatele. Buckmaster následně popsal nepříjemnou komunikaci s OpenAI poté, co zjistil, že firma ví o jejich postupu.
Jeho nejvážnější otázka mířila na data z Codexu, nástroje OpenAI, který při své práci používal. OpenAI popřelo, že by model nebo výzkumníci viděli jejich práci před jejím veřejným vydáním a že by použili konkrétní uživatelská data. Současně ale připustilo, že nemůže vyloučit nepravděpodobnou nepřímou možnost: odidentifikovaná data z používání produktů mohla přispět ke zlepšování modelů. Odidentifikovaná data jsou data zbavená přímých údajů o konkrétním člověku; ani taková formulace ale v podobně citlivém sporu nepůsobí zrovna uklidňujícím dojmem.
Buckmaster rovněž popsal výroky, které vnímal jako nátlak, a tvrdil, že OpenAI chtělo, aby místo Alpögeho uvedl interní model firmy. Sébastien Bubeck z OpenAI část tohoto popisu zpochybnil a popřel, že by žádal odstranění spoluautora. Zvenčí se teď nedá poctivě rozhodnout, čí verze je správná. Časová osa je zamotaná, výzkum se překrýval a původ nápadů v práci s AI se hledá těžko.
Matematika není jen závod o první místo
Nejvíc mě zarazila samotná motivace, kterou OpenAI otevřeně popsalo. Výzkumníci zaslechli na Twitteru zvěsti, že jiní lidé postupují u problémů Millennium Prize, a rozhodli se, že to zkusí také. Podle textu The Verge firma do akce vložila miliony dolarů a šlo o rychle sestavené úsilí, aby se dostala k výsledku dřív.
Priorita samozřejmě existuje i ve vědě a lidé soutěží. Matematická kultura ale stojí také na dlouhém ověřování, sdílení postupů a na tom, že důkaz přetrvá osobní i institucionální rivalitu. Představa, že se vedle badatelů objeví firma s obrovským výpočetním rozpočtem, tisíci agentů a motivací být první, může tyto zvyklosti dost změnit. Ne nutně k horšímu ve všech ohledech, ale bez nových pravidel to bude dost třaskavé.
Pokud se důkaz obstojí, je to mimořádná ukázka toho, co AI může ve formální vědě dělat. Zároveň bych byla opatrná s větou, že AI „vyřešila matematiku“. Teď potřebujeme vědět, zda řešení projde nezávislou kontrolou, jak mu odborníci porozumějí a jak se vyjasní spor o data a chování firmy. Tohle nejsou podružné detaily kolem velkého výsledku; jsou součástí toho, zda mu bude možné věřit.
Možná právě tahle kombinace technického výkonu a lidského chaosu nejlépe ukazuje, kam se AI výzkum posunul. Model může napsat důkaz rychleji než lidé, ale důvěru, férovost a uznání v oboru za něj zatím nikdo automaticky nevygeneruje.
