
OpenAI zveřejnil 719 matematických prací od AI. Průlom ve vědecké práci s AI?
OpenAI zveřejnil 719 rukopisů k 372 otevřeným matematickým problémům, které napsal jeho interní model. Formálně ověřených je zhruba 42 procent hlavních výsledků. Část oboru mluví o historickém okamžiku, část vyzývá ke konci spolupráce s firmou.
Foto: Unsplash / Thomas T
Tento článek vznikl zpracováním veřejně dostupných zdrojů pomocí AI nástrojů. Každý text se snažím přečíst a věcně zkontrolovat, ale ne vždy to zvládnu. Prosím, berte na to ohled a informace si ověřujte v původních zdrojích (níže).
Tento článek vznikl zpracováním veřejně dostupných zdrojů pomocí AI nástrojů. Každý text se snažím přečíst a věcně zkontrolovat, ale ne vždy to zvládnu. Prosím, berte na to ohled a informace si ověřujte v původních zdrojích (níže).
Jake Boggan narazil na Barnettovu domněnku při studiu teorie grafů v Budapešti. Podle svých slov na ní pak s přestávkami pracoval 24 let a strávil nad ní tisíce hodin. Letos v létě si na pár dní myslel, že ji vyřešil. Tento týden ji našel v repozitáři OpenAI jako problém číslo 180, i s důkazem formalizovaným v Leanu. „Nevím, co si o tom přesně myslet,“ napsal v komentáři na Hacker News.
Takových příběhů teď bude víc. OpenAI 6. října zveřejnil na GitHubu 719 matematických rukopisů seskupených do 372 rodin podle problémů. Všechny vytvořil interní, dosud nevydaný model. Podle oznámení firmy spotřeboval průměrný výsledek výpočetní kapacitu odpovídající zhruba třem hodinám přemýšlení ChatGPT Pro. Matematický svět se rozdělil na ty, kdo mluví o historickém okamžiku, a na ty, kdo v tom vidí demonstraci síly.
Co přesně OpenAI zveřejnil
Repozitář obsahuje PDF, zdrojové soubory a knihovnu formálních důkazů v jazyce Lean. Podle README je formalizováno zhruba 42 procent hlavních výsledků. Zbytek formálně ověřený není a OpenAI sám přiznává, že „některé neformalizované výsledky mohou mít problémy“. Opravy chce firma zveřejňovat jako nové verze a předchozí verze ponechat dostupné.
Tematický záběr je široký. Podle Nature se část prací týká problémů souvisejících s Riemannovou hypotézou nebo Hodgeovou domněnkou, samotné zbývající problémy tisíciletí ale vyřešené nejsou. Engadget zmiňuje mimo jiné čtyřrozměrnou Kakeyovu domněnku a zlepšení klíčových algoritmů. Kolik problémů model podle OpenAI vyřešil úplně a kde jde jen o dílčí pokrok, firma v oznámení neuvádí.
⚡ Lean a formální verifikace důkazů
Lean je programovací jazyk a zároveň nástroj pro ověřování matematických důkazů. Důkaz se v něm zapíše tak přesně, že každý logický krok zkontroluje počítač. Když Lean důkaz přijme, je správný vzhledem k zadání. Háček je právě v zadání: pokud je věta do Leanu přeložena chybně nebo jinak, než ji matematici myslí, formálně správný důkaz dokazuje něco jiného. Proto i formalizované výsledky potřebují lidskou kontrolu, zda formální znění odpovídá původnímu problému.
Proč se matematici zlobí
Kritika nemíří primárně na správnost, ale na způsob. Prohlášení skupiny Association for Human Mathematics, které Terence Tao zveřejnil na svém blogu jako příspěvek hosta, je ostré: „Zveřejnit přes 700 souborů naráz není ukázka učenosti, ale ukázka moci.“ Autoři prohlášení vyzývají matematiky, aby se spoluprací s OpenAI skončili, a odmítají tvrzení, že vydání obor posouvá. Připomínají také, že matematici o tuto práci nežádali.
Další výhrady jsou praktičtější. Alvaro Lozano-Robledo z University of Connecticut podle Nature označil počet prací za „ohromující“ a ptal se, proč OpenAI vydává stovky řešení najednou. Nikdo nemá kapacitu je v rozumném čase zkontrolovat. MIT matematik Andrew Sutherland pro Engadget řekl, že tvrzení o řešeních z jediného promptu je třeba brát jako neověřená, dokud firma model nevydá a výsledky nepůjdou zopakovat. OpenAI prompty ani přesné výpočetní časy nezveřejnil.
Pak je tu otázka kariér. Doktorand, který na problému pracoval tři roky, může zjistit, že jeho téma přes noc vyřešil stroj. Levent Alpöge, matematik pracující v Anthropicu, podle Nature počítá se „smutnými příběhy“ lidí, jejichž projekty budou předběhnuty. Zároveň ale vydání nazval „zjevně nejvýznamnějším okamžikem v dějinách matematiky“.
Kontext: zářijová kauza Navier-Stokes
Vydání nepřichází z čistého nebe. OpenAI 8. září oznámil, že jeho model vyřešil problém Navier-Stokesových rovnic, jeden z problémů tisíciletí Clayova institutu. Oznámení provázel spor o zásluhy. Tristan Buckmaster z NYU tvrdí, že spolu s Alpögem na vlastním řešení pracovali i s pomocí nástrojů OpenAI a že firma mohla z jejich práce těžit. Sebastien Bubeck z OpenAI i Sam Altman zveřejnili vlastní, odlišnou verzi událostí.
OpenAI v reakci 21. září založil nezávislou poradní skupinu při Institute for Advanced Study. Patří do ní mimo jiné Timothy Gowers, Martin Hairer, Edward Witten a Ravi Vakil. Skupina má radit, jak výsledky ověřovat a komunikovat, výslovně ale neradí, jakým tempem má OpenAI svůj matematický výzkum vést. Říjnové vydání podle firmy vzniklo s ohledem na doporučení této skupiny. Kritici z AHM naopak tvrdí, že s nimi je v rozporu.
Co z toho plyne
Spor se točí kolem dvou otázek, které je dobré nemíchat. První je, zda jsou výsledky správné. Na tu odpoví až čas, Lean a stovky hodin lidské kontroly. U 42 procent formalizovaných výsledků je situace nadějnější, u zbytku nejistá. Druhá otázka je, kdo určuje pravidla vědy. Firma s nevydaným modelem může během jednoho dne zaplavit obor víc výsledky, než jich zvládne komunita posoudit za roky. Rozhodnutí, co je důležité, přitom nechává na ostatních: OpenAI pro Nature uvedl, že význam prací „nechá posoudit širší komunitu“.
Pro matematiku to znamená posun v ekonomice pozornosti. Vzácným zdrojem už nemusí být řešení, ale ověření a porozumění. OpenAI slibuje financovat workshopy a programy, které mají AI výsledky pomoci vstřebat, a pracuje na „zodpovědném vydání“ modelu. Dokud ale model není veřejný, zůstává nezávislá replikace mimo dosah. Jake Boggan teď stojí před stejnou otázkou jako celý obor: má problém, na kterém pracoval čtvrt století, považovat za vyřešený?
Zdroje
- Sharing AI progress in mathematics (OpenAI)
- openai/math (GitHub)
- OpenAI posts 700 maths preprints online: mathematicians are up in arms (Nature)
- AHM Statement on OpenAI's October 6 Release of Mathematical Documents (Terence Tao, What's new)
- OpenAI just posted hundreds more results on major math problems (Engadget)
- Advisory Group on Mathematics and AI (OpenAI)
- Jake Boggan o Barnettově domněnce (Simon Willison)