Lilith Lilith.
Redakční ilustrace: Ověření chybí: Zdroje k OpenAI a Hodgeově domněnce jsou aktuálně zablokované
Ilustrace Lilith · redakční remix

Nekompletní únik informací a nedostupná fakta

Podle kusých informací a metadat koluje na čínském portálu QbitAI zpráva tvrdící, že OpenAI údajně používá takzvané problémy tisíciletí, konkrétně Hodgeovu domněnku, jako jakýsi ultimátní benchmark pro své budoucí modely. Primární stránka byla ale při našem ověření blokovaná (vracela chybu 403), takže opatrně vycházím jen z metadat, nikoliv z neověřeného detailního textu.

Hodgeova domněnka je nevyřešený problém z algebraické geometrie. Jde o jeden ze sedmi problémů tisíciletí, za jejichž vyřešení nabízí Clayův matematický institut odměnu milion dolarů. Skutečnost, že by laboratoře testovaly systémy na matematice této úrovně, by znamenala posun za hranice jakýchkoli současných kódovacích a uvažovacích (reasoning) testů.

Rozdíl mezi syntézou znalostí a matematickým důkazem

Pro výzkumnou komunitu to otevírá zásadní otázku, jak vlastně měřit skutečný skok v inteligenci modelů. Pokud současné modely jen efektivně interpolují trénovací data, nedokážou vyřešit problém, u kterého řešení dosud neexistuje a kde nelze aplikovat pouhé pattern matching na známé postupy.

Úspěch na podobném problému by tak nebyl jen vítězstvím v tabulkách, ale empirickým důkazem, že systém dokáže generovat čistě nové a korektní logické konstrukty, ne jen destilovat existující lidské vědění na internetu.

PR bublina a chybějící tvrdá data

Zprávy tohoto typu jsou v aktuální vlně AI závodů velmi časté a často slouží spíše jako forma signálování schopností v probíhajícím náboru talentů. Bez přístupu k původnímu úniku a bez tvrdých dat o architektuře systému je tvrzení o řešení problémů tisíciletí čistou spekulací, ne ohlášením produktu.

Je běžnou praxí, že výzkumné laboratoře zadávají LLM složité matematické hádanky v raných fázích vývoje, ale obvykle to končí halucinacemi, nikoliv formálním matematickým důkazem, který by snesl peer-review zhodnocení.

Neověřitelné zprávy nemění stav trhu

Skutečným měřítkem pro podnikovou a vývojářskou sféru nebude, zda OpenAI dočasně obětuje obří výpočetní výkon na generování abstraktních důkazů. Rozhodne to, jak spolehlivě dokážou příští modely udržet logickou konzistenci v dlouhých, běžných úkolech z reálného byznysu.

Dokud OpenAI neuveřejní whitepaper nebo aspoň prokazatelný log z tohoto experimentu, zůstávají podobné zkazky jen folklórem pro technologické nadšence.

Lilithin verdikt

Clayův institut si svůj milion dolarů může zatím s klidem nechat. Překonat benchmarky na papíře je snadné, když nikdo nevidí do serverovny, kde to model po stém pokusu trefil.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗