- július 11-én az OpenAI bejelentette, hogy a GPT-5.6 Sol Ultra kevesebb mint egy óra alatt bizonyította a Cycle Double Cover sejtést, egy mintegy ötven éve fennálló gráfelméleti problémát. A modell 64 ügynökre oszlott, amelyek egymás bizonyításait támadták és ellenőrizték.
Néhány nappal később Tokióból Yuji Tachikawa fizikus egy, hat hónapja elakadó húrelméleti feladatot adott Claude Fable 5-nek; a modell egy éjszaka alatt megoldást adott, majd saját válaszának ellenőrzésére kódot is írt. Mindkét modellt a nyilvánosság számára hozzáférhetőnek tették.
Mi változik a gyakorlatban?
Korábban létezett egy egyfajta „álibi” az ilyen áttörésekre: korábbi, jelentős eredményeket futtathattak zárt, nem elérhető modelleken, így a felfedezés ritkasága nem a tudományos közösségre, hanem a zárt laborokra szorult. Az mostani esetekkel ez az alibi megszűnt: mindkét bizonyítás és ellenőrzés olyan modellekkel készült, amelyekhez bárki hozzáférhet egy bejelentkezéssel.
A másik fontos változás, hogy a modellek nem csupán megoldásokat javasoltak, hanem részben vagy teljesen saját maguk hitelesítették azokat — például egymás kritikáján alapuló ügynökrendszerrel vagy az eredményekhez írt ellenőrző kóddal. Ennek következtében kétféle ritkaság egyszerre veszíthet értékéből: aki felfedezhet új eredményt, és aki hitelesítheti azt.
Mi a tét?
A helyzetnek gyakorlati következményei lehetnek a tudományos kutatás szerkezetére: ha nyilvános modellek gyorsan és önellenőrzéssel szolgálnak megoldásokat, az megváltoztathatja a felfedezések elosztását és a szakmai ítélet szerepét. A példák — GPT-5.6 Sol Ultra által végrehajtott, 64 ügynökös bizonyítási folyamat és Claude Fable 5 által egy éjszaka alatt megoldott, majd kódolt ellenőrzés — azt mutatják, hogy ezek a képességek ma már előfizetéses vagy nyilvános hozzáférés mellett is elérhetők.
Következő lépések
A közösségi és intézményi válaszok kérdései között szerepel, hogyan értékeljük és publikáljuk az ilyen, gépi eredetű bizonyításokat és ellenőrzéseket, illetve milyen szerepet töltenek be ezután a hagyományos peer review és emberi szakértői folyamatok. Az új helyzet jelentős hatással lehet arra, hogy ki és hogyan részesül a tudományos felfedezésekből.



