OpenAI a pus la dispoziție pe GitHub 722 de manuscrise grupate în 372 de familii de rezultate. Rezultatele acoperă numeroase domenii ale matematicii, iar OpenAI a publicat și o parte dintre dovezi în Lean, un limbaj care permite verificarea formală a demonstrațiilor de către calculator.
Compania precizează însă că nu toate manuscrisele au fost formalizate și că materialele se află în stadii diferite de verificare.
„Unele dintre rezultatele neformalizate ar putea avea probleme”, avertizează chiar OpenAI în documentația repository-ului, adăugând că va continua să corecteze eventualele erori și să adauge noi formalizări.
OpenAI a publicat odată cu manuscrisele și mai multe informații despre modul în care au fost obținute rezultatele. Acestea includ 10 sinteze ale raționamentului modelului, estimări ale resurselor de calcul și statistici privind numărul de probleme încercate.
Potrivit companiei, un rezultat a utilizat, în medie, un volum de calcul echivalent cu aproximativ trei ore de gândire a ChatGPT Pro.
Modelul care a generat materialele este descris drept un model AI de ultimă generație, dezvoltat intern de OpenAI, neprecizând în anunț numele acestuia. Compania afirmă că lucrează la lansarea sa într-un mod responsabil și că intenționează să folosească rezultatele pentru a sprijini progresul cercetării matematice.
Pentru lansarea setului de rezultate, OpenAI a colaborat cu Advisory Group on Mathematics and Artificial Intelligence, un grup independent asociat Institutului pentru Studii Avansate. Grupul subliniază însă că participarea sa nu reprezintă o validare a rezultatelor și că acestea trebuie analizate de comunitatea matematică.
„Publicarea acestei lucrări este un prim pas, nu finalul procesului de înțelegere umană și de integrare a rezultatelor în cunoașterea matematică”, a transmis grupul de experți.
În recomandările sale publicate anterior, grupul ceruse ca rezultatele generate de AI să fie însoțite de explicații privind modelul folosit, instrucțiunile date acestuia, timpul de calcul și, pe cât posibil, formalizări ale demonstrațiilor. Grupul a insistat, de asemenea, asupra necesității ca matematicienii să poată înțelege și verifica rezultatele înainte ca acestea să fie preluate în cercetarea științifică.
OpenAI spune că va finanța în continuare workshopuri, conferințe și programe speciale dedicate înțelegerii rezultatelor produse de AI. Compania consideră că astfel de inițiative pot ajuta cercetătorii să verifice și să dezvolte mai departe rezultatele generate de modelele sale.
Publicarea noului set de rezultate vine la mai puțin de o lună după ce OpenAI a prezentat o demonstrație generată de sistemul său intern pentru problema existenței și regularității ecuațiilor Navier–Stokes, una dintre cele șapte Probleme ale Premiului Mileniului. Compania susține că demonstrația arată cum un fluid tridimensional, inițial aflat într-o stare regulată, poate dezvolta o singularitate într-un timp finit, printr-un mecanism bazat pe formarea și intensificarea unui vortex.
Potrivit companiei, agenții AI au ajuns la rezultat după aproximativ 88 de ore de lucru, iar formalizarea și verificarea în Lean au necesitat alte 17 ore.
OpenAI consideră că rezultatul rezolvă problema. Clay Mathematics Institute, organizația care administrează premiile, a transmis că problema a fost „aparent” rezolvată și că demonstrația trebuie analizată și verificată. Regulile institutului prevăd un proces deliberat îndelungat pentru evaluarea unei soluții.