OpenAI a anunțat publicarea pe platforma GitHub a unui set substanțial de rezultate matematice, generate de un model de inteligență artificială care nu a fost încă lansat public. Această colecție include un total de 722 de manuscrise, care sunt grupate în 372 de familii de rezultate, acoperind diverse domenii ale matematicii. Compania a inclus și o parte din dovezi utilizând Lean, un limbaj specializat care permite computerelor să verifice formal demonstrațiile matematice.
Deși volumul de informații este considerabil, OpenAI a avertizat că nu toate manuscrisele au fost formalizate și că materialele se află în stadii diferite de verificare. În documentația repository-ului, compania precizează că unele dintre rezultatele neformalizate ar putea prezenta probleme, promițând însă că va continua procesul de corectare a eventualelor erori și adăugarea de noi formalizări. Procesul de cercetare implică o monitorizare atentă pentru a asigura progresul în domeniul matematicii.
Pentru a oferi transparență, OpenAI a publicat detalii despre modul în care au fost obținute aceste rezultate, incluzând 10 sinteze ale raționamentului modelului și statistici privind numărul de probleme încercate. Datele oferite cuprind și estimări ale resurselor de calcul utilizate, un rezultat utilizând, în medie, un volum de calcul echivalent cu aproximativ trei ore de gândire a ChatGPT Pro. Modelul de ultimă generație este dezvoltat intern, însă compania nu a precizat numele acestuia.
Colaborarea pentru lansarea acestui set de date a avut loc cu Advisory Group on Mathematics and Artificial Intelligence, un grup independent asociat cu Institutul pentru Studii Avansate. Membrii grupului au subliniat că participarea lor nu reprezintă o validare a rezultatelor, insistând ca acestea să fie analizate de comunitatea matematică. Experții au declarat că această publicare reprezintă doar un prim pas în procesul de înțelegere umană și de integrare a noilor cunoștințe în domeniul matematicii.
OpenAI intenționează să sprijine cercetătorii prin finanțarea unor workshopuri, conferințe și programe speciale dedicate înțelegerii rezultatelor produse de inteligența artificială. Această strategie vizează facilitarea verificării și dezvoltării ulterioare a descoperirilor generate de modelele sale. Compania consideră că astfel de inițiative sunt esențiale pentru ca matematicienii să poată valida și integra corect aceste descoperiri în cercetarea științifică oficială.
Această mișcare urmează o demonstrație recentă a sistemului intern OpenAI referitoare la problema existenței și regularității ecuațiilor Navier–Stokes, una dintre cele șapte Probleme ale Premiului Mileniului. În acel caz, agenții AI au lucrat aproximativ 88 de ore, urmate de 17 ore de formalizare în Lean. Clay Mathematics Institute a menționat că problema a fost aparent rezolvată, dar că procesul de evaluare a unei astfel de soluții trebuie să urmeze regulile stricte ale institutului.