Un biolog spaniol spune că inteligența artificială i-a furat ideile și toată munca de cercetare
Compania de tehnologie Anthropic a anunțat săptămâna trecută că modelul său de inteligență artificială, Claude, a contribuit la identificarea unui „nou sistem enzimatic cu proprietăți care amintesc de CRISPR”, pe care l-a numit ART, notează elDiario.
La doar câteva ore după anunț, un articol publicat în The New York Times a dezvăluit că descoperirea acestor „transcriptaze inverse asociate unor secvențe-matrice”, prezentate drept o posibilă unealtă pentru editarea genetică, nu era atât de nouă pe cât se afirma și nici nu era o descoperire originală a inteligenței artificiale. Biologul computațional Mario Rodríguez Mestre, de la Universitatea din Copenhaga, identificase deja aceste structuri în 2022.
„Descoperirea pe care au făcut-o nu este deloc nouă, era ceva ce se știa deja”, explică cercetătorul spaniol. „Iar faptul că este o unealtă de editare genetică asemănătoare cu CRISPR nu este adevărat. Nu seamănă deloc cu CRISPR”, a adăugat acesta.
Rodríguez Mestre spune că el și echipa sa au folosit intens Claude în cercetările lor și că acest sistem de inteligență artificială avea acces la manuscrisul tezei sale, la toate dosarele partajate ale laboratorului și la e-mailurile schimbate cu colaboratorii.
„Adică, practic, la tot”, rezumă cercetătorul. „În ceea ce privește posibilitatea ca inteligența să fi preluat informația de acolo, nu am nicio dovadă care să demonstreze acest lucru, dar este o posibilitate și o suspiciune.”
Rodríguez Mestre precizează că moleculele respective sunt, de fapt, retroni: transcriptaze inverse care sintetizează ADN pornind de la o matriță de ARN necodant, în virusuri gigantice, numite jumbofagi. Această structură permite generarea unor cantități mari de ADN și deschide posibilitatea editării genetice multiple.
Echipa cercetătorului identificase și caracterizase deja în 2022 exact aceleași secvențe și structurile lor de ARN, pe care le numise „jumbotroni”. Rezultatele nu fuseseră însă publicate într-o revistă științifică și nici într-o arhivă de articole științifice în versiune preliminară. Singura modalitate prin care modelul ar fi putut avea acces la aceste informații era prin intermediul schițelor și materialelor private pe care cercetătorul le partajase cu Claude în timpul cercetărilor sale.
Inteligeța artificială, controversa care are deja un precedent
Controversa apare la câteva săptămâni după ce o altă companie de tehnologie, OpenAI, a anunțat o soluție pentru problema Navier-Stokes, una dintre cele șase mari probleme ale matematicii, pe fondul suspiciunilor că s-ar fi bazat pe ideile a doi matematicieni spanioli care lucrau la această problemă.
Biologul spaniol, care a aflat despre anunțul Anthropic după ce a fost atenționat de alți specialiști care îi cunosc activitatea, consideră că în cazul său există două posibile explicații.
Prima, pe care o consideră mai puțin probabilă, este că datele sale au fost folosite pentru realizarea descoperirii. A doua este că oamenii de știință ai companiei știau deja de existența acestor secvențe moleculare și au ghidat în mod deliberat inteligența artificială folosind date prelucrate în prealabil, pentru a forța obținerea rezultatului și a-l prezenta apoi drept o realizare autonomă a sistemului.
„Oricare dintre cele două variante mi se pare că ridică o serie de probleme care îi afectează pe orice cercetători care folosesc aceste instrumente”, afirmă el. „Ceea ce pare foarte clar este că nu a fost o descoperire autonomă a inteligenței artificiale.”
Din acest motiv, Rodríguez Mestre anunță că va renunța la instrument și îi recomandă și altor oameni de știință să facă același lucru.
„Voi înceta să folosesc Claude și, în acest moment, încerc să mut tot ceea ce aveam deja pe modele cu sursă deschisă”, spune cercetătorul. „Cred că posibilitatea ca inteligența artificială să fi fost folosită pentru a se antrena cu datele mele este reală și merită adusă în atenție.
De aceea, îi îndemn pe toți cei din comunitatea științifică să se gândească de două ori înainte de a folosi modele lingvistice proprietare și să înceapă să caute alternative, astfel încât să nu depindă de companii ale căror politici privind colectarea datelor și etica nu sunt foarte clare”, a continuat el.
Anthropic a declarat pentru The New York Times că nu are cunoștință despre existența vreunei lucrări publicate anterior care să descrie sistemul enzimatic prezentat de companie. Totodată, compania susține că Claude nu a fost antrenat cu conversațiile sau fișierele utilizatorilor și că echipa sa de biologie moleculară nu are acces la aceste informații private.
O problemă care îi îngrijorează tot mai mult pe cercetători
După anunțul OpenAI privind soluționarea uneia dintre marile probleme ale matematicii, unii dintre cei mai importanți matematicieni din lume au semnat un manifest prin care cer transparență în utilizarea acestor instrumente.
Ei au avertizat că, dacă suspiciunile privind modul în care funcționează companiile care dezvoltă inteligența artificială se extind, matematicienii ar putea înceta să își mai împărtășească rezultatele pentru a evita ca algoritmii să și le însușească. Rodríguez Mestre vrea să atragă atenția asupra aceleiași probleme și în domeniul său.
„Au început cu artiștii, apoi cu scriitorii, programatorii, iar acum a venit rândul nostru, al oamenilor de știință”, spune el. „Poate am crezut că noi nu vom fi afectați, dar iată că acum vedem pericolul.”
Toni Gabaldón, șeful grupului de Genomică Comparativă al Institutului de Cercetare Biomedicală din Barcelona, consideră că situația matematicienilor arăta deja că este foarte posibil ca o astfel de însușire a datelor din cercetare să aibă loc.
„Este un pericol de care trebuie să ținem cont”, explică acesta. „Să pornești de la ideea că firmele de tehnologie vor respecta o etică riguroasă este puțin naiv, pentru că nu există nicio modalitate de a verifica acest lucru.”
„Tu scrii pe calculatorul tău din Barcelona, iar datele ajung într-un centru de calcul din Arizona, China sau din altă parte; datele tale trec pe acolo, iar un model poate învăța din ele. Cine îți spune că nu s-a întâmplat asta?”
Gabaldón spune că a decis de ceva timp să nu folosească inteligența artificială pentru procese creative, ci doar pentru sarcini mecanice și plictisitoare. Chiar și în aceste cazuri, avertizează el, există riscuri.
„Pentru că atunci când trimiți un articol, este posibil ca un colaborator sau un evaluator să îl introducă în ChatGPT sau Claude, iar informația poate ajunge pe altă cale. În cele din urmă, nici măcar nu mai ești proprietarul ei.”
În opinia sa, Anthropic a exagerat importanța anunțului privind noul său instrument molecular, deoarece aceste molecule și altele asemănătoare sunt deja cunoscute.
„Unul dintre efectele inteligenței artificiale este că mulți oameni vor crede că au descoperit lucruri care există deja: vom reinventa roata de foarte multe ori”, anticipează Gabaldón.
Cercetătorii cer mai multă prudență
Pentru geneticianul Lluis Montoliu, de la Centrul Național de Biotehnologie al Consiliului Superior pentru Cercetări Științifice (CNB-CSIC), cazul este îngrijorător. Se presupunea că versiunile plătite ale acestor instrumente de inteligență artificială garantau că textele nu sunt distribuite către servicii de stocare în cloud.
„Totul pare să indice contrariul și mă tem că va trebui să fim mult mai atenți și să evităm să introducem experimente care nu au fost încă publicate și care ar putea reprezenta o noutate într-un anumit domeniu. Chiar și atunci când încărcăm un text doar pentru a-i corecta gramatica în limba engleză, acesta poate ajunge să intre în baza de informații a universului inteligenței artificiale”, spune el.
În opinia lui Montoliu, acest caz, împreună cu ceea ce s-a întâmplat în cazul problemei matematice abordate de OpenAI, reprezintă un „semnal de alarmă” pentru oamenii de știință, care trebuie să își regândească modul în care folosesc aceste sisteme.