Modele de lume – alternativa pe care un pionier al AI o consideră esențială
Un cercetător cu contribuții fundamentale în domeniul inteligenței artificiale avertizează că direcția dominată de modele lingvistice mari (LLM) nu va conduce la o superinteligență și promovează în schimb dezvoltarea „modelor de lume”.
O privire asupra traseului unuia dintre arhitecții AI și critica sa la adresa LLM-urilor
Dezvoltatorul în cauză și-a început cariera în anii ’80, când învățarea automată era încă la începuturi, lucrând în cadrul unui laborator de cercetare academic unde a colaborat cu viitori lideri ai domeniului. A petrecut o perioadă importantă din carieră într-un institut de cercetare recunoscut pentru numeroasele sale inovații și a declarat: „Ceea ce mă entuziasmează cel mai mult este să lucrez cu oameni care sunt mai deștepți decât mine pentru că asta îți amplifică propriile abilități”.
Ulterior, a fost recrutat de fondatorul unei mari companii tehnologice pentru a conduce cercetarea în domeniul inteligenței artificiale și a primit, alături de doi colegi, cel mai important premiu din informatică pentru munca pe rețele neuronale care a stat la baza multor sisteme AI moderne.
De ce propune trecerea la modele de lume
El susține că modelele lingvistice mari – antrenate în principal pe volume uriașe de text pentru a prezice următorul cuvânt – sunt un „drum fără ieșire” în drumul spre sisteme mai inteligente decât oamenii. În locul lor, propune „modele de lume” – rețele care învață despre dinamica mediului real, integrând informații vizuale și de alt tip pentru a înțelege proprietățile spațiale și legile fizicii.
Aceste modele de lume pot procesa date vizuale și senzoriale pentru a genera simulări ale mediilor reale și sunt considerate utile în dezvoltarea roboților sau a vehiculelor autonome. Pe baza acestei viziuni, cercetătorul a sugerat că noile arhitecturi AI vor favoriza modelele care înțeleg lumea, nu doar textul.
Cuvintele cercetătorului – îndemn și avertisment
El a fost tranșant în declarații publice, afirmând: „Nu mi-am făcut prieteni în diverse colțuri din Silicon Valley, inclusiv la Meta, spunând că între trei și cinci ani de acum, modelul de lume [nu LLM-ul] va deveni modelul dominant pentru arhitecturile AI și nimeni sănătos la minte nu va mai folosi LLM-uri de genul celor pe care le avem azi”.
Totodată, le-a adresat un avertisment tinerilor cercetători: „Dacă ești doctorand în AI, nu ar trebui sub nicio formă să lucrezi la modele lingvistice mari”.
Ce înseamnă trecerea practică la modele de lume?
- Schimbarea focusului de la procesarea masivă de text la integrarea multimodală (vizual, senzorial, fizic).
- Dezvoltarea de rețele care pot simula și prezice comportamentul obiectelor în spațiu, nu doar structurarea limbajului.
- Aplicarea acestor modele în robotică și sisteme autonome, unde înțelegerea mediului este esențială.
Ce urmează
Potrivit relatărilor din presă, cercetătorul ar putea părăsi în curând structura în care lucrează pentru a înființa un startup dedicat dezvoltării de modele de lume. Această mișcare ar reflecta o orientare crescută a unor voci din comunitatea AI către abordări care integrează experiența senzorială și înțelegerea dinamicii fizice a lumii.
