Rendiment i riscos per cas particular

Hernández-Orallo (VRAIN-UPV/ValgrAI) lidera un estudi internacional publicat en Science que planteja un canvi profund en l'avaluació dels sistemes d'IA

[ 04/09/2026 ]

Des de Silicon Valley fins a la Xina, bona part de la carrera mundial per la intel·ligència artificial (IA) persegueix un mateix objectiu: desenvolupar una IA general capaç d'igualar o superar les capacitats humanes i, a partir d'ací, una “superintel·ligència”.

No obstant això, un article publicat avui en Science i liderat per l'investigador de la Universitat Politècnica de València (UPV), José Hernández-Orallo, qüestiona aquesta visió i planteja un canvi profund en la manera d'entendre i avaluar els sistemes d'IA.

En l'article, en el qual participen també investigadors de la Universitat de Cambridge, la Universitat de Princeton, el MIT (sigles en anglès de l'Institut Tecnològic de Massachusetts) i Google DeepMind, els autors sostenen que l'obsessió per mesurar si una intel·ligència artificial aconsegueix o supera el nivell humà reprodueix, en el fons, la mateixa lògica de l'històric Test de Turing, “un referent que durant dècades va marcar el desenvolupament de la disciplina, però que avui resulta insuficient per a avaluar els sistemes actuals”, apunta Hernández-Orallo, investigador de l'Institut VRAIN de la UPV i membre de ValgrAI.

Nou marc per a evitar concepcions antropomòrfiques

Enfront d'aquesta visió, i per a evitar caure en concepcions antropomòrfiques de la intel·ligència artificial, l'equip investigador proposa un nou marc basat en tres perspectives complementàries.

En primer lloc, exploren com avaluar diferents perfils cognitius, compostos de capacitats i propensions abstractes, en diversitat. En segon lloc, es pregunten com es pot avaluar la cognició humana tal com es transforma per noves maneres de pensar junt a la IA, és a dir, que en lloc de preguntar-se quines tasques poden substituir les màquines, els investigadors proposen analitzar com canvia la manera de pensar quan humans i IA treballen conjuntament.

Finalment, l'equip de la UPV, Cambridge, Princeton, el MIT i Google DeepMind també defensa que, en lloc de comprovar el nivell d'alineació de la IA amb els valors humans, s'ha d'avaluar l'efecte global: els beneficis i els danys de les intervencions de la IA en la societat. Per a això, proposen analitzar els beneficis i els possibles riscos que pot generar cada sistema d'IA abans del seu desplegament, utilitzant entorns de prova que permeten simular diferents escenaris i anticipar el seu impacte. “L'objectiu final és respondre a una pregunta clau: si la societat estarà realment millor després d'incorporar una determinada IA”, afirma Jose Hernández-Orallo.

Una situació especialment urgent atesa l'enorme acceleració tecnològica

Segons els investigadors, el desenvolupament de nous mètodes d'avaluació resulta especialment urgent en un moment d'enorme acceleració tecnològica, marcat per la ràpida evolució dels models basats en arquitectures del transformador i l'aparició constant de nous agents d'IA. En aquest context, sostenen que el principal repte ja no consisteix únicament a construir models cada vegada més potents, sinó a desenvolupar eines que permeten comprendre el seu comportament, explicar les seues decisions i anticipar tant els seus beneficis com els seus riscos.

“El futur de la IA dependrà tant de la seua capacitat tècnica com de la nostra capacitat per a avaluar-la correctament. Només així serà possible impulsar un desenvolupament responsable, segur i alineat amb les necessitats reals de la societat”, conclou José Hernández-Orallo.

Notícies destacades


Encara queden places Encara queden places
Ets a temps de sol·licitar l'accés a dos títols de la UPV: el Grau en Ciències Ambientals (Gandia), i el Grau en Conservació i Restauració de Béns Culturals (València)
Prop de l'excel·lent Prop de l'excel·lent
Tres edificis del campus de Vera han aconseguit la màxima categoria d'eficiència energètica, després de la realització d'obres de millora
Ronda d'inversió històrica Ronda d'inversió històrica
iPronics aconsegueix 108 milions d'euros per a construir la infraestructura fotònica de la intel·ligència artificial
Doblet històric Doblet històric
El FSUPV Team conquesta Formula Student Àustria i reafirma el lideratge mundial de la UPV en enginyeria universitària
Apunta-t'hi! Apunta-t'hi!
Fotografia, disseny audiovisual, edició de vídeo, gestió cultural, art contemporani... Inscriu-te en els cursos de cultura de setembre i octubre


Contacta amb nosaltres

Envia'ns un suggeriment, una queixa o una felicitació. Consulta'ns directament els teus dubtes. Evita desplaçaments i esperes