Rendimiento y riesgos por caso particular

Hernández-Orallo (VRAIN-UPV/ValgrAI) lidera un estudio internacional publicado en Science que plantea un cambio profundo en la evaluación de los sistemas de IA

[ 04/09/2026 ]

Desde Silicon Valley hasta China, buena parte de la carrera mundial por la inteligencia artificial (IA) persigue un mismo objetivo: desarrollar una IA general capaz de igualar o superar las capacidades humanas y, a partir de ahí, una “superinteligencia”.

Sin embargo, un artículo publicado hoy en Science y liderado por el investigador de la Universitat Politècnica de València (UPV), José Hernández-Orallo, cuestiona esta visión y plantea un cambio profundo en la forma de entender y evaluar los sistemas de IA.

En el artículo, en el que participan también investigadores de la Universidad de Cambridge, la Universidad de Princeton, el MIT (siglas en inglés del Instituto Tecnológico de Massachusetts) y Google DeepMind, los autores sostienen que la obsesión por medir si una inteligencia artificial alcanza o supera el nivel humano reproduce, en el fondo, la misma lógica del histórico Test de Turing, “un referente que durante décadas marcó el desarrollo de la disciplina, pero que hoy resulta insuficiente para evaluar los sistemas actuales”, apunta Hernández-Orallo, investigador del Instituto VRAIN de la UPV y miembro de ValgrAI.

Nuevo marco para evitar concepciones antropomórficas

Frente a esta visión, y para evitar caer en concepciones antropomórficas de la inteligencia artificial, el equipo investigador propone un nuevo marco basado en tres perspectivas complementarias.

En primer lugar, exploran cómo evaluar diferentes perfiles cognitivos, compuestos de capacidades y propensiones abstractas, en diversidad. En segundo, se preguntan cómo se puede evaluar la cognición humana tal como se transforma por nuevas formas de pensar junto a la IA, es decir, que en lugar de preguntarse qué tareas pueden sustituir las máquinas, los investigadores proponen analizar cómo cambia la forma de pensar cuando humanos e IA trabajan conjuntamente.

Por último, el equipo de la UPV, Cambridge, Princeton, el MIT y Google DeepMind también defiende que, en lugar de comprobar el nivel de alineación de la IA con los valores humanos, se tiene que evaluar el efecto global: los beneficios y los daños de las intervenciones de la IA en la sociedad. Para ello, proponen analizar los beneficios y los posibles riesgos que puede generar cada sistema de IA antes de su despliegue, utilizando entornos de prueba que permitan simular distintos escenarios y anticipar su impacto. “El objetivo final es responder a una pregunta clave: si la sociedad estará realmente mejor después de incorporar una determinada IA”, afirma Jose Hernández-Orallo.

Una situación especialmente urgente dada la enorme aceleración tecnológica

Según los investigadores, el desarrollo de nuevos métodos de evaluación resulta especialmente urgente en un momento de enorme aceleración tecnológica, marcado por la rápida evolución de los modelos basados en arquitecturas transformer y la aparición constante de nuevos agentes de IA. En este contexto, sostienen que el principal desafío ya no consiste únicamente en construir modelos cada vez más potentes, sino en desarrollar herramientas que permitan comprender su comportamiento, explicar sus decisiones y anticipar tanto sus beneficios como sus riesgos.

“El futuro de la IA dependerá tanto de su capacidad técnica como de nuestra capacidad para evaluarla correctamente. Solo así será posible impulsar un desarrollo responsable, seguro y alineado con las necesidades reales de la sociedad”, concluye José Hernández-Orallo.

Noticias destacadas


Aún quedan plazas Aún quedan plazas
Todavía estás a tiempo de solicitar el acceso a dos títulos de la UPV: el Grado en Ciencias Ambientales (Gandia), y el Grado en Conservación y Restauración de Bienes Culturales (València)
Cerca del sobresaliente Cerca del sobresaliente
Tres edificios del campus de Vera han alcanzado la máxima categoría de eficiencia energética, tras la realización de obras de mejora
Ronda de inversión histórica Ronda de inversión histórica
iPronics consigue108 millones de euros para construir la infraestructura fotónica de la IA
Doblete histórico Doblete histórico
El FSUPV Team conquista Formula Student Austria y reafirma el liderazgo mundial de la UPV en ingeniería universitaria
¡Apúntate! ¡Apúntate!
Fotografía, diseño audiovisual, edición de vídeo, gestión cultural, arte contemporáneo... Inscríbete en los cursos de cultura de septiembre y octubre


Contacta con nosotros

Envía una sugerencia, queja o felicitación. Consulta directamente tus dudas. Evita desplazamientos y esperas.