Cuando una plataforma intenta adivinar qué película queremos ver, qué ruta elegiríamos para ir al trabajo o qué respuesta de un chatbot nos resulta más convincente, suele recurrir a una pregunta bastante simple: entre A y B, ¿cuál preferís? Un trabajo presentado en la conferencia ICLR 2026 sostiene que esa costumbre deja escapar información importante. Según sus autores, para captar mejor ciertos patrones de preferencia conviene mirar tríos de opciones y no solo comparaciones de dos en dos.
La idea puede sonar menor, pero toca una herramienta matemática muy usada. Los llamados modelos de utilidad aleatoria intentan describir cómo elegimos entre varias alternativas cuando nuestros gustos no son idénticos a los de otras personas, e incluso cambian según el momento o el contexto. Estos modelos se usan desde hace décadas en economía, transporte, sistemas de recomendación y, cada vez más, en el entrenamiento de sistemas de inteligencia artificial que aprenden a partir de elecciones humanas.
El nuevo trabajo analiza un problema de fondo en esa tradición. Si a muchas personas se les pide que comparen únicamente pares de opciones, ciertos vínculos entre sus gustos quedan ocultos. Por ejemplo, alguien que prefiere cine independiente quizá también tienda a valorar películas extranjeras; o una persona que apoya una política pública determinada podría inclinarse con mayor probabilidad por otra relacionada. Esas asociaciones, que ayudan a personalizar mejor una predicción, no pueden reconstruirse bien solo con duelos entre dos candidatos, según la demostración matemática del equipo.
La situación cambia cuando se pide ordenar tres alternativas. En ese caso, sostienen los autores, sí aparece información suficiente para detectar correlaciones entre preferencias y construir modelos más finos. El resultado no implica que cualquier encuesta de tres opciones sea automáticamente superior, pero sí ofrece una guía concreta sobre qué tipo de datos conviene recolectar si se quiere representar mejor la diversidad real de gustos.
Eso puede tener efectos prácticos en varios ámbitos. Una plataforma de streaming podría afinar sugerencias con menos puntos ciegos. Un sistema de transporte o planificación urbana podría estimar mejor cómo reaccionaría la gente ante cambios de rutas o inversiones públicas. Y en el terreno de la IA, donde con frecuencia se pide a personas que ordenen respuestas generadas por un modelo, este tipo de enfoque podría ayudar a captar matices que hoy quedan diluidos en comparaciones demasiado simples.
El trabajo también deja una advertencia útil: no siempre más datos equivalen a mejores modelos si los datos tienen una estructura limitada. A veces el problema no está en la cantidad de respuestas sino en el tipo de pregunta que se formula. Cambiar una comparación binaria por un pequeño ranking puede parecer un detalle de diseño, pero desde el punto de vista estadístico puede abrir información que antes estaba cerrada.
Aún así, conviene no leer el resultado como una receta universal lista para aplicarse mañana en todos los sistemas. Se trata de un avance teórico con validaciones en conjuntos de datos, no de una prueba de que cualquier producto comercial vaya a mejorar de inmediato solo por introducir ternas. También hay costos prácticos: pedir a una persona que ordene tres opciones puede ser más exigente que elegir una entre dos, y eso influye en cómo se recolectan respuestas a gran escala. Con todo, el estudio ofrece una idea clara y útil: para entender mejor nuestras preferencias, a veces dos alternativas no alcanzan.
When it comes to predicting people’s preferences, it pays to consider “the power of three” · MIT News Research
MIT News | Massachusetts Institute of Technology · Imagen acompañante del artículo fuente; atribución preservada · Fuente de imagen
Cherapanamjeri, Y., Daskalakis, C. C., Farina, G., & Mohammadpour, S. (2026). Learning Correlated Reward Models: Statistical Barriers and Opportunities. The Fourteenth International Conference on Learning Representations (ICLR). https://openreview.net/forum?id=TbEyl6krsY
Relacionadas por categoría
Ver masUna ventana al interior de los chatbots ayuda a anticipar conductas problemáticas
Un estudio del MIT probó una interfaz que muestra señales internas de un chatbot antes de usarlo y encontró que puede ayudar a anticipar rasgos como complacencia excesiva, toxicidad o empatía aparente.
Un método permite auditar modelos de IA sin generar material ilegal
Investigadores de MIT desarrollaron una técnica para detectar si un modelo generativo fue adaptado para producir material ilegal, sin pedirle nunca que lo genere.
Los modelos de lenguaje ya pueden anticipar resultados de experimentos sociales
Un estudio en Nature halló que modelos de lenguaje como GPT-4 pueden prever, con bastante acierto, el resultado de muchos experimentos de ciencias sociales.
Más de la misma fuente
Ver masNubes difusas de materia bariónica “pérdida” rodean a la mayoría de las galaxias
Un análisis con ráfagas rápidas de radio sugiere que buena parte de la materia ordinaria faltante del universo está dispersa en nubes muy extendidas alrededor de grupos de galaxias.
Un puente de concreto impreso en 3D muestra cómo construir con menos carbono
Un equipo del MIT diseñó e imprimió un puente de concreto de 2,3 metros con un sistema que adapta el diseño a los límites reales de la impresora, una vía para usar menos material en construcción.
Los campos eléctricos del cerebro podrían explicar parte de su variabilidad momento a momento
Un estudio en monos sugiere que parte de las oscilaciones cambiantes de la actividad cerebral no dependen solo de las neuronas, sino también de los campos eléctricos locales que ellas mismas generan.
Más del mismo autor
Ver masEl LHC encuentra nuevas pistas del plasma primordial en choques de oxígeno
Las cuatro grandes colaboraciones del LHC detectaron nuevas señales de plasma de quarks y gluones en colisiones de oxígeno y neón, lo que sugiere que ese estado extremo puede surgir en sistemas más pequeños.
Los castigos previos pueden dificultar aprender de las recompensas
Un estudio con 159 participantes encontró que, cuando una misma opción arrastra un historial de castigos, aprender de sus recompensas se vuelve más difícil y aumenta la exploración.
Lantana camara: una planta invasora que se propaga sin diversidad genética
Un estudio con 359 plantas de India reveló que Lantana camara, una de las especies invasoras más problemáticas del mundo, se reproduce principalmente por autofecundación y existe como líneas genéticas idénticas.