
Cuando le preguntas algo a un chatbot, con frecuencia recibes un montón de texto, quizá con una o dos imágenes sacadas de internet. Pero ahora OpenAI está renovando por completo la forma en que ChatGPT responde a las preguntas.
El miércoles, OpenAI presentó una actualización de la “interfaz de usuario inteligente” de ChatGPT. Genera elementos visuales personalizados, cuando es útil y pertinente, para responder a las preguntas de los usuarios. La nueva experiencia de la empresa se basa en su reciente modelo GPT-6, que se puso ayer a disposición de los usuarios de pago y a partir de hoy para los usuarios gratuitos.
Probamos la nueva interfaz
Pude probar rápidamente la interfaz de usuario antes de su lanzamiento, y estos elementos visuales me parecieron un cambio muy positivo. Cuando pedí un diagrama de una babosa, ChatGPT generó una imagen centrada en su anatomía con botones que podía pulsar para ver cada parte, desde los tentáculos superiores hasta el pie muscular. También generé una calculadora de la asequibilidad de los departamentos en San Francisco, con controles deslizantes para ajustar los ingresos y otros gastos; mostraba también qué porcentaje de mi salario neto costarían las diferentes viviendas.
Lo que más me gustó de esta breve prueba práctica con la interfaz de usuario inteligente de ChatGPT fue un explorador de asientos de avión. No me gusta sentarme en las filas de salida, así que le pedí a ChatGPT que generara una herramienta personalizada para comparar la distribución de la cabina entre cuatro aviones diferentes de Alaska y Delta. En el resultado, podía pulsar cualquier asiento del mapa para obtener más detalles, y ChatGPT resaltaba las filas de salida en verde.
No es para todo
Aunque resulta útil en algunos casos, no todas las respuestas de ChatGPT incluyen de repente un gráfico o una tabla. “Contamos con un equipo de diseño que ha dedicado mucho tiempo a determinar cuándo añadir un diagrama, un gráfico o botones aporta valor, y cuándo empieza a dar sensación de desorden”, aclara Aarush Selvan, gestor de producto de OpenAI. Si un usuario no está interesado en los elementos visuales, puede indicarle a ChatGPT que genere menos resultados de ese tipo.
Estos resultados visuales son similares a lo que Google anunció a principios de este año para su buscador, cuando amplió los resultados personalizados que los usuarios pueden ver. La versión de Google se denomina “interfaz de usuario generativa”. Un ejemplo: si quieres comprender mejor el espacio profundo, el buscador puede mostrar un gráfico ajustable que desglosa cómo funcionan los agujeros negros, utilizando varios controles deslizantes.
Las experiencias con los chatbots se han vuelto cada vez más multimodales, lo que significa que el texto, las imágenes y la voz se fusionan en una única experiencia de usuario. El lanzamiento por parte de OpenAI de una versión actualizada de ChatGPT, más agradable a la vista y más interactiva para más de mil millones de usuarios, indica que la era multimodal ya está aquí. Con un cambio hacia las interfaces de usuario generativas, la IA dicta cada vez más el aspecto que tiene el software para cada usuario.
Ahora que las herramientas de IA son capaces de generar rápidamente software a la medida, el futuro de los chatbots será aún más personalizado y adaptado a lo que quiero ver, y lo que quiero ver son diagramas de babosas. ¡Adiós para siempre a los muros de texto!
Artículo originalmente publicado en WIRED.com. Adaptado por Mauricio Serfatty Godoy.


