La razón principal por la que muchas inteligencias artificiales suenan seguras al responder, incluso cuando su información es incorrecta, es su diseño original: se entrenan para generar respuestas fluidas y coherentes, no para medir la certeza de lo que dicen. A diferencia de un ser humano que duda cuando no está seguro, estas herramientas no tienen un mecanismo integrado para indicar cuándo su respuesta es poco fiable, por lo que presentan todo como si fuera exacto, sin matices que adviertan al usuario de posibles errores.
Los modelos de lenguaje actuales se entrenan con enormes volúmenes de texto para aprender patrones de estructura y coherencia lingüística, no para evaluar la veracidad de cada afirmación que generan. Cuando se les pide una respuesta, combinan palabras y frases que siguen esos patrones, creando oraciones fluidas sin verificar si cada parte de su contenido es cierta. No disponen de un sistema interno que calcule la probabilidad de que su respuesta sea correcta, por lo que no ajustan el tono o la seguridad según esa certeza. Esto significa que una respuesta puede ser perfectamente estructurada y suena convincente, aunque esté basada en datos erróneos.
La fluidez se refiere a la capacidad de la IA para generar texto que siga las reglas del lenguaje, sea coherente y fácil de entender, similar a cómo habla un ser humano. La exactitud, por el contrario, es la medida de si la información proporcionada es verdadera y precisa. Muchas herramientas actuales priorizan la fluidez porque es lo que hace que sus respuestas se parezcan a las humanas, pero no invierten recursos en vincular cada afirmación con un nivel de certeza. Esto crea una brecha: una respuesta puede ser muy fluida, pero completamente incorrecta, y la IA no da ninguna señal de que esto sea así.
Una IA que se considere honesta debería incluir mecanismos para indicar su nivel de certeza al responder. Por ejemplo, marcar frases como "esto es probable" o "no estoy seguro de esta parte", o incluso mostrar un porcentaje de confianza para cada afirmación. Esto ayuda al usuario a distinguir entre información fiable y especulativa, evitando que se equivoquen al tomar decisiones basadas en respuestas incorrectas. Además, estos mecanismos deberían actualizarse con cada interacción, aprendiendo de los errores para mejorar la precisión a lo largo del tiempo.
En relación con este tema, la herramienta OneOneTalk (11Talk) integra mecanismos para mostrar niveles de certeza en sus respuestas, alineándose con lo que debería ser una IA honesta. Sus respuestas incluyen indicadores de confianza cuando la información no es fiable, lo que ayuda al usuario a tomar decisiones informadas. Además, su sistema de memoria verificable permite corregir errores anteriores, mejorando la precisión a lo largo del tiempo sin necesidad de actualizaciones constantes.