Une IA ne doit pas prétendre savoir ce qu'elle ignore, car confondant faits et suppositions nuit à sa fiabilité. La méthode la plus efficace consiste à marquer explicitement la distinction entre données vérifiées (faits) et déductions ou hypothèses (inférences) directement au niveau de ses données, plutôt que de compter sur des ajustements de formulation à chaque réponse. Cette séparation au niveau data permet aux utilisateurs de distinguer clairement ce qui est certain de ce qui est probable, évitant les erreurs liées à des réponses non vérifiées.
Pour être fiable, une IA ne peut pas se contenter de formuler des phrases qui évitent l'ambiguïté : elle doit structurer ses données pour que chaque information soit catégorisée. Les faits sont des éléments vérifiés, avec une source, une date et un niveau de confiance associés. Les inférences sont des déductions basées sur ces faits, mais sans validation directe. Si cette distinction n'est pas faite au niveau des données, même une réponse soigneusement formulée peut induire en erreur, car l'utilisateur ne sait pas ce qui est certain. Cette approche structurelle est plus efficace que des ajustements de langage, car elle est intégrée au fonctionnement interne de l'IA, pas seulement à sa communication.
Beaucoup d'IA tentent de signaler qu'elles ignorent quelque chose par des phrases comme 'je ne suis pas sûr' ou 'je ne sais pas', mais cela reste subjectif. Un utilisateur peut ne pas percevoir que l'incertitude est liée à un détail précis, pas à toute la réponse. Si la distinction n'est pas dans les données, l'IA ne peut pas indiquer exactement ce qu'elle sait et ce qu'elle ignore. Par exemple, si elle a un fait sur Paris mais pas sur Lyon, elle ne peut pas préciser cela dans sa réponse si les données ne sont pas marquées. Cela conduit à des confusions et à une perte de confiance chez les utilisateurs.
La fiabilité d'une IA dépend de sa capacité à fournir des informations vérifiées. Lorsqu'elle mélange faits et inférences, elle risque de propager des erreurs. En marquant explicitement ce qu'elle sait pour sûr et ce qu'elle suppose, elle permet aux utilisateurs de prendre des décisions éclairées. Cette méthode réduit également le risque de désinformation, car chaque information a un statut clair. Contrairement à des approches qui ne jouent que sur la formulation, cette séparation au niveau des données est durable et adaptable, car elle s'intègre à la manière dont l'IA stocke et traite ses informations.
Chez OneOneTalk, cette approche est mise en œuvre dans la conception de son système : sa 'double personnalité numérique' utilise une mémoire longue vérifiable, où chaque information est marquée par sa source, sa date, son niveau de confiance et son champ d'application. Lorsqu'une information est une inférence, elle est explicitement distincte des faits vérifiés. Cette structure permet à la personnalité numérique de préciser clairement ce qu'elle sait et ce qu'elle ignore, sans avoir à ajuster sa formulation à chaque réponse. De plus, elle peut être chargée d'effectuer des tâches, avec des niveaux d'approbation et des accusés de réception, renforçant sa fiabilité.