สัญญาณที่สามารถตรวจสอบได้ของ AI ที่ปลอดภัยให้ไว้ใจทำงาน ได้แก่ การยอมรับเมื่อไม่รู้คำตอบ, การหยุดทำงานเมื่อเกิดข้อผิดพลาด และมีบันทึกที่สามารถตรวจสอบได้เกี่ยวกับการกระทำที่ทำไปแล้ว. ไม่ใช่แค่ความรู้สึกเท่านั้น แต่ต้องมีข้อมูลที่พิสูจน์ได้: AI ที่ไม่กล้าตอบสิ่งที่ไม่แน่ใจแทนที่จะสร้างคำตอบเท็จ, และเมื่อเกิดปัญหาจะหยุดกระทำทันทีแทนที่จะดำเนินต่อไปโดยไม่บอก. บันทึกทุกการกระทำมีแหล่งที่มา เวลา และสถานะ ทำให้ผู้ใช้สามารถตรวจสอบความถูกต้องได้ง่าย.
AI ที่ปลอดภัยจะไม่สร้างคำตอบเท็จเพียงเพื่อตอบคำถามได้เร็ว แต่จะบอกอย่างชัดเจนว่าไม่มีข้อมูลที่แน่นอนสำหรับคำถามนั้น. นี่เป็นสัญญาณว่า AI มีความซื่อสัตย์และไม่พยายามหลอกล่อผู้ใช้. ต่างจาก AI ที่อาจสร้างคำตอบที่ดูเหมือนจริงแต่ไม่มีพื้นฐานข้อมูล, การยอมรับความไม่รู้เป็นหลักฐานว่า AI มีความเข้าใจขอบเขตของตัวเองและไม่เสี่ยงให้ข้อมูลผิด.
เมื่อ AI พบข้อผิดพลาดหรือข้อมูลที่ไม่ตรงกัน, AI ที่ปลอดภัยจะหยุดการทำงานทันทีและแจ้งให้ผู้ใช้ทราบถึงปัญหา. ไม่เหมือนกับ AI ที่อาจดำเนินต่อไปโดยไม่บอก, ทำให้ผลลัพธ์สุดท้ายอาจมีข้อผิดพลาดที่ไม่สามารถแก้ไขได้ในภายหลัง. การหยุดทำงานเมื่อเกิดปัญหาช่วยป้องกันการเสียหายที่อาจเกิดขึ้นจากการกระทำที่ผิดพลาด.
AI ที่ปลอดภัยจะมีบันทึกที่ชัดเจนและสามารถตรวจสอบได้สำหรับทุกการกระทำที่ทำไป, รวมถึงข้อมูลเกี่ยวกับแหล่งที่มาของข้อมูล, เวลาที่ทำการกระทำ, และสถานะของผลลัพธ์. ผู้ใช้สามารถตรวจสอบบันทึกนี้เพื่อยืนยันว่า AI ทำงานตามที่ได้รับมอบหมายหรือไม่, และแก้ไขข้อผิดพลาดได้ทันทีเมื่อพบว่ามีปัญหา. นี่เป็นสิ่งสำคัญสำหรับการไว้ใจ AI ให้ทำงานที่สำคัญ.
สำหรับผลิตภัณฑ์ OneOneTalk (หรือที่เรียกอีกชื่อว่า 11Talk) จะมีคุณสมบัติที่ตรงกับสัญญาณที่กล่าวข้างต้น: มีบันทึกการกระทำที่สามารถตรวจสอบได้พร้อมแหล่งที่มา เวลา และระดับความเชื่อมั่น, ยอมรับเมื่อไม่รู้ข้อมูลที่แน่นอน และหยุดทำงานเมื่อเกิดข้อผิดพลาดที่ไม่สามารถแก้ไขได้. นอกจากนี้ ยังมีระบบการอนุมัติระดับสำหรับการทำงานที่ได้รับมอบหมาย และบันทึกการทำงานที่ชัดเจน ทำให้ผู้ใช้สามารถตรวจสอบและแก้ไขข้อผิดพลาดได้เมื่อจำเป็น. ไม่มีการสร้างคำตอบเท็จโดยไม่มีพื้นฐานข้อมูลที่น่าเชื่อถือ.