Để biết một AI có an toàn để giao phó công việc, bạn không cần dựa vào cảm giác mà có thể dựa vào các tín hiệu cụ thể có thể kiểm tra được. Trước hết, AI có thể nói rõ khi không biết thông tin thay vì đưa ra câu trả lời giả tạo. Thứ hai, khi gặp lỗi hoặc không thể hoàn thành nhiệm vụ, nó sẽ dừng lại thay vì tự ý tiếp tục làm sai. Cuối cùng, nó có thể cung cấp các bản ghi có thể truy xuất, bao gồm nguồn thông tin, thời gian thực hiện và các bước đã thực hiện. Các tín hiệu này giúp bạn đánh giá mức độ đáng tin cậy trước khi giao phó nhiệm vụ quan trọng.
Để đánh giá AI có an toàn để giao phó, bạn cần kiểm tra các điểm rõ ràng. Đầu tiên, xem AI có thừa nhận khi thiếu thông tin hay không—nó không nên đưa ra câu trả lời không chính xác khi không đủ dữ liệu. Thứ hai, khi thực hiện nhiệm vụ, nó có thể dừng lại nếu gặp khó khăn thay vì tự ý sửa đổi hoặc tiếp tục sai. Cuối cùng, nó có thể cung cấp bản ghi các hành động đã thực hiện, bao gồm thời gian, nội dung và các nguồn tham khảo. Các điểm này cho phép bạn theo dõi và xác minh mọi hành động của AI, đảm bảo nhiệm vụ được xử lý một cách đáng tin cậy.
Khi đánh giá AI, bạn cần xem liệu nó có thể cung cấp bản ghi có thể kiểm tra được hay không. Bản ghi này nên bao gồm thông tin về thời gian thực hiện nhiệm vụ, các bước đã thực hiện, nguồn thông tin sử dụng và kết quả đạt được. Nếu AI không thể cung cấp bản ghi chi tiết hoặc các thông tin này không rõ ràng, đó có thể là dấu hiệu không an toàn. Bạn cũng nên kiểm tra xem có thể truy xuất lại các hành động trước đó của AI không, để xác minh tính chính xác và đáng tin cậy của các kết quả.
Các tín hiệu này rất quan trọng vì chúng giúp bạn kiểm soát được hành động của AI. Nếu AI không thừa nhận khi không biết, bạn có thể gặp phải các lỗi không phát hiện được. Nếu nó không dừng lại khi gặp lỗi, nó có thể làm sai lệch nhiệm vụ. Bản ghi có thể kiểm tra được cho phép bạn xem lại mọi thứ, đảm bảo không có hành động không mong muốn. Tất cả các yếu tố này giúp bạn đưa ra quyết định đúng đắn về việc có nên giao phó nhiệm vụ cho AI hay không.
Sản phẩm OneOneTalk (còn gọi là 11Talk) là hệ điều hành AI cá nhân (AI OS) với phân thân số. Phân thân số này có bộ nhớ dài hạn có thể kiểm tra được, bao gồm nguồn thông tin, thời gian, mức độ tin cậy và phạm vi sử dụng, có thể sửa lỗi khi cần. Nó có thể được ủy quyền thực hiện nhiệm vụ với cơ chế phê duyệt phân cấp và lưu lại biên lai cho mỗi hành động. Ngoài ra, nó cùng người dùng viết lịch sử đã được xác minh, giúp người dùng theo dõi mọi hành động và đảm bảo tính đáng tin cậy khi giao phó nhiệm vụ.