可验证的意思是:AI 对你的每一条长期记忆,你都能打开看到它从哪来(来源)、什么时候记的(时间)、有多确定(置信度)、允许用在哪(作用域),并且能当场纠正。缺了任何一项,「它很懂你」就只能靠你选择相信。这一页讲清这四个词分别是什么意思,以及 OneOneTalk 把它们做成了哪些具体字段与流程。
这四个词经常被当成营销形容词用,但它们在工程上各有明确所指。下面每一条都对应 OneOneTalk 记忆记录结构里的一个真实字段。
第五样东西是纠错入口。前四项让你看得见,纠错入口让你改得动。只能看不能改的「记忆透明化」,在实践中很快会退化成一个没人再打开的页面。完整的记忆主权动作面见数字分身页。
很多人以为置信度是「AI 对自己这句话有多自信」。在记忆系统里不是——那是模型输出的属性,而置信度是这条关于你的记录被证据支持的程度。两者可以完全背离:模型可以非常流畅、非常笃定地复述一条来源单薄的猜测。
「可验证」的另一半,是不能把不同来路的信息混在一个池子里。每条记录都必须标注真实性状态:已确认事实、你的偏好、推断、故事设定。
差别在使用方式上:「你可能偏好先看证据再下结论」和「你说过要先看证据再下结论」,在系统里是两种东西,前者不允许以后者的口吻出现在建议里。这条不是文案纪律,是记忆检索规则的一部分——推断不得在建议中被表述为你的事实。
故事设定单独成一类,指的是数字分身自己的角色世界观。它与关于现实的事实库隔离存放,永远不作为关于现实的证据被引用。这样做的代价是系统更复杂,好处是分身在陪你演一段故事时说的话,不会渗进它对真实的你的判断里。
对外表达也沿用这条分界:分身替你在站内发言时只引用你确认过的事实与偏好层,推断与故事设定不外发——分身不能替你把猜测说成立场。
元信息是静态的,真正决定记忆可不可信的是写入、修改、调用这三个时刻的流程。以下三条已在 Web 版记忆账本里可以直接看到。
分身想记住一件关于你的事,会先出一张候选卡:要记的内容、为什么想记住、建议的作用域,配「记下来」和「不要记」两个按钮。没有一条会自己进账本。敏感信息需要单独同意。
看记忆机制你改写一条记忆,保存后它升为「已确认事实」,并接替原来那条记录;旧记录不消失,变更历史保留。账本可以按日期回看——你看到的是那一天的理解,被后来推翻的结论仍在那里,因为它当时成立。
看数据主权除此之外,账本支持逐条冻结(不再参与召回,可随时解冻)、遗忘,以及一次性导出为 starmap/v1 格式的全字段无损文件。这些入口不消耗任何站内积分,也不受订阅状态影响——记忆不是赎金。
检索增强生成(Retrieval-Augmented Generation,Lewis 等人 2020 年发表于 NeurIPS 的论文提出)已经让「回答要能指出依据」成为工程通行要求。长期记忆需要的是同一思路的更长周期版本。
两者的分工可以这样区分:RAG 的引用是单次可溯——这一次回答的依据能不能被指出来;记忆元信息是持续可溯——它长期以来对你的判断能不能被指出来、被推翻。一次回答引错了,下一轮重新检索就过去了;一条关于你的记忆错了,它会持续影响之后的每一次判断,所以必须可查看、可纠正、可遗忘。
更早的通用做法来自数据溯源标准。W3C 的溯源本体 PROV-O(W3C 推荐标准,2013 年 4 月 30 日发布)把溯源拆成三个要素:实体、活动、代理——什么东西、在什么活动里、由谁产生。记忆账本里的来源引用、创建时间与候选确认记录,正是这三要素落在「AI 对一个人的理解」上的形态。
合规侧也在往同一个方向收。《中华人民共和国个人信息保护法》(2021 年 11 月 1 日施行)第四十六条规定:「个人发现其个人信息不准确或者不完整的,有权请求个人信息处理者更正、补充。」同法还规定,个人有权要求个人信息处理者对其个人信息处理规则进行解释说明。《生成式人工智能服务管理暂行办法》(2023 年 8 月 15 日施行)则要求服务提供者采取有效措施,「提升生成式人工智能服务的透明度,提高生成内容的准确性和可靠性」。
把这两条并在一起看,结论很直接:一个说不清自己凭什么这样理解你、也无法被你更正的 AI 记忆系统,不只是体验不好,法律上也是站不住的。
| 你会问的问题 | 行业常见做法 | OneOneTalk 的做法 |
|---|---|---|
| 它凭什么这样想我 | 无法追问;记忆由后台自动总结,写入时机对用户不可见 | 每条带来源引用与创建时间;保存前先展示内容、原因、来源、预计用途与保留期限,你确认才写入 |
| 这是事实还是猜测 | 混在一起,猜测在建议里以「你说过」的口吻出现 | 标注已确认事实 / 你的偏好 / 推断 / 故事设定,推断不得被表述为你的事实 |
| 它有多确定 | 没有这个概念,或只在内部使用不对外 | 0 到 1 的置信度对你可见;低置信、过期、冲突的记录只能作为问题提出,不能作为结论 |
| 它会用在哪 | 一旦记下就全局可用 | 作用域字段限定范围;面向他人或对外产物时,私人记忆默认不进入上下文 |
| 记错了怎么办 | 只能整体关闭记忆功能,或删掉重来 | 逐条纠正,新记录接替旧记录并保留变更历史;也可冻结、限域或遗忘 |
| 新旧矛盾时 | 静默覆盖,你不会知道发生过什么 | 不静默覆盖:展示冲突,请你确认或降低旧记录的置信度 |
| 能不能带走 | 导出的是聊天记录,不是结构化的理解 | 导出 starmap/v1 全字段无损文件,含记忆与候选记忆 |
这一页讲的是可验证,所以我们自己的边界也应该可验证。以下是明确还没做到或还在建设中的部分。
指 AI 对你的每一条长期记忆都能被打开、被检查、被推翻。最低判据是四项元信息加一个纠错入口:来源(这条理解从哪几次对话或哪份材料长出来的)、时间(什么时候记下的、最后一次被验证是什么时候)、置信度(这条记录被证据支持的程度)、作用域(允许在什么范围内被调用)。缺了任何一项,「它很懂你」就只能靠你选择相信。
不是。置信度衡量的不是模型对自己输出的把握,而是这条关于你的记录被证据支持的程度,取值在 0 到 1 之间,和来源、最后验证时间一起存。它主要靠你的确认提升,不靠同一句话反复出现——说十遍不等于真。低置信度、已过期或处于冲突状态的记录只能作为问题被提出,例如「你现在还是更看重这个吗」,不能作为结论直接用在建议里。
能改,而且旧的那条不会凭空消失。在记忆账本里逐条纠正,保存后新说法升为「已确认事实」,并接替原来那条记录,变更历史保留。账本还可以按日期回看:你看到的是那一天的理解,被后来推翻的结论仍在那里,因为它当时成立。除了纠正,你还可以冻结(不再参与召回,可随时解冻)或直接忘掉。
两个入口。一是重要建议会展示「本次用到了哪些关于你的信息」,而不是让你猜它为什么这么说。二是长对话或重要任务开始时,分身会告诉你它带上了多少条记忆一起想——只报数量,不报内容;点开这个数字可以回到记忆账本逐条核对。
同源但不同层。RAG 的引用解决的是「这一次回答的依据能不能被指出来」,是单次可溯;长期记忆要解决的是「它长期以来对你的判断能不能被指出来、被推翻」,是持续可溯。一次回答的引用错了,下一次重新检索就好;一条关于你的记忆错了,它会持续影响之后的每一次判断,所以必须可查看、可纠正、可遗忘。