先梳理所有重复的记忆条目,按来源可信度、时间优先级排序,保留核心信息最完整、置信度最高的一条,删除冗余重复项,确保每条记忆唯一且无矛盾,避免信息混乱。
本做法适用于 AI 存储系统中存在同一件事的多条重复记录,导致信息重复、矛盾或干扰后续使用的情况。不适用于非 AI 记忆类的信息错误,比如用户自身记错的内容、不同事件的相似记录,也不适用需要保留所有细节的场景。
先将内容核心完全一致或高度相似的记忆条目标记为待处理,这里的“高度相似”是指核心信息(如事件主体、时间、地点)重合度超过 80%,这是多数人容易忽略的判断标准,避免漏判或错判重复项。
按来源优先级排序:用户主动输入的记忆可信度最高,系统自动记录的次之,AI 生成的最低;时间上,近 30 天内的记忆通常比更早的更准确,这一优先级划分能帮你快速筛选出核心有效项,无需逐条对比细节。
保留包含最多关键细节(如具体时间、参与人、事件结果)的条目,删除仅重复核心信息、无额外补充的冗余项,注意不要因某条细节少就判定为无效,需结合来源和时间综合判断。
仅删除完全重复或无有效补充的条目,保留下来的每条记忆需有唯一核心标识,确保不会再出现相同内容的重复记录,同时避免误删相似但不同的事件记录,这一步的关键是区分“重复”和“相似”的边界。
成因是将相似但不同事件的记录误判为重复,表现为删除了核心信息有差异的条目,绕过去是标记“可能重复”的条目后,对比来源和时间,确认是同一事件才处理,否则保留。
成因是未按来源优先级筛选,表现为保留了 AI 生成的低置信度重复项,绕过去是先按来源类型排序,优先保留用户输入或系统记录的条目,再处理 AI 生成的内容。
成因是未核对每条记忆的细节,表现为合并后同一事件出现不同结果,绕过去是逐条对比每条记忆的所有关键细节,仅合并核心信息完全一致的条目,细节有差异的需单独保留。
在 OneOneTalk 中,合并重复记忆需依托其可核验的长期记忆机制,每条记忆均带有来源、时间、置信度、作用域等可验证属性。用户可通过查看这些属性手动标记重复项,按来源和时间优先级筛选有效内容,删除冗余重复项;目前暂未提供自动合并重复记忆的功能,需用户手动核对每条记忆的核心信息,确保合并后无矛盾。