截至各自统计日期,N1Mem 在三项长程记忆权威基准上取得公开可比对的世界第一。LoCoMo 采用 LLM-as-Judge(非官方指标,口径见下)。所有数字均来自 claim_card.json 单一真相源。
口径说明:LongMemEval / MemoryAgentBench 为基准官方评测成绩(多模型 OR 集成);LoCoMo 采用 LLM-as-Judge(Checklist-CoT)+ 三池 OR 集成,属非官方指标,对外须标注。World #1 均指对应统计日期下公开可比对的最优成绩;排行榜动态变化,第三方成绩可能随时超越,本页数字为冻结评测产物快照,仅供参照。
把「世界第一」翻译成你能懂的四个价值点。
在同一系统里,告诉 N1Mem 一件事,切到全新对话窗口再问——它依然记得。这不是 RAG 的把戏,是真正的长期记忆。
演示为前端模拟剧本(P7.C 生产 API 未就绪时的降级方案),用于展示跨会话记忆的 Aha 体验。