PÅMINMemoryEN/返回首页
FAQ

Påmin Memory — 常见问题

关于这层记忆的回答:它存什么、返回什么、花多少钱。首页的路线图按真实日期读取。

  1. Påmin Memory 是什么?

    Påmin Memory 是可插拔到任何 AI 智能体的记忆层,保留完整的来源链。它存下的每条事实都指回它来自的原话;每次修订都能沿时间回溯查询。用 Rust 编写,本地优先,以 MIT 协议公开在 github.com/pamin-labs/PaminMemory。

  2. 和向量数据库或普通 RAG 有什么不同?

    向量库返回与查询相似的段落。Påmin Memory 返回的是事实,连同它的证据和被选中的理由。检索合并四路信号——页/树结构、语义召回、词汇匹配、时间关系——再统一重排。结果带着指回原文片段的引用,所以答案可以被核对,而不是只能被相信。

  3. 「事实会变,但不被覆盖」是什么意思?

    当一条新陈述与旧的相矛盾时,旧的不会被删除,而是被标记为过期或矛盾并保留下来。当前、过期、矛盾、历史事实始终可分,任何一类都能按时间点查询——所以你可以问系统在去年三月认为什么是真的,而不只是它现在怎么想。这种时间版本追踪是多数记忆系统没有的部分。

  4. 支持哪些智能体和模型?

    都支持。Påmin Memory 是智能体之下的一层,而不是某个模型的功能。同一份记忆可以服务 Claude Desktop、Cursor、OpenClaw、ChatGPT、Codex,或你自己写的智能体——换工具,记忆跟着走。语气由你的智能体决定,Påmin 决定它能记住什么。

  5. 我的数据会离开本机吗?

    本地优先版不会。它是一键安装,把整条记忆栈——证据、事实、索引——都留在设备上,开发者可以检视并掌控。带跨设备同步的托管云服务是另行规划的;首页的路线图会说明每一档现在走到哪。

  6. 到底能省多少 token?

    省的是「每轮重发整段对话」这部分。原始上下文随对话轮次平方增长:第二十轮要把前十九轮历史再发一遍。Påmin 改为发一个固定的召回窗口加上新增内容。按首页展示的模型——每轮 1,500 token、1,200 token 的召回窗口,另加每次记忆操作约 0.2 美分——十二轮的会话少发约 72% 的输入 token。换成钱能省多少,取决于模型怎么收费:Claude Opus 4.1 约 59%,Claude Sonnet 4.5 约 54%;而在最便宜的模型上几乎不省,每次记忆操作的费用把 token 省下的那点抵掉了。首页的计算器会按你选的模型和长度把两者都重算;用的是各厂商公开标价,不是跑分。

  7. 用什么写的,什么协议?

    Rust,带三层缓存和一张带时间版本追踪的知识图谱。MIT 协议,仓库公开。

  8. 现在走到哪了?

    生产级内核和开源 alpha 已经交付。接下来是面向本地模型的隐私优先安装版(含创作、陪伴、教育场景内测),再往后是带跨设备同步的托管云服务。首页的进展一节按真实日期读取 status.json,所以你打开那天看到的是当天的状态,而不是文案写下那天的状态。

这里的每一条都能从仓库复现。哪些事还没端到端跑通,路线图会直说,而不是含糊带过。