开源内存模块赋予任何 AI agent 类似 Claude/ChatGPT 的长期记忆能力,扩展 agent 应用场景。
Stash 让你的 AI 记住你。每次对话。永远。不再从零开始解释自己。
不仅仅是记忆。一个第二大脑。
Stash 是一个持久化的认知层,位于你的 AI agent 和世界之间。它不替代你的模型——它让你的模型连续化。事件变成事实。事实变成规律。规律变成智慧。
像文件夹一样组织的记忆。
不是所有的记忆都相等。你的 agent 对你的了解,不同于它对项目的了解,也不同于它对自己的理解。命名空间让 agent 把学到的东西组织成整洁、分离的存储桶——就像你计算机上的文件夹一样。
每个命名空间是一条路径。路径是分层的。从 /projects 读取会自动包含 /projects/stash、/projects/cartona 下的所有内容,等等。你永远不必考虑这些——agent 会处理。
看 Stash 如何记忆。
一个真实的对话循环——两个会话,一个 agent,零重复。看看它们之间发生了什么。
你可能听说过 RAG——检索增强生成(Retrieval Augmented Generation)。这很聪明。但这不是记忆。这是区别,用简单的英语。
你给它一堆文档。当你提问时,它搜索这些文档并给你相关的页面。就这样。它不记得你的对话。它不学习。它不了解你。每个问题都从零开始——它只是对你已经写过的文件进行更聪明的搜索。
Stash 从你的 agent 的所有经历中学习——对话、决定、成功、失败。它将原始观察合成事实,将事实连接成知识图,检测矛盾,追踪目标,并建立对你的理解,随着时间深化。你不用写任何东西。它自己搞清楚。
Claude.ai 有记忆。ChatGPT 有记忆。它们只对自己有效——锁定在一个平台、一个模型、一个公司。Stash 对所有人、所有地方、永远有效。而且它比任何一个都深得多。
AI 模型推理很聪慧,但什么都不记得。每个会话你都要重新解释你是谁、你需要什么、你已经尝试过什么。你每天都在训练同一个学生。
解决方案是将完整的对话历史填充到每个 prompt 中。它很慢,很昂贵,而且你仍然会达到限制。你花费的 token 重复相同的事实一遍又一遍。
你的 agent 尝试了什么,它失败了,下一个会话它尝试完全相同的事情。没有机制来传递教训。每个失败都被遗忘。
只有少数几个 AI 平台提供记忆——而且仅限于它们自己的模型。你的自定义 agent、你的本地 LLM、你的 Cursor 设置?它们都一开始就目盲。记忆不应该是高级功能。
没有基础设施要设置。没有需要手动安装的依赖。Docker Compose 处理一切——Postgres、pgvector、Stash,全部连接在一起并准备就绪。
启动 Stash,将任何兼容 MCP 的 agent 指向下面的 URL。就这样。没有 SDK。没有供应商锁定。
{
"mcpServers": {
"stash": {
"url": "http://localhost:8080/sse"
}
}
}
{
"mcpServers": {
"stash": {
"url": "http://localhost:8080/sse"
}
}
}
{
"mcp": {
"stash": {
"type": "remote",
"url": "http://localhost:8080/sse",
"enabled": true
}
}
}
{
"mcpServers": {
"stash": {
"url": "http://localhost:8080/sse"
}
}
}
一个后台进程持续将你的 agent 的经历合成为结构化知识。它按计划运行——你的 agent 只是活着。
调用 init 并且 Stash 创建一个 /self 命名空间框架。agent 使用自己的记忆层来构建和维护其自身能力、限制和偏好的模型。
给你的 agent 一个 5 分钟研究循环。它从过去的记忆中定向,研究一个它自己选择的话题,发明新的联系,巩固它学到的东西,并优雅地关闭——准备好在下一次继续。
将其作为 cron 任务运行。每 5 分钟,你的 agent 变得更聪明。
Stash 为嵌入和推理使用一个提供者——任何兼容 OpenAI 的后端都可以工作。云、本地或自托管。永远没有供应商锁定。
OpenRouter 让你访问数百个模型——GPT、Claude、Gemini、Mistral——全部在一个兼容 OpenAI 的端点后面。将 Stash 指向它并为嵌入和推理选择任何模型。
运行 Ollama 本地?Stash 开箱即用。使用 Qwen、Llama、Mistral 或任何你拉取的模型——你的记忆保持完全私密、完全离线。
vLLM、LM Studio、llama.cpp server、Together AI、Groq——如果它支持 OpenAI API 格式,Stash 就支持它。同一提供者提供两个模型。
开源。Apache 2.0 许可。由 PostgreSQL 支持。适用于任何兼容 MCP 的 agent。