上下文一关就失忆:Memorable 把成功跑次变成可复用程序,我怎么看
大家好,我是珂抖屁。
Agent 圈有一句我听过太多次、自己也骂过太多次的话:做完难题、窗口关了,知识归零。
你看着它花半小时摸清测试失败链、试错出那条唯一能过的命令、记住该先改哪个文件——下一轮新会话,它又从「让我先了解一下仓库」开始。人累的不是模型不会写代码,是同一份学费交第二遍、第三遍。
YC S27 的 Memorable 把这句抱怨钉成产品叙事:把成功跑次蒸馏成可复用的程序图(procedural memory),让下一次同类任务更快、更省、更可预期。官网 memorable.sh、创始团队公开帖,以及 @heynavtoor、@stretchcloud 的转述,口径大致一致。我下面写的是我怎么看这刀口,不是替谁做尽调。
他们钉的问题,我认
@heynavtoor 那条很适合当标题党原文:「agent 解决了难题 → 上下文关了 → 知识没了 → 下次从零开始」。连 Anthropic / OpenAI「也还没彻底修好」——这话是营销温度,但体感真实。
Memorable 官方说法更工程一点:
•Layer 1:留下轨迹(prompt + 工具调用顺序);
•Layer 2:从成功跑次合成工作流,砍掉死胡同;
•Layer 3:把共享步骤拼成图,露出可组合路径;
•Layer 4:新任务时检索相关流程,引导 agent 走。
它强调存的是「怎么做成」——步骤、前置/后置条件、验证命令与退出码——而不是把整段聊天记录原样塞回下一轮。官网还写了本地存储、显式同意写入、recall 延迟量级、以及和 Claude Code / Codex / Cursor 等 harness 的对接方式。这些当产品说明书读即可。
@stretchcloud 的长帖把同一问题接到「多 agent 并行/串行却不共享已发现」上,并顺便推自己的 Campfire。这说明:叙事已经从「要不要 memory」走到「memory 到底记事实还是记程序」。
程序记忆 ≠ 聊天记忆,这个区分值钱

Memorable 四层:轨迹 → 工作流 → 程序图 → 检索引导
我见过太多「记忆产品」其实在做两件不同的事,却共用一个词:
| 类型 | 大概记什么 | 典型失败 | |------|------------|----------| | 情景/语义记忆 | 决策、偏好、项目事实、「现在什么为真」 | 记成一堆难检索的散文;或记错还不忘 | | 程序记忆 | 成功路径:先读谁、再跑谁、用什么命令验收 | 把偶然成功固化成教条;环境一变就踩坑 |
Memorable 公开站在第二列。一人公司场景里,第二列往往更痛:你不是缺「记得老板喜欢简洁」,而是缺「修这类 auth 测试,上次验过的命令是这条」。
所以我判断:如果 Memorable 真能把「可复用程序」而不是「可复述聊天」做稳,它踩中的是 agent 工业化的关键瓶颈——可重复劳动的可重复性。
我不会照单全收的三点
1. 成功跑次 ≠ 正确程序 Agent 可能靠脏环境、靠缓存、靠「碰巧没触发竞态」绿了。蒸馏进去,就是把偶然写进制度。没有「失败反例 / 环境漂移检测 / 人工可废止」,程序图会变成高级技术债。
2. 官方案例数字是设计伙伴口径 站点上有「更少工具调用」「更少上下文」一类对照。那是他们公布的伙伴结果,不是你仓库的承诺。一人公司该问的是:我能不能看见每条 procedure 的步骤、验证命令、以及「这次有没有帮上忙」的账本——官网宣称有 dashboard / savings,落地以你本机为准。
3. 「隔夜接着干」还要纪律,不只是插件 产品能 recall,人仍要决定:什么任务值得固化、什么必须重新推理、什么敏感路径禁止写入。Memorable 自己写了 enable/disable、显式写同意——这方向对。没有同意模型的记忆,是另一类供应链。
另外提醒一句:开源圈里还有叫 Memorable 的项目记忆/MCP 工具,和这家 YC 公司不是一回事。别装错、别写混。
一人公司我会怎么用(如果试)
我的用法会很「小作坊」:
1.先圈重复劳动:隔夜续跑的 bugfix、固定回归命令、固定发布检查——这类才值得 proceduralize。
2.强制带验证命令:没有「怎么证明做成了」的 procedure,我不让它进默认召回。
3.变更后作废:依赖升级、目录搬家、鉴权改版——相关 procedure 先 disable,再决定是否重录。
4.多 harness 共享时更谨慎:跨 Claude Code / Codex 共用一张图很香,也意味着坏程序会污染所有壳。
和「隔夜接着干」怎么对齐
一人公司的真实节奏往往是:白天开会、晚上丢长任务、早上起来收结果。窗口一关,如果系统不记得「昨晚验过的路径」,你早上就会付双倍 token,还付情绪税。
Memorable 的吸引力正在这里:它不只说「我记得你说过什么」,而说「我记得怎么做成过」。官网甚至把 recall 延迟写到约几十毫秒量级、强调验证命令跟着 procedure 走——这些细节若落地,比又一个聊天侧栏更贴夜间工厂。
但我仍会把期望钉在「辅助召回」,而不是「自动驾驶」。隔夜续跑最怕两件事:一是召回了过期程序还自信满满;二是为了省 token 跳过重新勘察,结果在坏假设上狂奔。程序记忆省的是探索,不该省掉关键路径上的再验证。
我自己的判断
上下文窗口关了就失忆,不是模型「不够聪明」,是系统没把成功路径当成一等公民资产。Memorable 把这句话产品化了,而且选对了「程序图」而不是「更长的聊天摘要」。
我会保持好奇,也会保持怀疑:真正难的不是第一次蒸馏,而是程序过期之后谁有勇气删。一人公司隔夜接着干,靠的不是永恒记忆,是可召回、可检查、可废止的短程序库。
Memorable 若把这三件事做扎实,它会比又一个「向量聊天记忆」更接近 agent 工厂的地基。若只停留在 launch 叙事,那它也只是又一次把痛点说得很准的 YC 帖。