GitHub双响:28.1万星skills让Agent正经干活,9.9万星claude-mem替你记住一切
刷GitHub日榜,今天冲得最猛的两个项目都跟AI Agent有关:一个教你把”怎么干活”写成技能给Agent装上,一个解决Agent最要命的失忆问题。一个是Matt Pocock(TypeScript培训圈那个名人)的mattpocock/skills,一天涨了1774星,总星数干到28.1万;另一个是thedotmack/claude-mem,9.9万星,今天还在涨。两个都不是玩具,实测看完README,说说值不值得上。
mattpocock/skills:28.1万星的”工程基本功”技能包
仓库定位一句话:给真正的工程师用的Agent技能,不是vibe coding。Matt在README里直接开怼——GSD、BMAD、Spec-Kit这类框架想接管整个流程,结果是把你的控制权拿走,流程出了bug还没法查。他的思路反过来:技能要小、要能拆开重组、不挑模型。
装法确实快,Claude Code一条claude plugin install mattpocock-skills@claude-plugins-official,Codex、GitHub Copilot、Gemini CLI各有各的命令,其他Agent走npx skills@latest add mattpocock/skills。装完每个仓库跑一次/setup-matt-pocock-skills,它会问你用哪个issue tracker、打什么标签、文档放哪,然后就能用了。
技能分两层:用户主动敲的(user-invoked)负责编排,模型自己判断调的(model-invoked)负责具体纪律。最值得试的几个:
/grill-me、/grill-with-docs:让Agent反过来审问你,把需求的每个分支都问透了才动手,顺带生成领域词汇表(GLOSSARY.md)和ADR决策记录。Matt管这叫解决”Agent没干我想要的事”这个头号失败模式。/tdd、/diagnosing-bugs:红绿重构的测试循环,调试必须先造出能复现的红灯再谈修,不许Agent瞎猜。/code-review:两轴并行审查——代码是否符合仓库规范、是否忠实实现了原始spec,两个子Agent互不污染。/to-spec、/to-tickets、/implement-spec:把对话变成spec,拆成带依赖关系的tracer-bullet工单,再按任务图并发开工。
底层逻辑其实很老派:静态类型、自动化测试、领域驱动设计。软件工程几十年的老规矩,换了个马甲塞给Agent,反而成了稀缺品——因为Agent生成代码太快,代码库烂的速度也跟着加快。
claude-mem:9.9万星,给Agent装上跨会话的长期记忆
用Claude Code、Codex这类工具的人都懂一个痛:今天调了半天的项目上下文,明天新开会话全部归零,得从头解释一遍。claude-mem就是干这个的,整个链路全自动:
- 捕获:5个生命周期钩子(SessionStart、UserPromptSubmit、PostToolUse、Stop、SessionEnd)挂在你的Agent上,每次工具调用的观测自动记下来,标
<private>的内容不入库。 - 压缩:原始事件交给AI生成语义摘要,避免记忆库变成垃圾场。
- 存储:SQLite(FTS5全文检索)管结构化记录,Chroma向量库存语义索引,worker是个本地HTTP API,还自带网页查看器能实时看记忆流。
- 检索:三层MCP工具——
search只回50-100 token的索引,timeline补时间线上下文,get_observations按ID批量取详情。先过滤再取详情,官方说法约省10倍token。 - 注入:新会话SessionStart自动把相关上下文带回来,Agent接上昨天的进度继续干。
安装npx claude-mem install一条命令,支持Claude Code、Codex、OpenCode、Pi等一堆宿主,还有OpenClaw网关的一键脚本。版本已经迭代到13.35.0,Node 20+就能跑,Apache-2.0协议。中文用户注意,内置code--zh模式,生成的摘要直接是简体中文,不用额外装。
实话
两个项目都值得试,但各有一个坑要先说清楚。
claude-mem安装时会引导你邮箱登录、开通”30天免费试用”的托管记忆服务(CMEM Pro),默认走他们的云端observer——想纯本地就得手动--provider指定或者关掉在线选项。README末尾还提了个叫CMEM的代币,官方”拥抱”这种东西,多少有点加密味儿,介意的自行判断。另外Claude Code插件市场里同类记忆项目一堆,装之前想清楚你要的是”全自动记”还是”按需查”。
mattpocock/skills的坑在于它带着强烈的个人工程观:要求你先跑setup、先被审问、先写测试。习惯了”一句话直接出活”的人会觉得繁琐,但真在生产代码上干活,这套繁琐恰恰是它值28万星的原因。技能是Matt自己日常工作流的沉淀,不是通用标准,用之前挑着改,别全盘照搬。
一句话总结:Agent的短板正在从”会不会写代码”变成”像不像个正经工程师”——一个教它守规矩,一个让它长记性,方向没错。