实验室
讲义是想明白的,实战是拆解过的,实验室是做出来的——这一区陈列我自己造的项目:多数已开源,也有跑在生产里的系统。都是为了同一件事造的工具:让 Agent 在长任务里不漂移、有记忆、上下文可控、用量看得清。每个项目一页,固定结构:解决什么 → 核心机制 → 怎么用。
项目
harness-kit
把「用 Claude Code 做长程任务」的工程方法,沉淀成一套可 clone 即用的项目骨架。
研 · 2 已开源agent-memory-kit
给你正在构建的产品 Agent 装一层运行时记忆——四个角色把经验沉淀成可复用的教训。
研 · 3 已开源context-engineering-kit
用一张 CONTEXT.md,把进入上下文窗口的每样东西按七层管理起来——每层带预算和缓存策略。
研 · 4 已开源claude-usage
一条命令读本地 Claude Code 日志,把 token、成本、模型分布、缓存节省算清楚。
研 · 5 已开源agent-skill-case-studies
把设计精良的 Claude Agent Skills 当教材拆开,提炼可复用的设计模式。
研 · 6 已开源superagent-from-scratch
两千行内、零框架、教学优先的 SuperAgent harness 复刻——从 18.5 万行的 deer-flow 里蒸馏出 agent 核心,逐切片公开构建,已推进到第 11 刀。
研 · 7 已开源skill-catalog-pipeline
把 7.7 万条第三方技能包做成 500ms 语义检索技能库底座的工程方案——五层管线 + 17 条踩坑结晶。
研 · 8 已开源meet-scribe
线下会议自动纪要:录音 → 本地转写 + 说话人分离 → claude 生成纪要 → 落 Obsidian,全程无人值守。
研 · 9 已开源openknowledge-py
用 Python 从零复刻 inkeep/open-knowledge——人与 AI agent 共用的 git-native markdown 知识底座,「通过重建来拆解」。
研 · 10 生产中蓝领招聘语音 Agent
一条打进打出的电话链路:实时语音对话 + 通话持久化 + LLM 质检闭环,跑在真实招聘业务里。
研 · 11 生产中Delphi Clone · 数字分身平台
把一个真人蒸馏成可对话的数字分身:多源喂料 + 自适应访谈钻探 + 溯源 RAG 作答 + 对齐飞轮 + 本人声线,整条流水线自建并跑在生产里。