SELECTED WORK

精选项目

把模型、检索和工作流编排落到可运行的产品里。

全部仓库
从“答错了”到“错在哪”:RAG 检索诊断接口设计
面向考试题库场景,记录如何让缺失材料、召回过程、重排结果和关键短语覆盖变得可检查。
#RAG#检索诊断#RRF+1
WeKnora 二次开发笔记:把 RAG 拆成可观察的工程链路
从文档解析、索引、召回、重排到引用与生成,记录我在 WeKnora 二次开发中形成的 RAG 排障方法。
#WeKnora#RAG#Agent+1
从 Prompt 到 Context Compiler:智能编码 Harness 的上下文工程笔记
记录我在个人 Harness 实践中对上下文分层、证据检索、状态压缩和工具反馈闭环的理解。
#Agent#Harness#Context Engineering+1
Agent 上线前的安全边界:权限、确认与可追溯执行
整理生产级 Agent 在工具权限、提示注入、人工确认、审计日志和失败恢复方面需要建立的基础边界。
#Agent#安全#Human-in-the-loop+1
具身智能学习笔记:智能体需要怎样的记忆系统
从世界状态、情景记忆、语义记忆和技能记忆出发,思考具身智能体如何在持续交互中保留有效经验。
#具身智能#Agent#记忆系统+1
MCP 工具设计笔记:从“能调用”到“可安全执行”
总结 MCP 工具的输入契约、读写边界、幂等性、错误返回和权限设计,避免把普通接口直接包装成工具。
#MCP#Agent#工具调用+1
RAG 评估笔记:把召回质量与回答质量分开检查
从评测集、召回证据、引用正确性和失败归因出发,整理一套适合迭代 RAG 系统的检查方法。
#RAG#评估#检索诊断+1
用 LangGraph 设计可修复的 AI 面试工作流
从简历解析、面试规划到问题生成和回答评价,记录显式状态机比单次 Prompt 更适合产品化的原因。
#LangGraph#Agent#FastAPI+1
从混合检索到 Agentic GraphRAG:代码仓库问答的设计笔记
记录我如何把 Tree-sitter、BM25、向量检索、符号图和 LangGraph 工作流组合成可追踪的代码仓库问答系统。
#GraphRAG#LangGraph#Tree-sitter+1

当前页面没有目录