Agent Agent Memory 与 Context Engineering:从任务状态到长期记忆治理 阶段 5 学习笔记:区分状态、记忆、RAG 与上下文,建立带来源、时间、权限、冲突、删除和效果评估的生产级 Agent Memory 生命周期。 2026/04/08
AI-Coding Universal Prompt Optimizer:一个让 Agent 先问清楚再动手的 Skill AI Coding 专栏:自研 Claude Code Skill,解决模糊指令导致 Agent 猜错方向的问题,通过追问澄清 + 7 段式标准化 + 默认执行,让模糊需求也能稳定产出。 2026/04/09
Agent Agentic RAG、GraphRAG 与 RuleRAG:构建可追溯业务证据链 阶段 6 学习笔记:从普通向量问答升级到可规划、可迭代、权限感知且可验证的证据系统,并落地 GraphRAG 与结构化 RuleRAG。 2026/04/11
Agent Planning、Reflection 与 Verifier:规划、自我修正与验证闭环 阶段 7 学习笔记:建立可执行、可验证、可修复的计划数据模型,区分 Reflection、Critic、Verifier、Retry 与 HITL 的生产边界。 2026/04/12
Agent Multi-Agent 与 A2A 协作:从角色分工到协议化运行 阶段 8 学习笔记:用明确角色、任务契约、共享状态、委派与验证构建可评估的多 Agent 系统,并理解 A2A 跨系统协作协议。 2026/04/13
Agent Agent 微调工程:从工具轨迹到 SFT、偏好优化与强化学习 阶段 9 学习笔记:判断 Agent 是否值得微调,构建可审计的多轮工具轨迹数据,并用 LoRA、QLoRA、DPO 与 RFT 完成评估和发布。 2026/04/14
Agent Agent 安全、约束与可靠性:从威胁建模到纵深防御 阶段 10 学习笔记:围绕身份、数据、工具、MCP/Skills、Memory/RAG、沙箱、HITL 与事故响应建立生产级 Agent 纵深防御。 2026/04/15
Agent Agent 评估、测试集与可观测性:从最终答案到轨迹级归因 阶段 11 学习笔记:构建 Golden、Adversarial 与 Regression 数据集,评估工具、轨迹、环境终态、安全、成本,并用 Trace 定位失败。 2026/04/17