AI Agent 技术栈梳理(Skill / 蒸馏 / MCP / Harness)
一共包含三个内容:
- Skill / 蒸馏 / MCP / Harness 分别是什么、有何关联;
- 除了这些,Agent 还有哪些技术栈;
- 当前热门AI关键词术语速览;
一、四个核心热门概念:Skill / 蒸馏 / MCP / Harness
1.1 一句话总览
| 概念 | 一句话 | 所属层 |
|---|---|---|
| 蒸馏(Distillation) | 用大模型"教"出小模型,压缩体积保留能力 | 模型层 |
| Harness | 运行模型的"智能体运行时 / 编排框架" | 运行时层 |
| Skill(技能) | 按需加载的"能力包"(指令 + 流程 + 资源) | 能力扩展层 |
| MCP | 连接外部工具 / 数据的标准协议 | 能力扩展层(协议) |
1.2 蒸馏(Knowledge Distillation)
模型压缩技术:用一个强大的教师模型(Teacher)去"教"一个小的学生模型(Student),让后者模仿前者的输出,从而在体积更小、成本更低、速度更快的前提下保留大部分能力。
- 经典例子:
DeepSeek-R1-Distill-Qwen、DeepSeek-R1-Distill-Llama(用 R1 蒸馏出的小模型) - 价值:把 671B 的大模型能力浓缩到 7B / 14B,能跑在单卡甚至本地
- 关键点:它只影响"用哪个模型",与下面的基础设施无关
1.3 Harness(智能体运行时 / 编排框架)
“套在模型外面的那套东西”——负责跑模型、管工具、管上下文、执行 agent 循环(调用模型 → 解析工具调用 → 执行 → 把结果喂回去,反复)。
以 DeepSeek Harness(DSH) 为例,它就是 harness:
- 提供
run_code、read、write、pwsh、web_search等一堆工具 - 管理沙箱、文件权限、审批、后台任务、子代理、目标(goal)
- 提供 Web GUI
- 模型只是在它的循环里被反复调用,真正的"手脚"都是 harness 给的
类比:模型是"大脑",harness 是"身体 + 神经系统"。
1.4 Skill(技能)
一个可复用的能力包,按需加载,避免把所有知识常驻在上下文里。通常是"一个 SKILL.md 说明文件 + 若干脚本 / 资源",告诉模型"遇到某类任务时该怎么做"。
- 例子:一个
pdf-processing技能、一个database-migration技能 - 工作方式:平时不加载,只有当任务命中某个技能时,harness 才把这个技能的完整指令塞进上下文
- 价值:知识模块化 + 按需注入,省 token、也更可控
在 DSH 里就有
skill工具和"会话技能目录(skill catalog)",这就是 skill 概念的落地。
1.5 MCP(Model Context Protocol)
Anthropic 提出的开放标准协议,作用是让 AI 模型 / 智能体用统一的方式接入外部工具、数据和资源,号称"AI 的 USB-C 接口"。
- 核心角色:
- MCP Server:暴露工具 / 资源的一方(如文件系统 server、数据库 server、GitHub server)
- MCP Client:消费这些工具的一方(通常是 harness 或 IDE 里的插件)
- 价值:标准化——以前每家都要自己写对接代码,现在只要实现了 MCP,任何支持 MCP 的客户端都能直接连
1.6 四个概念的关联关系
┌──────────────────────────────────────────────┐
│ Harness(智能体运行时,例如 DeepSeek Harness) │
│ │
│ ┌────────────────────────────┐ │
│ │ 模型(可能是蒸馏出来的小模型)│ ← 蒸馏影响这层 │
│ └────────────────────────────┘ │
│ │
│ ┌────────────── 能力扩展 ──────────────┐ │
│ │ Skill:内部能力包(指令/流程/脚本) │ │
│ │ MCP 客户端 ──协议──▶ MCP Server │ │
│ │ (外部工具/数据源) │ │
│ └────────────────────────────────────┘ │
└──────────────────────────────────────────────┘
-
Harness 是容器,其它都装在里面。Harness 负责跑模型、调用工具、执行循环。Skill 和 MCP 都是 harness 用来"扩展模型能力"的手段。
-
Skill 和 MCP 是互补的两种扩展方式:
- Skill = 给模型"内置知识 / 流程"(带自己的指令,偏静态、本地)
- MCP = 给模型"外接实时工具 / 数据"(标准化协议,偏动态、联网)
- 两者可被同一个 harness 同时使用,不冲突
-
蒸馏是正交的(独立维度):它只决定"harness 里跑的是哪个模型",不影响 harness / skill / MCP 的架构。一个被蒸馏的小模型,照样可以跑在 harness 里、加载 skill、通过 MCP 调外部工具。
-
一句话概括:
蒸馏决定了"大脑多小多便宜";Harness 提供"身体和手脚";Skill 是"随身携带的技能手册";MCP 是"插拔外部设备的通用接口"。
二、AI Agent 完整技术栈(9 层)
上述四个概念只是整个 Agent 技术栈里的几个点。完整栈分 9 层:
| 层 | 名称 | 核心内容 | 已讲 |
|---|---|---|---|
| ① | 模型层 | 基座模型、微调、RL、蒸馏、Embedding | 蒸馏 ✓ |
| ② | 运行时 & 框架层 | Harness、Agent 框架、循环范式 | Harness ✓ |
| ③ | 能力扩展层 | Skill、MCP、Tool、RAG、插件 | Skill/MCP ✓ |
| ④ | 记忆 & 上下文层 | 短期记忆、长期记忆、上下文工程 | — |
| ⑤ | 工具 & 集成层 | 代码沙箱、浏览器自动化、Computer Use | — |
| ⑥ | 编排 & 多智能体层 | 多智能体、Workflow、Subagent | — |
| ⑦ | 评估 & 观测层 | Evals、Benchmark、Tracing | — |
| ⑧ | 安全 & 治理层 | 沙箱、权限审批、Guardrails | — |
| ⑨ | 基础设施层 | 推理引擎、向量库、网关、部署 | — |
2.1 ① 模型层(Model)
- 基座模型:LLM / VLM / 多模态
- 微调:SFT、LoRA、DPO、RLHF
- 强化学习:RL / GRPO(专门训练"agent 行为",让模型会规划、会用工具、会自我纠错)
- 蒸馏(已讲)
- Embedding / Reranker 模型(给 RAG 用)
2.2 ② 运行时 & 框架层(Runtime & Framework)
- Harness(已讲)
- Agent 框架:LangChain / LangGraph、LlamaIndex、AutoGen、CrewAI、Semantic Kernel、OpenAI Agents SDK、Google ADK、Dify(低代码)
- Agent 循环范式:ReAct(推理 + 行动)、Plan-and-Execute、Reflexion(反思)、Tool-use
2.3 ③ 能力扩展层(Capability)
- Skill(已讲)、MCP(已讲)
- Tool / Function Calling(模型直接调用函数,比 MCP 更原始、更基础)
- RAG(检索增强生成:外部知识检索后喂给模型)
- 插件系统
2.4 ④ 记忆 & 上下文层(Memory & Context)
- 短期记忆:上下文窗口、KV Cache
- 长期记忆:向量库 + 记忆系统(MemGPT / Letta、Zep、LangMem)
- 上下文工程(Context Engineering):压缩、摘要、选择性注入、上下文缓存
2.5 ⑤ 工具 & 集成层(Tools & Integration)
- 代码执行沙箱:E2B、容器、Code Interpreter
- 浏览器自动化:Playwright、Puppeteer、Browser-use
- Computer Use(直接操作电脑屏幕 / 键盘鼠标)
- 搜索、文件系统、数据库、第三方 API 集成
2.6 ⑥ 编排 & 多智能体层(Orchestration & Multi-agent)
- 多智能体:主从、协作、竞争 / 辩论、层级式
- Workflow 编排:DAG、状态机(LangGraph、Temporal、Prefect、n8n)
- 子代理(Subagent):一个主 agent 派生子任务
2.7 ⑦ 评估 & 观测层(Eval & Observability)
- 评测基准:SWE-bench、GAIA、AgentBench、τ-bench
- 追踪观测(Tracing):LangSmith、Langfuse、Arize Phoenix、OpenTelemetry GenAI
- 成本追踪、质量监控
2.8 ⑧ 安全 & 治理层(Safety & Governance)
- 沙箱隔离(sandbox)
- 权限 & 审批:RBAC、human-in-the-loop(关键操作需人工确认)
- Guardrails:Prompt 注入防护、内容安全、越权拦截
- 审计日志
2.9 ⑨ 基础设施层(Infrastructure)
- 推理引擎:vLLM、TGI、SGLang、TensorRT-LLM
- 向量数据库:Milvus、Pinecone、Weaviate、Qdrant、pgvector、Chroma
- 模型网关:LiteLLM、One API、OpenRouter、Portkey
- 部署:K8s、Serverless、GPU 集群
三、整体关系一图流
① 模型层 ← 大脑(可能蒸馏 / 微调 / RL 过)
│
② 运行时/框架 ← Harness + Agent 框架 + 循环范式
│
③ 能力扩展 ← Skill / MCP / Tool / RAG
④ 记忆/上下文 ← 短期 + 长期 + 上下文工程
⑤ 工具/集成 ← 沙箱 / 浏览器 / Computer Use
│
⑥ 编排/多智能体 ← 多 agent + workflow + subagent
│
⑦ 评估/观测 ← 横向贯穿:测效果、看 trace
⑧ 安全/治理 ← 横向贯穿:沙箱、权限、护栏
│
⑨ 基础设施 ← 底层:推理、向量库、网关、部署
四、补充要点
-
前面问的四个概念覆盖的是:模型层(蒸馏)、运行时层(Harness)、能力扩展层(Skill、MCP)。中间还有记忆、编排、评估、安全、基础设施这五大块未涉及。
-
实际落地时最重要的几个(除已讲的):
- RAG——绝大多数业务 agent 都在用
- Function Calling / Tool Use——agent 能"动手"的基础
- 长期记忆——让 agent 跨会话记得住
- Tracing / 可观测性——生产环境排障刚需
- 多智能体 / Subagent——复杂任务的拆解协作
-
概念 vs 产品:每个类别里都有大量具体产品 / 框架(LangChain、LangGraph、Dify、Milvus、Langfuse…),它们各自属于某一层,不要混为一谈。
-
当前趋势:这套栈仍在快速演进,几个较热的方向是 Agentic 专用训练(RL / GRPO)、MCP 生态标准化、Computer Use / 浏览器智能体、上下文工程与记忆系统。
五、AI关键词术语速览
🧠 基础概念
| 术语 | 通俗解释 |
|---|---|
| AI(人工智能) | 模拟人类智能的技术系统,像能自主升级的“电子大脑”。 |
| AGI(通用人工智能) | 具备人类广泛认知能力,能跨领域自主解决问题。 |
| AIGC | 人工智能生成内容的总称(文字、图片、音视频等)。 |
| 生成式 AI | 专门创造全新数字内容(如文本、图像、音乐)的技术。 |
🤖 模型与架构
| 术语 | 通俗解释 |
|---|---|
| GPT | 基于 Transformer 的生成式预训练模型,可写文章、对话。 |
| Transformer | 基于注意力机制的模型架构,现代大模型的基础。 |
| LLM(大语言模型) | 处理海量语言信息的 AI 系统,如“超级语料处理器”。 |
| 神经网络 | 仿生物神经元连接的计算模型,像层层传递的“快递分拣中心”。 |
| 深度学习 | 基于多层神经网络的特征抽象技术。 |
| 机器学习 | 通过数据训练模型实现预测和决策。 |
| 强化学习 | 通过奖惩机制优化决策,类似游戏策略调整。 |
| GAN(生成对抗网络) | 生成器与判别器对抗训练,模拟“造假”与“打假”博弈。 |
🔧 训练与优化
| 术语 | 通俗解释 |
|---|---|
| 监督学习 | 用标注数据训练,像有老师逐题批改作业。 |
| 无监督学习 | 自主发现数据规律,像没有参考答案的自学。 |
| 半监督学习 | 结合标注与非标注数据训练。 |
| 训练集 | 用于模型训练的数据集合。 |
| 过拟合 | 模型过度拟合训练数据,导致泛化能力差。 |
| 迁移学习 | 将已学知识迁移到新领域,提高学习效率。 |
| 特征提取 | 从数据中识别最具辨识度的特征。 |
| 参数调整 | 优化模型内部配置的过程。 |
| Fine-tuning(微调) | 在预训练模型基础上针对性优化。 |
🛠️ 应用与工具
| 术语 | 通俗解释 |
|---|---|
| NLP(自然语言处理) | 让计算机理解、生成人类语言(翻译、情感分析等)。 |
| CV(计算机视觉) | 让机器解析图像、视频等视觉信息。 |
| TTS(语音合成) | 文字转自然语音,像 AI 配音演员。 |
| ASR(语音识别) | 语音转文字技术。 |
| MidJourney | 文生图扩散模型应用(图片生成工具)。 |
| Hugging Face | 开源 AI 模型社区,类似 AI 模型的“应用商店”。 |
| OpenAI | 知名 AI 研究机构,ChatGPT 的创造者。 |
🧩 其他关键术语
| 术语 | 通俗解释 |
|---|---|
| Prompt(提示词) | 引导 AI 输出的指令文本,像唤醒 AI 的“咒语”。 |
| 算力 | 计算机处理数据的能力,驱动 AI 运转的“引擎”。 |
推荐链接:
本文档用于梳理 AI Agent 技术栈的核心概念与分层,具体产品 / 框架随生态快速迭代,以最新资料为准。

217

被折叠的 条评论
为什么被折叠?



