AI Agent 技术栈梳理(Skill / 蒸馏 / MCP / Harness)

AI Agent 技术栈梳理(Skill / 蒸馏 / MCP / Harness)

一共包含三个内容:

  1. Skill / 蒸馏 / MCP / Harness 分别是什么、有何关联;
  2. 除了这些,Agent 还有哪些技术栈;
  3. 当前热门AI关键词术语速览;

一、四个核心热门概念:Skill / 蒸馏 / MCP / Harness

1.1 一句话总览

概念一句话所属层
蒸馏(Distillation)用大模型"教"出小模型,压缩体积保留能力模型层
Harness运行模型的"智能体运行时 / 编排框架"运行时层
Skill(技能)按需加载的"能力包"(指令 + 流程 + 资源)能力扩展层
MCP连接外部工具 / 数据的标准协议能力扩展层(协议)

1.2 蒸馏(Knowledge Distillation)

模型压缩技术:用一个强大的教师模型(Teacher)去"教"一个小的学生模型(Student),让后者模仿前者的输出,从而在体积更小、成本更低、速度更快的前提下保留大部分能力。

  • 经典例子:DeepSeek-R1-Distill-QwenDeepSeek-R1-Distill-Llama(用 R1 蒸馏出的小模型)
  • 价值:把 671B 的大模型能力浓缩到 7B / 14B,能跑在单卡甚至本地
  • 关键点:它只影响"用哪个模型",与下面的基础设施无关

1.3 Harness(智能体运行时 / 编排框架)

“套在模型外面的那套东西”——负责跑模型、管工具、管上下文、执行 agent 循环(调用模型 → 解析工具调用 → 执行 → 把结果喂回去,反复)。

DeepSeek Harness(DSH) 为例,它就是 harness:

  • 提供 run_codereadwritepwshweb_search 等一堆工具
  • 管理沙箱、文件权限、审批、后台任务、子代理、目标(goal)
  • 提供 Web GUI
  • 模型只是在它的循环里被反复调用,真正的"手脚"都是 harness 给的

类比:模型是"大脑",harness 是"身体 + 神经系统"。

1.4 Skill(技能)

一个可复用的能力包,按需加载,避免把所有知识常驻在上下文里。通常是"一个 SKILL.md 说明文件 + 若干脚本 / 资源",告诉模型"遇到某类任务时该怎么做"。

  • 例子:一个 pdf-processing 技能、一个 database-migration 技能
  • 工作方式:平时不加载,只有当任务命中某个技能时,harness 才把这个技能的完整指令塞进上下文
  • 价值:知识模块化 + 按需注入,省 token、也更可控

在 DSH 里就有 skill 工具和"会话技能目录(skill catalog)",这就是 skill 概念的落地。

1.5 MCP(Model Context Protocol)

Anthropic 提出的开放标准协议,作用是让 AI 模型 / 智能体用统一的方式接入外部工具、数据和资源,号称"AI 的 USB-C 接口"。

  • 核心角色:
    • MCP Server:暴露工具 / 资源的一方(如文件系统 server、数据库 server、GitHub server)
    • MCP Client:消费这些工具的一方(通常是 harness 或 IDE 里的插件)
  • 价值:标准化——以前每家都要自己写对接代码,现在只要实现了 MCP,任何支持 MCP 的客户端都能直接连

1.6 四个概念的关联关系

┌──────────────────────────────────────────────┐
│  Harness(智能体运行时,例如 DeepSeek Harness) │
│                                              │
│   ┌────────────────────────────┐             │
│   │  模型(可能是蒸馏出来的小模型)│  ← 蒸馏影响这层 │
│   └────────────────────────────┘             │
│                                              │
│   ┌────────────── 能力扩展 ──────────────┐    │
│   │  Skill:内部能力包(指令/流程/脚本)   │    │
│   │  MCP 客户端 ──协议──▶ MCP Server     │    │
│   │            (外部工具/数据源)        │    │
│   └────────────────────────────────────┘    │
└──────────────────────────────────────────────┘
  1. Harness 是容器,其它都装在里面。Harness 负责跑模型、调用工具、执行循环。Skill 和 MCP 都是 harness 用来"扩展模型能力"的手段。

  2. Skill 和 MCP 是互补的两种扩展方式

    • Skill = 给模型"内置知识 / 流程"(带自己的指令,偏静态、本地)
    • MCP = 给模型"外接实时工具 / 数据"(标准化协议,偏动态、联网)
    • 两者可被同一个 harness 同时使用,不冲突
  3. 蒸馏是正交的(独立维度):它只决定"harness 里跑的是哪个模型",不影响 harness / skill / MCP 的架构。一个被蒸馏的小模型,照样可以跑在 harness 里、加载 skill、通过 MCP 调外部工具。

  4. 一句话概括

    蒸馏决定了"大脑多小多便宜";Harness 提供"身体和手脚";Skill 是"随身携带的技能手册";MCP 是"插拔外部设备的通用接口"。


二、AI Agent 完整技术栈(9 层)

上述四个概念只是整个 Agent 技术栈里的几个点。完整栈分 9 层

名称核心内容已讲
模型层基座模型、微调、RL、蒸馏、Embedding蒸馏 ✓
运行时 & 框架层Harness、Agent 框架、循环范式Harness ✓
能力扩展层Skill、MCP、Tool、RAG、插件Skill/MCP ✓
记忆 & 上下文层短期记忆、长期记忆、上下文工程
工具 & 集成层代码沙箱、浏览器自动化、Computer Use
编排 & 多智能体层多智能体、Workflow、Subagent
评估 & 观测层Evals、Benchmark、Tracing
安全 & 治理层沙箱、权限审批、Guardrails
基础设施层推理引擎、向量库、网关、部署

2.1 ① 模型层(Model)

  • 基座模型:LLM / VLM / 多模态
  • 微调:SFT、LoRA、DPO、RLHF
  • 强化学习:RL / GRPO(专门训练"agent 行为",让模型会规划、会用工具、会自我纠错)
  • 蒸馏(已讲)
  • Embedding / Reranker 模型(给 RAG 用)

2.2 ② 运行时 & 框架层(Runtime & Framework)

  • Harness(已讲)
  • Agent 框架:LangChain / LangGraph、LlamaIndex、AutoGen、CrewAI、Semantic Kernel、OpenAI Agents SDK、Google ADK、Dify(低代码)
  • Agent 循环范式:ReAct(推理 + 行动)、Plan-and-Execute、Reflexion(反思)、Tool-use

2.3 ③ 能力扩展层(Capability)

  • Skill(已讲)、MCP(已讲)
  • Tool / Function Calling(模型直接调用函数,比 MCP 更原始、更基础)
  • RAG(检索增强生成:外部知识检索后喂给模型)
  • 插件系统

2.4 ④ 记忆 & 上下文层(Memory & Context)

  • 短期记忆:上下文窗口、KV Cache
  • 长期记忆:向量库 + 记忆系统(MemGPT / Letta、Zep、LangMem)
  • 上下文工程(Context Engineering):压缩、摘要、选择性注入、上下文缓存

2.5 ⑤ 工具 & 集成层(Tools & Integration)

  • 代码执行沙箱:E2B、容器、Code Interpreter
  • 浏览器自动化:Playwright、Puppeteer、Browser-use
  • Computer Use(直接操作电脑屏幕 / 键盘鼠标)
  • 搜索、文件系统、数据库、第三方 API 集成

2.6 ⑥ 编排 & 多智能体层(Orchestration & Multi-agent)

  • 多智能体:主从、协作、竞争 / 辩论、层级式
  • Workflow 编排:DAG、状态机(LangGraph、Temporal、Prefect、n8n)
  • 子代理(Subagent):一个主 agent 派生子任务

2.7 ⑦ 评估 & 观测层(Eval & Observability)

  • 评测基准:SWE-bench、GAIA、AgentBench、τ-bench
  • 追踪观测(Tracing):LangSmith、Langfuse、Arize Phoenix、OpenTelemetry GenAI
  • 成本追踪、质量监控

2.8 ⑧ 安全 & 治理层(Safety & Governance)

  • 沙箱隔离(sandbox)
  • 权限 & 审批:RBAC、human-in-the-loop(关键操作需人工确认)
  • Guardrails:Prompt 注入防护、内容安全、越权拦截
  • 审计日志

2.9 ⑨ 基础设施层(Infrastructure)

  • 推理引擎:vLLM、TGI、SGLang、TensorRT-LLM
  • 向量数据库:Milvus、Pinecone、Weaviate、Qdrant、pgvector、Chroma
  • 模型网关:LiteLLM、One API、OpenRouter、Portkey
  • 部署:K8s、Serverless、GPU 集群

三、整体关系一图流

① 模型层      ← 大脑(可能蒸馏 / 微调 / RL 过)
      │
② 运行时/框架  ← Harness + Agent 框架 + 循环范式
      │
③ 能力扩展    ← Skill / MCP / Tool / RAG
④ 记忆/上下文  ← 短期 + 长期 + 上下文工程
⑤ 工具/集成   ← 沙箱 / 浏览器 / Computer Use
      │
⑥ 编排/多智能体 ← 多 agent + workflow + subagent
      │
⑦ 评估/观测   ← 横向贯穿:测效果、看 trace
⑧ 安全/治理   ← 横向贯穿:沙箱、权限、护栏
      │
⑨ 基础设施    ← 底层:推理、向量库、网关、部署

四、补充要点

  1. 前面问的四个概念覆盖的是:模型层(蒸馏)、运行时层(Harness)、能力扩展层(Skill、MCP)。中间还有记忆、编排、评估、安全、基础设施这五大块未涉及。

  2. 实际落地时最重要的几个(除已讲的):

    • RAG——绝大多数业务 agent 都在用
    • Function Calling / Tool Use——agent 能"动手"的基础
    • 长期记忆——让 agent 跨会话记得住
    • Tracing / 可观测性——生产环境排障刚需
    • 多智能体 / Subagent——复杂任务的拆解协作
  3. 概念 vs 产品:每个类别里都有大量具体产品 / 框架(LangChain、LangGraph、Dify、Milvus、Langfuse…),它们各自属于某一层,不要混为一谈。

  4. 当前趋势:这套栈仍在快速演进,几个较热的方向是 Agentic 专用训练(RL / GRPO)MCP 生态标准化Computer Use / 浏览器智能体上下文工程与记忆系统


五、AI关键词术语速览

🧠 基础概念

术语通俗解释
AI(人工智能)模拟人类智能的技术系统,像能自主升级的“电子大脑”。
AGI(通用人工智能)具备人类广泛认知能力,能跨领域自主解决问题。
AIGC人工智能生成内容的总称(文字、图片、音视频等)。
生成式 AI专门创造全新数字内容(如文本、图像、音乐)的技术。

🤖 模型与架构

术语通俗解释
GPT基于 Transformer 的生成式预训练模型,可写文章、对话。
Transformer基于注意力机制的模型架构,现代大模型的基础。
LLM(大语言模型)处理海量语言信息的 AI 系统,如“超级语料处理器”。
神经网络仿生物神经元连接的计算模型,像层层传递的“快递分拣中心”。
深度学习基于多层神经网络的特征抽象技术。
机器学习通过数据训练模型实现预测和决策。
强化学习通过奖惩机制优化决策,类似游戏策略调整。
GAN(生成对抗网络)生成器与判别器对抗训练,模拟“造假”与“打假”博弈。

🔧 训练与优化

术语通俗解释
监督学习用标注数据训练,像有老师逐题批改作业。
无监督学习自主发现数据规律,像没有参考答案的自学。
半监督学习结合标注与非标注数据训练。
训练集用于模型训练的数据集合。
过拟合模型过度拟合训练数据,导致泛化能力差。
迁移学习将已学知识迁移到新领域,提高学习效率。
特征提取从数据中识别最具辨识度的特征。
参数调整优化模型内部配置的过程。
Fine-tuning(微调)在预训练模型基础上针对性优化。

🛠️ 应用与工具

术语通俗解释
NLP(自然语言处理)让计算机理解、生成人类语言(翻译、情感分析等)。
CV(计算机视觉)让机器解析图像、视频等视觉信息。
TTS(语音合成)文字转自然语音,像 AI 配音演员。
ASR(语音识别)语音转文字技术。
MidJourney文生图扩散模型应用(图片生成工具)。
Hugging Face开源 AI 模型社区,类似 AI 模型的“应用商店”。
OpenAI知名 AI 研究机构,ChatGPT 的创造者。

🧩 其他关键术语

术语通俗解释
Prompt(提示词)引导 AI 输出的指令文本,像唤醒 AI 的“咒语”。
算力计算机处理数据的能力,驱动 AI 运转的“引擎”。

推荐链接:

1. 什么是Skill以及和MCP的区别

2. 学习AI的相关课程

3. 鱼皮的AI知识库


本文档用于梳理 AI Agent 技术栈的核心概念与分层,具体产品 / 框架随生态快速迭代,以最新资料为准。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值