本文介绍了Agent的基础概念,包括Agent的核心公式、Agent与大模型的对比、记忆系统设计等。文章还对比了主流的Agent开发框架,并提供了选型建议。此外,本文详细阐述了Agent的三种工作模式:反应式、深思熟虑式和混合式,并探讨了RAG与Tool的知识管理策略。最后,文章分享了LangGraph实战要点、Agent与工作流的区别、实战技巧以及进阶学习路径。对于想要学习大模型开发的小白或程序员来说,本文提供了一个全面而实用的入门指南。

一、Agent 基础概念
- 1 Agent 核心公式
Agent = 大模型 + System Prompt + 工具(Tools) + 知识库(RAG) + 记忆(Memory)
智能体是大模型的工程化应用,通过配备插件使其具备:
-大模型:推理引擎 规划能力 将复杂任务分解为可执行步骤
-System Prompt:角色定义和行为指导
-工具(Tools):调用外部 API、检索数据、执行操作
-知识库(RAG):领域知识检索
-记忆(Memory):短期记忆(上下文)+ 长期记忆(文件存储)
- 2 Agent vs 大模型
| 对比维度 | 纯大模型 | Agent |
|---|---|---|
| 交互模式 | 对话式问答 | 长程任务执行 |
| 能力范围 | 文本生成 | 自主规划 + 工具调用 |
| 记忆机制 | 上下文窗口 | 文件系统持久化 |
| 适用场景 | 简单咨询 | 复杂任务链 |
关键特性:
- Agent 具备自主规划能力,可根据要求自行决策调用哪些工具
- 通过多步执行(Action)完成复杂任务
- 典型限制:单次执行步数上限约 50 步

- 3 记忆系统设计
短期记忆
- 当前对话的上下文(如前 5 轮)
- 存储在会话状态中
长期记忆
- 通过文件读写(read_file / write_file)实现
- 案例:Kimi 会记住用户历史偏好,背后是 write_file 机制

二、Agent 开发框架对比
- 1 主流框架
| 框架 | 特点 | 适用场景 |
|---|---|---|
| LangChain / LangGraph | 高代码,工作流可视化(Mermaid),生态完善 | 企业级项目,需要精细控制流程 |
| Qwen-Agent | 轻量级,内置 GUI,快速验证 | 原型开发,小型项目 |
| Coze / Dify | 低代码拖拉拽,入门友好 | 业务人员快速搭建,不需深度定制 |
| OpenClaw / Hermes | Skill 两段式调用,内置工具 | 需要模块化工具管理 |

- 2 框架选型建议
高代码框架(推荐)
- LangChain / LangGraph:面试必备,企业主流
- Qwen-Agent:代码量是 LangGraph 的一半,快速交付
低代码框架
- Coze / Dify:理解 Agent 逻辑的学习工具,生产环境受限

2.3 LangGraph 核心机制
状态图(StateGraph)
# 创建状态图
workflow = StateGraph(AgentState)
# 添加节点(每个节点 = 一个任务)
workflow.add_node("感知", perception_node)
workflow.add_node("建模", modeling_node)
workflow.add_node("推理", reasoning_node)
# 添加边(定义执行顺序)
workflow.add_edge("感知", "建模")
workflow.add_edge("建模", "推理")
# 设置入口和出口
workflow.set_entry_point("感知")
workflow.add_edge("推理", END)
条件边(Conditional Edge)
# 根据运行时状态动态选择路径
workflow.add_conditional_edges(
"评估节点",
route_function, # 返回 "reactive" 或 "deliberative"
{
"reactive": "快速响应节点",
"deliberative": "深思熟虑节点"
}
)

三、Agent 三种工作模式
3.1 反应式(Reactive)
特点
- 接收输入 → 单次工具调用 → 立即返回
- 无复杂推理链路
- 适合高频、简单、时效性强的场景

典型场景
- 查询股票实时价格
- NPC 对话响应
- 工业控制传感器报警
优缺点
| 优势 | 劣势 |
|---|---|
| 速度快,延迟低 | 无法处理复杂任务 |
| 易于验证和调试 | 可能陷入循环(如扫地机器人转圈) |

案例:私募基金问答助手
# 工具注册示例
@tool
defsearch_rules_by_keywords(keywords: str):
"""根据关键词检索私募基金规则"""
# 从知识库匹配关键词
return matched_rules
@tool
defsearch_rules_by_category(category: str):
"""根据类别检索私募基金规则"""
# 按类别筛选
return category_rules
# Agent 创建
agent = create_agent(
llm=ChatOpenAI(model="qwen-plus"),
tools=[search_rules_by_keywords, search_rules_by_category],
system_prompt="你是私募基金咨询助手..."
)
工具调用的不确定性
- 同一问题可能调用不同工具(关键词检索 vs 类别检索)
- 概率性选择工具,无法完全预测
- 2 深思熟虑式(Deliberative)
特点
- 多节点流水线(Pipeline)
- 每个节点独立完成子任务
- 结果逐层传递,最终汇总

典型场景
- 投资研究报告生成
- 物流路径优化
- 复杂决策(需比较多个候选方案)
工作流设计(5 节点示例)


| 节点 | 职责 | 输入 | 输出 |
|---|---|---|---|
| 感知 | 收集市场数据 | 研究主题、行业焦点 | 市场信息摘要 |
| 建模 | 分析市场状态 | 感知节点输出 | 经济周期判断、风险因素 |
| 推理 | 生成多个候选方案 | 建模节点输出 | 3-5 个投资策略方案 |
| 决策 | 方案评分筛选 | 候选方案列表 | 选中方案(置信度最高) |
| 报告 | 撰写完整报告 | 所有前序节点结果 | 最终投研报告 |
置信度(Confidence)的作用
- 解决"每个方案看起来都很好"的问题
- 让 Agent 自我打分,辅助决策
- 适用于方案数量 > 3 的场景
案例:智能投研助手
# 状态定义
classAgentState(TypedDict):
research_topic: str # 研究主题
industry_focus: str # 行业焦点
time_horizon: str # 时间范围(短期/中期/长期)
perception_data: str # 感知阶段输出
modeling_result: str # 建模阶段输出
candidate_plans: List # 候选方案
selected_plan: str # 选中方案
final_report: str # 最终报告
# 节点示例:建模节点
defmodeling_node(state: AgentState):
prompt = f"""
你是专业投资分析师,根据以下市场信息分析:
{state['perception_data']}
请分析:
1. 当前经济周期阶段
2. 主要风险因素
3. 结构性机会
"""
result = llm.invoke(prompt)
return {"modeling_result": result.content}
执行时间
- 单次运行约 1-2 分钟
- 每个节点独立推理,无法并行
- 3 混合式(Hybrid)

设计思路
- 意图识别节点(Router)判断任务复杂度
- 简单任务 → Reactive 路径
- 复杂任务 → Deliberative 路径
架构图

意图识别实现
defassess_query(state: AgentState):
"""评估任务复杂度"""
prompt = f"""
用户问题:{state['user_query']}
判断任务类型:
- reactive:需要快速查询(如查股价、查余额)
- deliberative:需要深度分析(如投资规划、风险评估)
返回 JSON:{{"mode": "reactive"或"deliberative"}}
"""
result = llm.invoke(prompt)
return {"processing_mode": result.mode}
# 条件路由
workflow.add_conditional_edges(
"assess_query",
lambdax: x["processing_mode"],
{
"reactive": "reactive_agent",
"deliberative": "collect_data"
}
)
典型对话场景
| 用户提问 | 路由选择 | 原因 |
|---|---|---|
| 今天上证指数多少点? | Reactive | 单次查询,无需分析 |
| 如何应对经济衰退调整投资组合? | Deliberative | 需市场分析 + 多方案比较 |
四、RAG vs Tool:知识管理策略
- 1 对比分析
| 维度 | RAG(知识库) | Tool(工具调用) |
|---|---|---|
| 稳定性 | 高(Pipeline 固定) | 低(AI 随机选择工具) |
| 灵活性 | 低(受切分/检索算法限制) | 高(多维度动态检索) |
| 适用场景 | 领域知识相对固定 | 多维度、复杂领域 |
| 实现方式 | 文件切分 → Top-K 检索 | 注册多个检索工具 |
- 2 推荐策略
简单场景(优先 RAG)
- 知识库边界清晰(如企业内部规章制度)
- 问题类型相对固定
复杂场景(RAG + Tool 组合)
# 工具层:多维度检索
@tool
defsearch_by_keyword(keyword: str): ...
@tool
defsearch_by_category(category: str): ...
@tool
defsearch_financial_report(company: str): ...
# RAG 层:提供"使用说明书"
faq_content = """
情况 1:用户询问公司财报,调用 search_financial_report(公司名)
情况 2:用户询问行业分类信息,调用 search_by_category(类别名)
情况 3:...
"""
# 将 faq_content 作为 RAG 文档,指导 Agent 何时用哪个工具
核心原则
- Tool 负责"数据获取"(多维度灵活检索)
- RAG 负责"决策指导"(Few-Shot 示例 + 思维链)
4.3 RAG 的新角色
传统 RAG:直接提供答案片段
现代 RAG:提供"操作手册"
faq.txt(作为 RAG 文档)
用户询问财报数据
- 调用:search_financial_report(公司名)
- 示例:用户问"贵州茅台营收",调用 search_financial_report("贵州茅台")
用户询问行业趋势
- 步骤1:调用 web_search(行业关键词)
- 步骤2:调用 search_by_category(行业类别)
- 步骤3:综合结果生成分析
五、LangGraph 实战要点
-
1 核心组件
-
StateGraph(状态图)
from langgraph.graph import StateGraph, END
# 定义共享状态
classAgentState(TypedDict):
user_query: str
processing_mode: str
tools_output: str
final_result: str
# 创建图
workflow = StateGraph(AgentState)
- 节点(Node)
- 每个节点 = 一个函数
- 函数签名:
def node_func(state: AgentState) -> dict - 返回值会更新 state
- 边(Edge)
- 普通边:
workflow.add_edge("A", "B") - 条件边:根据运行时状态动态路由
- 2 调试技巧
生成 Mermaid 流程图
# 打印流程图代码
print(workflow.get_graph().draw_mermaid())
# 粘贴到 https://mermaid.live/ 可视化
状态追踪
# 在节点中打印状态
defdebug_node(state):
print(f"当前状态:{state}")
return {}
- 3 与 Coze 的对比
| 维度 | LangGraph | Coze |
|---|---|---|
| 开发方式 | 代码定义流程 | 拖拉拽可视化 |
| 灵活度 | 动态修改流程(代码控制) | 受限于界面功能 |
| 开发效率 | 需要编码,AI 辅助快 | 手动配置,节点多时繁琐 |
| 适用规模 | 30+ 节点复杂流程 | 小型原型(< 10 节点) |
结论:LangGraph 更适合生产环境,Coze 适合快速验证想法
六、Agent vs 工作流
- 1 核心区别
| 对比维度 | Agent | 工作流(Workflow) |
|---|---|---|
| 驱动方式 | 对话驱动(需外界 Push) | 定时/事件驱动(自动执行) |
| 流程 | 动态(AI 决定下一步) | 固定(预定义流程图) |
| 适用场景 | 通用助手、开放式任务 | 周期性任务、固定流程 |
| 落地难度 | 高(需持续对话) | 低(设置后自动运行) |
- 2 项目落地建议
优先工作流(80% 价值)
- 每天固定时间执行的任务(如每日市场简报)
- 流程明确的场景(如数据同步、报告生成)
配合 Agent(20% 价值)
- 处理临时性、个性化问题
- 作为工作流的"异常处理器"
示例:量化交易系统
# 工作流:每天开盘前执行
defdaily_workflow():
# 1. 抓取新闻
news = fetch_news()
# 2. 分析热点板块
sectors = analyze_sectors(news)
# 3. 生成持仓建议
report = generate_report(sectors)
# 4. 发送邮件
send_email(report)
# Agent:处理用户临时提问
agent = create_agent(
tools=[query_stock, query_position, ...],
prompt="你是量化交易助手..."
)
七、实战技巧
- 1 从 0 到 1 的正确姿势
❌ 错误做法:直接让 AI 写完整项目
- 代码不稳定,需反复调试
- 难以把控细节
✅ 推荐做法:基于现有案例改写
- 找相似案例
- 跑通代码,理解逻辑
- 让 AI 基于案例修改
- 迭代优化
示例对话
@hybrid_wealth_advisor_langgraph.py
@assistant_ticket_bot-3.py
这是一个混合式投顾助手(LangGraph 实现)
参考 assistant_ticket_bot-3.py(Qwen-Agent 实现)
帮我用 Qwen-Agent 重写,保留混合式逻辑
写入新的 .py 文件
7.2 AI 辅助开发技巧
- 生成代码文档
@文件路径
帮我整理代码逻辑,可以适当讲解示例
不超过 800 字,整理到 .html
包含 Mermaid 流程图
- 二次开发
- 先跑通现有案例
- 基于案例 @原文件 + 需求描述
- 让 AI 增量修改
- 避免从零开始
- 找同类型框架案例(Agent 类 → 找 Qwen-Agent 案例)
- 找同类型模式案例(工作流 → 找 LangGraph 案例)
- 形式确定后,改内容比改架构容易 10 倍
- 3 工具选择决策树

八、关键知识点速查
8.1 Function Call vs MCP
| 对比项 | Function Call | MCP |
|---|---|---|
| 协议层 | LLM API 内置 | 独立协议(6277 端口) |
| 注册方式 | API 参数 | FastMCP 包装 |
| 适用场景 | 简单工具调用 | 跨平台工具共享 |
转换方式
# Function Call → MCP
from fastmcp import FastMCP
mcp = FastMCP("我的工具")
@mcp.tool()
defmy_function(param: str):
"""原有 Function Call"""
return result
# 启动 MCP 服务(默认 6277 端口)
mcp.run()
- 2 WebSearch 实现
方式 1:调用大模型自带 WebSearch
# Qwen / Kimi / GLM 都支持
response = llm.invoke(
prompt,
enable_search=True # 参数名各厂商不同
)
方式 2:自建 WebSearch 工具
@tool
defreal_time_stock_price(symbol: str):
"""实时查询股票价格(精确到秒)"""
# 调用东方财富 API
return fetch_stock_api(symbol)
推荐:实时性要求高的数据(如股价)用自建工具,一般信息用大模型 WebSearch
- 3 Skill 两段式调用
第一段:决定调用哪个 Skill
name: read_file
description: 读取指定文件内容
第二段:读取 Skill 详细说明
# SKILL.md
## 调用方式
read_file(file_path: str) -> str
## 参数说明
- file_path: 绝对路径,支持 .txt / .md / .py
## 返回值
文件内容字符串
## 示例
read_file("/path/to/file.txt")
调用流程
-
LLM 根据 name/description 选择 Skill
-
调用 read_file 工具加载 SKILL.md
-
根据详细说明执行具体操作
九、课程案例总结
Case 1:私募基金问答助手(反应式)
-技术栈:LangChain + Function Call
-知识库:3 条规则(JSON 格式)
-工具数量:3 个(关键词检索、类别检索、QA 匹配)
-特点:快速响应,单次工具调用
Case 2:智能投研助手(深思熟虑)
-技术栈:LangGraph 工作流
-节点数量:5 个(感知 → 建模 → 推理 → 决策 → 报告)
-运行时间:约 1-2 分钟
-特点:多方案生成 + 置信度评分
Case 3:投顾 AI 助手(混合式)
-技术栈:LangGraph + 条件边
-路由节点:意图识别(Assess Query)
-分支:Reactive(快速查询)+ Deliberative(深度分析)
-特点:根据任务复杂度自动选择模式
构建Agent的核心思想



十、进阶学习路径
-
掌握基础:跑通三个 Case,理解三种模式
-
框架对比:LangGraph(工作流)vs Qwen-Agent(灵活)
-
二次开发:基于案例改写成自己的场景
-
优化策略:
-
工具设计:减少工具间冲突(如合并相似工具)
-
Prompt 优化:在 RAG 中提供 Few-Shot 示例
-
流程简化:用条件边替代冗余节点
-
-
生产部署:
-
错误处理:工具调用失败的兜底逻辑
-
成本控制:缓存高频查询结果
-
监控告警:记录异常路径和耗时
-
学习建议
如果说程序员已经是高薪职业,那么干AI的程序员,就是高薪中的高薪。

现在的市场,已经用数据给程序员指明了方向:学AI大模型,就是冲刺高薪的最优解!

看着身边越来越多的同行转型大模型、拿到高薪offer,很多人心里都动了心,但真正的难题来了:零基础小白不知道从哪入门?有基础的程序员找不到系统学习路径?实战项目练手无门?面试不知道考什么?
别慌!今天就给大家整理了一份【2026年最新版】AI大模型免费学习资源包,覆盖从入门到实战、从理论到面试、从基础到进阶的全流程,所有资料均已整理归档,无冗余、无套路,免费分享给每一位想抓住AI风口的程序员和小白!
👇👇扫码免费领取全部内容👇👇

1、大模型系统化学习路线

2、大模型学习书籍&文档

3、AI大模型最新行业报告

4、大模型项目实战&配套源码

5、大模型大厂面试真题

四阶段精细化学习规划(附时间节点,可直接照做)
结合上述资源,给大家整理了一份可直接落地的四阶段学习规划,总时长约2个月,小白可循序渐进,程序员可根据自身基础调整节奏,高效掌握大模型核心能力,快速实现从“入门”到“能落地、能面试”的跨越。
第一阶段(10天):初阶应用
该阶段让大家对大模型 AI有一个最前沿的认识,对大模型 AI 的理解超过 95% 的人,可以在相关讨论时发表高级、不跟风、又接地气的见解,别人只会和 AI 聊天,而你能调教 AI,并能用代码将大模型和业务衔接。
- 大模型 AI 能干什么?
- 大模型是怎样获得「智能」的?
- 用好 AI 的核心心法
- 大模型应用业务架构
- 大模型应用技术架构
- 代码示例:向 GPT-3.5 灌入新知识
- 提示工程的意义和核心思想
- Prompt 典型构成
- 指令调优方法论
- 思维链和思维树
- Prompt 攻击和防范
- …
第二阶段(30天):高阶应用
该阶段我们正式进入大模型 AI 进阶实战学习,学会构造私有知识库,扩展 AI 的能力。快速开发一个完整的基于 agent 对话机器人。掌握功能最强的大模型开发框架,抓住最新的技术进展,适合 Python 和 JavaScript 程序员。
- 为什么要做 RAG
- 搭建一个简单的 ChatPDF
- 检索的基础概念
- 什么是向量表示(Embeddings)
- 向量数据库与向量检索
- 基于向量检索的 RAG
- 搭建 RAG 系统的扩展知识
- 混合检索与 RAG-Fusion 简介
- 向量模型本地部署
- …
第三阶段(30天):模型训练
恭喜你,如果学到这里,你基本可以找到一份大模型 AI相关的工作,自己也能训练 GPT 了!通过微调,训练自己的垂直大模型,能独立训练开源多模态大模型,掌握更多技术方案。
到此为止,大概2个月的时间。你已经成为了一名“AI小子”。那么你还想往下探索吗?
- 为什么要做 RAG
- 什么是模型
- 什么是模型训练
- 求解器 & 损失函数简介
- 小实验2:手写一个简单的神经网络并训练它
- 什么是训练/预训练/微调/轻量化微调
- Transformer结构简介
- 轻量化微调
- 实验数据集的构建
- …
第四阶段(20天):商业闭环
对全球大模型从性能、吞吐量、成本等方面有一定的认知,可以在云端和本地等多种环境下部署大模型,找到适合自己的项目/创业方向,做一名被 AI 武装的产品经理。
- 硬件选型
- 带你了解全球大模型
- 使用国产大模型服务
- 搭建 OpenAI 代理
- 热身:基于阿里云 PAI 部署 Stable Diffusion
- 在本地计算机运行大模型
- 大模型的私有化部署
- 基于 vLLM 部署大模型
- 案例:如何优雅地在阿里云私有部署开源大模型
- 部署一套开源 LLM 项目
- 内容安全
- 互联网信息服务算法备案
- …
👇👇扫码免费领取全部内容👇👇

6、这些资料真的有用吗?
这份资料由我和鲁为民博士(北京清华大学学士和美国加州理工学院博士)共同整理,现任上海殷泊信息科技CEO,其创立的MoPaaS云平台获Forrester全球’强劲表现者’认证,服务航天科工、国家电网等1000+企业,以第一作者在IEEE Transactions发表论文50+篇,获NASA JPL火星探测系统强化学习专利等35项中美专利。本套AI大模型课程由清华大学-加州理工双料博士、吴文俊人工智能奖得主鲁为民教授领衔研发。
资料内容涵盖了从入门到进阶的各类视频教程和实战项目,无论你是小白还是有些技术基础的技术人员,这份资料都绝对能帮助你提升薪资待遇,转行大模型岗位。


这份完整版的大模型 AI 学习资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】


653

被折叠的 条评论
为什么被折叠?



