AI时代必修课:构建FDE的核心交付能力实战工作坊

《构建FDE的核心交付能力实战工作坊》

大模型实战专家—周红伟老师 法国科学院数据算法博士/前阿里人工智能专家/曾任马上消费风控负责人

课程背景

FDE成为AI行业落地的标准职位。OpenAI和Anthropic组建FDE工程团队。

目前缺乏针对FDE的系统训练方法。大部分转型过来的工程师面临三个共同的困境:第一,习惯了拿到明确需求再动手,到了客户现场发现需求本身就是模糊的,不知道从哪里开始。第二,技术能力没问题,但不知道怎么在客户盯着屏幕时当场改方案,也不知道怎么把一次失败的项目变成对公司有价值的情报。第三,对Agent、Skills这些新工具会用来做Demo,但不知道怎么能稳定跑在生产环境里,更不知道怎么交给客户的团队自己维护。

这门课就是为这三个困境设计的。它不讲通用的AI原理,也不讲单一工具的文档用法,而是把FDE日常工作中最高频、最容易卡住的环节拆开,用两天时间密集训练一套能直接带走的工作方法。

课程收益

学完这两天,你能带走的东西包括:

一、一套从模糊需求到可运行Agent的工作流程。从客户说“我想用AI做点什么”开始,到画工作流草图、拆任务节点、搭最小可行Agent、现场迭代实操。

二、对Hermes智能体架构的实际操作能力。能理解它的感知、规划、执行、反思循环,能把它嵌入客户的具体业务流程里,能在私有化环境下把依赖打包跑通。

三、写Skill和复用Skill的方法。知道合格的Skill应该包含什么,能把客户现场的常见任务封装成标准化Skill,能在团队内部建立Skill集市避免重复造轮子。

四、判断模型边界的直觉。能用压力测试探测模型在特定场景下的能力边界,能判断什么任务该用RAG、什么该走规则,能把失败案例整理成可复用的避坑清单。

五、把客户现场信息转化成内部反馈的能力。能结构化地记录客户痛点,能分析根因,能写出让产品和研发看得懂、动得了的反馈报告,能在内部推动需求落地。

课程特色

案例精讲+案例实操+项目实操+代码实操;项目实战交付;

培训时长

2天

课程大纲

第一天 构建FDE的核心交付能力和案例实操

第一部分 FDE交付闭环:从模糊需求到可运行Agent
1.1 丢掉SOW,从Mission开始
1.1.1 用真实客户的模糊需求开场,让学员先写下自己会怎么接这个活
1.1.2 拆解Mission的关键动作:把一句话需求变成3到5个可以由Agent完成的任务节点
1.1.3 引入Agent编排画布工具,动手画第一版工作流草图,标出每一步谁来做决策

1.2 现场搭能跑的最小Agent
1.2.1 选最简单的主线任务,用提前准备好的模板搭出能跑通的Agent
1.2.2 演示如何在客户盯着你屏幕时改System Prompt,调整Agent的行为
1.2.3 练习在客户说“这不是我要的”之后,15分钟内重新跑一遍演示

1.3 看清Demo和上线的距离
1.3.1 拿出3个Demo时完美上线后崩溃的真实案例,逐个拆解死因
1.3.2 给Agent加上日志、报警和人工暂停按钮,从玩具变成能用的东西
1.3.3 总结从Demo到Production的检查清单,贴在工位上每次上线前过一遍

第二部分 Hermes智能体:FDE的现场决策引擎
2.1 为什么你需要Hermes
2.1.1 回顾传统Prompt链路的三个常见痛点:僵化、脆弱、难调试
2.1.2 讲清Hermes的“感知-规划-执行-反思”循环,画在一张白板上反复对照
2.1.3 把反欺诈调查员的真实工作流拆开,展示Hermes循环怎么嵌入进去

2.2 Hermes的架构现场拆解
2.2.1 用一套开源的Hermes实例,把每个模块的输入输出打印出来看
2.2.2 学员动手修改规划步骤的逻辑,观察Agent后续行为的变化
2.2.3 讨论:什么场景下应该让Hermes自己规划,什么场景应该走固定编排

2.3 让Hermes跑在客户业务里
2.3.1 接入客户真实API时的三个常见坑:鉴权、限流、超时,逐条过方案
2.3.2 如何把客户内部术语映射到Agent的指令里,避免模型理解偏差
2.3.3 完成练习:在客户的内网环境里把Hermes跑通,输出第一份正确结果

第三部分 Skills:把能力拆成可拼装的积木
3.1 Skills不是写代码,是定义能力
3.1.1 从烂Skill开始讲,让大家挑毛病,建立好坏判断标准
3.1.2 拆解好的Skill包含什么:名称、描述、参数、接口、输出格式
3.1.3 现场写简单的Skill,然后让其他人调用来找茬

3.2 把客户现场任务变成标准化Skill
3.2.1 从客户现场带回来的常见需求中抽象出3到5个高频Skill
3.2.2 给Skill写描述让三个不同的Agent调用,对比输出一致性
3.2.3 讨论Skill应该写到多细才算合格,粗细之间的分界线在哪里

3.3 建Skill集市
3.3.1 把所有人写的Skill放在共享目录里,按行业和场景分好类
3.3.2 定简单规范让下人能找到、看懂、直接用别人写的Skill
3.3.3 演练:接到新客户后先在集市里翻一遍,匹配能复用的Skill再动手

第四部分 模型边界的肌肉记忆
4.1 摸清模型能做什么不能做什么
4.1.1 用同一组指令测试三个不同模型,观察输出的差异并记录
4.1.2 设计有针对性的压力测试集,专门测幻觉、遗忘、逻辑断裂
4.1.3 每天选自己跑出来的失败case放进个人错题本,标注根因

4.2 RAG、规则、Fallback的选择直觉
4.2.1 用五个真实业务场景做判断题,训练什么时候该用RAG
4.2.2 讨论三个强规则约束的场景,推导出必须加规则引擎的信号
4.2.3 设计人工兜底节点的触发条件,写出具体的阈值和逻辑

4.3 失败案例解剖
4.3.1 每人带自己遇到过的最头疼的失败case,当堂分组解剖
4.3.2 用同一套框架分析每个case:模型问题、编排问题还是Skill问题
4.3.3 把解剖结果归纳成一份避坑清单,后续新项目启动时先拿出来对照

第五部分 从客户现场到产品Roadmap
5.1 你不是去交付项目
5.1.1 把FDE的定位重新讲清楚:前线感知器,不是高级外包
5.1.2 解释反馈链路为什么值钱,模型公司为什么愿意为这个付高薪
5.1.3 分组讨论:自己做过的项目里哪些信息如果能回流就价值巨大

5.2 把客户抱怨变成可行动的反馈
5.2.1 拿到一句“这个太慢了”,逐层拆出问题现象、根因、改进方向、商业价值
5.2.2 练习用同一套模板写反馈条,让产品和研发看完就能动手
5.2.3 对比一份好反馈和一份烂反馈,明确差距在哪里

5.3 把反馈推进产品Roadmap
5.3.1 模拟一次产品规划会,FDE要在3分钟内把反馈讲清楚争取排期
5.3.2 写一份内部问题单,附上客户场景截图、日志、影响范围
5.3.3 总结FDE推动内部改进的三条常用路径:提issue、产品会、直接找owner

第六部分 全天实战:从Mission到交付模拟
6.1 拿到Mission开始动手
6.1.1 给模拟银行客户的模糊需求,两人一组开始拆解任务
6.1.2 用画布画出Agent工作流,列好需要哪些Skill然后分工去写
6.1.3 各组在2小时内完成可跑通的MVP原型

6.2 模拟客户会议当场迭代
6.2.1 导师扮演客户,每组轮流演示原型并接收反馈
6.2.2 现场改System Prompt或换Skill,15分钟内重新演示
6.2.3 迭代两轮后评估原型的可用性改进幅度

第二天 FDE在复杂场景中实战交付

第一部分 复杂业务场景下的Agent设计
1.1 多Agent协同模式
1.1.1 区分三种协同方式:串行管道、并行分派、自由协作,各举适用场景
1.1.2 设计跨部门审批场景的Agent群,画出消息传递路径
1.1.3 讨论多Agent协同时最常出的三个乱子:消息丢失、重复处理、顺序错乱

1.2 长时间运行任务的编排
1.2.1 拆解可能跑几小时甚至几天的任务,设计分段和检查点
1.2.2 给Agent加上中断恢复能力,停电断网后能从断点继续
1.2.3 讨论什么时候该用排队机制把任务存下来,而不是让Agent一直等着

1.3 在客户私有化环境里的交付
1.3.1 列出私有化部署的五个硬约束:网络隔离、模型本地、鉴权体系、审计日志、合规备案
1.3.2 如何在离线环境下把依赖打包好,确保到现场能一次跑通
1.3.3 用一套模拟的私有化环境完成部署,跑出第一份结果并截图留证

第二部分 调优与排障实战
2.1 Agent行为不符合预期时的排查路径
2.1.1 从现象倒推:先用日志锁定是哪个环节出的问题
2.1.2 用二分法逐步缩小范围,定位到具体的Skill或Prompt语句
2.1.3 拿着定位到的问题当场改完重跑,记录修复前后的对比

2.2 Skill调用失败的处理策略
2.2.1 列出Skill失败的五种常见类型:超时、返回空、格式错、权限不够、数据脏
2.2.2 给每种失败设计对应的重试或降级策略,写进Skill定义里
2.2.3 在代码里加入失败计数器和熔断机制,避免坏Skill拖垮整个Agent

2.3 客户说模型变笨了怎么办
2.3.1 收集证据:把同case在旧版本和新版本上的输出对比
2.3.2 用一组标准化的测试case跑一遍,把退步的地方标出来
2.3.3 决定下一步:调整Prompt绕过、换模型、还是反馈给内部团队等修复

第三部分 交付物的落地与交接
3.1 什么该留什么该扔
3.1.1 区分三类交付物:代码和Skill、操作文档、给高管的汇报
3.1.2 代码交接的核心不是堆注释,是让客户的工程师能自己改得动
3.1.3 文档只写最关键的三件事:怎么跑起来、常见问题怎么排、找谁求救

3.2 让客户团队能自己接手
3.2.1 设计一次30分钟的交接会:10分钟演示、10分钟答疑、10分钟让他们自己操作
3.2.2 教会客户最核心的维护动作:改Prompt让Agent适配业务变化
3.2.3 用录屏工具把常见维护操作录下来,文件命名写清楚日期和场景

3.3 离开后的持续支撑
3.3.1 跟客户定好未来月的响应节奏和联系方式
3.3.2 在内部记录这个客户的状态、遗留问题、可扩展的方向
3.3.3 三个月后回访一次,收集Agent真实运行数据作为后续迭代的依据

第四部分 内部反馈的推动与汇报
4.1 写好一份让产品经理秒懂的反馈报告
4.1.1 用一套标准模板写反馈报告,含问题现象、复现步骤、根因判断、改进建议四个部分
4.1.2 对比三份真实反馈报告的改前改后版本,抽取出好坏标准
4.1.3 每人写一份针对自己昨天实战项目的反馈报告,互评打分

4.2 在内部推动需求落地
4.2.1 画出一张内部决策流程图,找到你反馈的问题最终谁拍板
4.2.2 模拟一次1对1沟通,用3分钟说服产品经理把这个需求排上
4.2.3 讨论如果产品没排期怎么办:自己写Skill先用、拉客户一起提需求、还是等

4.3 用数据讲你的工作价值
4.3.1 列出FDE值得记录的三类数据:客户用量、解决的问题数、带来的新增消耗
4.3.2 用季度维度的表格展示自己的输出,标注哪些影响了内部决策
4.3.3 写100字的自我总结,用于内部述职或晋升材料

第五部分 全套流程大演练
5.1 拿到新客户Mission开始部署
5.1.1 接到新场景Mission,由学员独立完成从拆解到Agent设计
5.1.2 列出需要提前准备的环境信息和客户资料清单
5.1.3 搭建Agent并完成第一轮自测,确保交付给客户前基本可用

5.2 客户现场演示与迭代
5.2.1 每组在导师扮演的客户面前演示,接收随机抛出的刁钻问题
5.2.2 现场调整方案并重新演示,两轮迭代后评估最终效果
5.2.3 其他组观察并记录反馈手法,结束后互评优劣

5.3 收尾复盘与认证评估
5.3.1 每人用一页纸总结自己的Agent做了什么、遇到什么问题、如何解决
5.3.2 导师从原型可用性、迭代速度、Skill复用度三个维度打分
5.3.3 公布考核结果,颁发课程认证,收集每个人下一步的行动计划

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

AI周红伟

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值