我一开始学习agent,vibecoding时经常遇到一些不懂的名词/问题,查阅资料的时候,回答总是晦涩难懂,我当时一直是半懂不懂的状态;直到最近我学完了rag,Langchain等一系列的课程,回头再看这些知识,我已经有了更深刻更简单的理解,再此分享出来,供大家一起学习交流
1.什么是LLM
LLM,全称是“Long Language Model”,中文意思是“大语言模型”,即我们生活中常用的豆包,deepseek这些ai模型
2.什么是agent
agent的本质是“能调用工具的llm”,普通的llm只能回答问题,输出对话,能力有限,但是agent可以调用各种工具,能力更强
3.市面上有哪些比较好用的agent
国外的有codex,Claude code,国内的有trae,minimax code,work buddy等
4.ai回答的本质
LLM的本质,“就是一个通过海量数据训练出来的、能预测下一个词的超级概率计算器”。没想到吧,其实ai也没有大家想的那么神秘,它的本质其实就是一个“概率预测器”
5.什么是prompt
prompt的中文意思是”提示词“,其实就是你给llm/agent发的提示信息,比如你和它说”你是一个资深的程序员“像这种就是角色设定的prompt
6.有哪些写好prompt的方法?
- 角色设定,就像上面的例子,这样agent能用更加专业的视角回答你的问题
- 明确任务,说清要做什么。比如不要说”帮我分析这段文字“,可以说”帮我把这段文字拆解成三个核心要点“
- 规定输出格式。比如直接告诉它给我输出为markdown格式
- Few-shot。给agent少量例子,让agent大概明白思考方法和回答格式,比如你和它说”告诉我北京的天气;回答:晴天“,这样你再问别的城市的天气,他就会直接回答,不会再返回别的多余信息了
7.什么是skill
skill的中文意思是”技能“,我觉得它的本质其实是"一套写好的操作流程";比如你给ai一个“帮我写一份报告”的指令,如果它被配置了一个专门写报告的skill,那么他就会按照skill里的文档里说明的去做,比如“第一步先查阅相同领域的报告文档,后面再…”,一个优秀的skill会比起我们普通给ai的指令会更加专业,更节省token
8.skill和prompt的区别
那你可能会问了,其实prompt也可以做到啊,在写prompt的时候也可以先写好让ai先做什么,再做什么啊;但是不同的是,prompt你每次都要写一遍给ai,但是skill可以无限次调用,当ai自己识别到可以用这个skill,它就会自己调用,更加节省token,提升效率。
9.什么是插件
插件就是赋予大模型“手脚”的外部工具,让 AI 能够突破纯文本的限制,去联网搜索、计算或执行具体操作。使 AI 从单纯的“聊天工具”进化为能解决现实问题的“任务执行系统”。比如你给agent安装了Wolfram 插件,那么它在数学计算时就可以调用Wolfram 工具,去进行更加精确的数学计算。在我看来,它其实就是Langchain里的tools(工具),只是换了个名字
10.什么是api-key
api-key是一个“密钥”,每个人的api-key都是独一无二的,它是你调用大模型的“身份证”,大模型供应商会根据你的api-key,准确记录你使用了多少次服务,以便进行计费和权限控制;这个就涉及到钱啦,所以千万不能随意暴露自己的api-key哦
11.什么是token
Token(词元)就是大模型处理文本时的最小基本单元。同时,token也是衡量AI信息消耗和计算成本的核心计量单位。
12.token有什么意义
你给ai发一长串话,ai没法全部理解,AI 会把你的长串话切分成一个个 Token(词元),把它们转化为数字后,通过复杂的数学计算瞬间感知它们之间的整体关系,从而理解整句话的意思。
—基础篇&spm=1001.2101.3001.5002&articleId=163760480&d=1&t=3&u=2264649af8704ad79d59cb4dce58b072)
334

被折叠的 条评论
为什么被折叠?



