1. 纯Prompt问答

纯Prompt问答是指直接通过自然语言指令(Prompt)与大模型进行交互,利用其强大的推理和生成能力来完成特定任务。这是大模型最基础、最直接的应用方式,无需额外的工具调用或多步规划。

核心特点:

  • 单次交互:用户输入一个问题或指令,模型一次性给出完整回答。
  • 依赖模型知识:回答质量主要取决于模型预训练和微调阶段学习到的知识。
  • 任务相对简单:适用于信息提取、内容生成、分类、翻译等逻辑清晰、步骤单一的任务。

典型应用场景:

  • 文本摘要与分析:快速总结长篇文章、报告或会议记录的核心内容。
  • 舆情分析:对大量用户评论、社交媒体帖子进行情感倾向(正面/负面/中性)分类和观点提炼。
  • AI对话与客服:基于通用知识库进行问答,解答常见问题。
  • 内容创作与改写:撰写邮件、广告文案、诗歌,或对现有文本进行润色、扩写、缩写。
  • 代码解释与生成:解释一段代码的功能,或根据描述生成简单的代码片段。

局限性:

  • 知识截止性:无法获取训练数据之外的最新信息或私有数据。
  • 缺乏执行能力:只能“说”,不能“做”,无法调用外部API、查询数据库或执行计算。
  • 复杂任务处理能力弱:对于需要多步骤推理、动态规划或依赖实时信息的复杂任务,效果有限。

与Agent、RAG的关系:纯Prompt问答是构建更复杂AI应用(如Agent、RAG)的基础。Agent在其“思考”环节会频繁使用Prompt与大模型交互;RAG则是在生成最终答案前,先通过检索为Prompt补充最新的外部知识。

纯Prompt问答示意图:用户输入问题,大模型直接生成答案

2. Agent(智能体)

Agent(智能体)是一种能够感知环境、自主决策并执行任务以达成目标的智能系统。它通过将复杂任务拆解为可执行的子步骤,并利用工具(如搜索、计算、代码执行等)来逐步完成。你可以把它想象成一个拥有“思考-行动”循环的虚拟助手。

核心工作流程:

  1. 任务理解与规划:Agent 首先理解用户指令,并规划出完成任务所需的步骤序列。
  2. 工具调用与执行:根据规划,选择合适的工具(如搜索引擎、API、计算器)来执行具体操作。
  3. 观察与迭代:执行后观察结果,判断是否达成目标。若未完成,则调整策略并继续执行,直至任务完成或无法继续。

通俗比喻:让 Agent “炒一盘番茄炒蛋”。它会先思考步骤:1. 准备食材;2. 打蛋;3. 切番茄;4. 开火炒制;5. 调味出锅。然后它依次调用“拿取工具”、“切菜工具”、“灶具控制工具”来执行每一步,并在过程中根据“菜是否熟了”、“味道如何”等反馈来调整火候或加盐。

典型应用场景:

  • 旅行规划助手:根据用户预算、时间、偏好,自动查询航班、酒店、景点并生成详细行程。
  • 数据提取与聚合分析:自动从多个网页或文档中抓取指定数据,并进行清洗、汇总与可视化。
  • 智能课程顾问:分析学员水平与目标,推荐学习路径、练习题目并跟踪进度。
  • 自动化运维与排错:监控系统日志,自动诊断常见问题并执行修复脚本。

与纯 Prompt 问答的区别:纯 Prompt 问答是一次性推理输出,而 Agent 具备多步执行与工具调用的能力,能处理更复杂、动态的任务。

Agent 工作流程示意图:感知、规划、执行、观察的循环

3. RAG(检索增强生成)

RAG(检索增强生成)就像给大模型配了一个“外挂知识库”。当模型遇到不知道的问题时,它会先去这个知识库里查找相关资料,然后把查到的信息和自己已有的知识结合起来,给出更准确、更可靠的答案。

通俗比喻:你是一个知识渊博但记性不太好的专家(大模型)。当有人问你一个专业问题时,你允许他先去你的书房(知识库)里翻书查资料,然后把查到的内容告诉你,你再结合自己的理解给出最终回答。这样,你的回答就不会因为“记不清”而出错。

核心应用:个人知识库问答、AI客服助手、企业文档智能查询等需要基于特定、最新或私有信息回答的场景。

4. Fine-tuning(模型微调)

Fine-tuning(模型微调)是指在一个已经预训练好的大模型基础上,使用特定领域或任务的数据集进行额外的训练,使模型能够更好地适应特定任务或领域。你可以把它理解为“给一个通才专家进行专项培训”,让它在某个细分领域变得更专业。

核心原理:

  • 预训练模型作为起点:模型已经通过海量通用数据(如互联网文本)学习了通用的语言规律和世界知识。
  • 特定数据驱动调整:使用规模较小但高度相关的数据集(如医疗问答、法律文书、客服对话)继续训练模型。
  • 参数微调:在训练过程中,调整模型的部分或全部参数,使其输出更符合目标任务的风格、格式和知识要求。

通俗比喻:想象你是一位精通多国语言的翻译(预训练模型)。现在公司需要你专门负责翻译医疗文献。Fine-tuning 的过程就是让你集中阅读大量的医学词典、论文和病例报告(特定领域数据),在这个过程中,你调整了自己对医学术语、句式和逻辑的理解,最终成为了一个更专业的医学翻译。

主要方法:

  • 全参数微调:更新模型的所有参数,效果通常最好,但计算成本和数据需求高。
  • 参数高效微调:如 LoRA、Adapter,只训练模型中的一小部分新增参数,大部分原始参数冻结,在效果和效率间取得平衡。
  • 指令微调:使用指令-回答对数据训练,让模型学会更好地理解和遵循人类指令。

典型应用场景:

  • 领域知识问答:打造一个精通金融、法律或医疗的专业问答助手。
  • 风格化内容生成:让模型学会生成符合公司品牌调性的营销文案或技术文档。
  • 代码生成与补全:针对特定编程语言或框架(如 React、Spring Boot)进行优化,生成更准确、更符合规范的代码。
  • 客服机器人定制:使用历史客服对话数据微调,让机器人更懂自家产品和服务,回答更精准。

与Prompt、Agent、RAG的关系:

  • Fine-tuning 是“改变模型本身”,让模型内化特定知识或技能。
  • Prompt 是“引导模型”,不改变模型参数,依赖其已有能力。
  • Agent 可以利用微调后的模型作为其“大脑”,进行更专业的思考和规划。
  • RAG 可以为微调模型提供最新的外部知识,弥补其训练数据截止性的不足。

优势与挑战:

  • 优势:模型性能在特定任务上显著提升;输出风格和格式更可控;可处理私有或敏感数据。
  • 挑战:需要高质量的标注数据;存在“灾难性遗忘”风险(忘记原有通用知识);训练过程有计算成本。

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐