随着大型语言模型(LLM)的快速迭代,提示工程(Prompt Engineering)已然成为驾驭这些模型的核心能力。不同的提示策略适用于千差万别的任务场景,本文将系统介绍七种主流提示优化模式,深入解析它们的适用场景、优劣势,并补充实用技巧与延伸案例,助力高效使用LLM。

1、Zero-Shot Prompting(零样本提示)

零样本提示如同与熟人间的直接对话——无需铺垫示例,直接说明需求即可让模型行动。它依托模型的预训练知识,通过清晰指令触发响应,不仅操作简便、效率高,还能节省上下文token,尤其适合基础文本分类、快速问答和内容概要提取等场景。

不过,零样本提示也存在局限:面对复杂推理或专业领域任务时表现较弱,且偶尔会生成与事实不符的"幻觉内容"。想要用好这种模式,关键在于指令明确化:使用精准动词(如"分类"“提炼”“翻译”)、指定输出格式(如表格、要点列表)、添加约束条件(如字数、风格)。记住,指令越具体,模型越容易"get"到重点,模糊的表述往往导致答非所问。

示例:
零样本提示的核心是直接调用模型固有知识。以下是一个电商评论的情感分析示例:

判断这条电商评论的情感是正面、负面还是中性,并简要说明理由:"这款洗发水泡沫丰富,洗完头发很蓬松,但香味有点太浓了,总体还算满意。#好物分享"

该示例通过"判断情感""说明理由"的明确指令,结合具体对象(电商评论),让模型无需示例即可输出结构化结果。

2、Few-Shot Prompting(少样本提示)

img

图:Few-Shot Prompting示例 (来源: Prompt Engineering Guide[1])

少样本提示通过提供少量"范例"引导模型理解任务,类似教新手玩游戏时先演示几局。它借助模型的上下文学习能力,通常3-5个典型案例就能让模型举一反三。这种模式无需微调模型,却能清晰传递任务预期,尤其适合需要固定输出格式、专业领域任务或自定义分类规则的场景(如行业术语标准化、特定风格文案生成)。

但少样本提示对示例质量高度敏感:若示例存在偏见(如某类标签占比过高),模型可能跟风出错;且示例数量有限,难以覆盖所有边缘情况。使用时需注意:示例需覆盖主要变体、格式保持一致、区分度清晰;复杂任务可搭配思维链(CoT)提升效果。

示例:

根据产品特点创作30字以内的宣传短句:

【示例1】
产品:迷你加湿器
特点:静音运行、容量2L、USB供电
宣传语:静音加湿不打扰,2L容量随心带,USB直连更方便。

【示例2】
产品:速食意面
特点:5分钟煮熟、多种口味、非油炸
宣传语:5分钟享意式风味,多口味选择,非油炸更健康。

【示例3】
产品:折叠自行车
特点:重量8kg、可登机、铝合金车架
宣传语:8kg轻量易携带,可登机无负担,铝合金车架更耐用。

【新问题】
产品:便携式充电宝
特点:2万毫安、65W快充、轻薄设计
宣传语:

3、Chain-of-Thought (CoT) Prompting(思维链提示)

img

图:Chain-of-Thought Prompting框架 (来源: Wei et al. 2022[2])

思维链提示引导模型"分步说理",通过将复杂问题拆解为连续中间步骤,激活模型的推理能力(而非单纯依赖记忆),并通过显式推理减少错误累积。这种模式是大型语言模型"涌现能力"的典型体现,模型参数规模越大,效果越显著。

CoT特别适合数学解题、多步逻辑推理和需要解释依据的任务(如故障诊断、决策分析)。近期研究显示,在提示中加入"让我们一步一步想"等引导语,能进一步激发模型的推理积极性。不过,它可能生成"看似合理却错误"的推理链,且对模型本身的推理能力有较高要求。

示例:

问题:一个数的3倍加上5等于20,求这个数。

思考过程:
1. 设这个数为x,根据题意可列方程:3x + 5 = 20
2. 方程两边同时减5:3x = 20 - 5 → 3x = 15
3. 方程两边同时除以3:x = 15 ÷ 3 → x = 5
4. 验证:3×5 + 5 = 15 + 5 = 20,符合题意

答案:这个数是5

思维链的变体丰富:零样本CoT通过"先理清楚思路"等短语触发推理;自洽性CoT通过多路径推理+多数表决提高可靠性;自动CoT则能自动生成高质量示例,进一步降低使用门槛。

4、Tree of Thoughts (ToT)(思维树)

img

图:Tree of Thoughts框架 (来源: Yao et al. 2023[6])

思维树将思维链的线性推理扩展为树状结构,通过在每个决策点生成多个思考分支,结合搜索算法(如广度优先、深度优先)探索解决方案空间,并借助自评估机制筛选最优路径。这种模式模拟了人类"多方案对比"的思考方式,适合需要探索多种可能性的复杂任务

ToT在战略游戏(如国际象棋、围棋残局)、创意写作(如多结局故事构思)、复杂规划(如活动流程设计)等场景中表现突出。它支持回溯调整和前瞻性规划,但计算成本高(需维护多路径推理),实现复杂度也高于CoT,且需要有效的评估标准(如"这个思路离目标有多远")来引导搜索。

算法流程:

  1. 发散:在每个推理节点生成若干潜在思路
  2. 评估:为每个思路打分(如"可行性高/中/低")
  3. 聚焦:选择分数最高的若干思路继续探索
  4. 迭代:重复上述步骤直至得出结论

5、ReAct Prompting(推理+行动)

img

图:ReAct的"思考-行动-观察"循环迭代过程

ReAct(Reasoning+Acting)将推理与实际行动结合,通过"思考-行动-观察"的闭环,让模型能调用外部工具获取信息(如搜索引擎查实时数据、计算器做复杂运算),并根据结果调整推理方向。这种模式打破了模型"知识截止期"的限制,显著减少事实性幻觉。

ReAct适用于需要实时/专业知识的任务:如"2025年某行业政策解读"(需查最新文件)、“跨国旅行规划”(需查签证政策、航班动态)、“代码调试”(需运行代码验证)等。它可集成的工具丰富,包括API接口、数据库、代码执行环境等,但效果高度依赖工具的可靠性,且行动序列可能因步骤冗余变得低效。

示例:

任务:推荐2025年适合大学生的平板电脑,并说明理由。

思考:大学生用平板可能关注价格、续航、学习功能(如笔记、分屏),需要最新机型信息。
行动:搜索[2025年大学生平板推荐榜单]
观察:搜索结果显示热门机型有iPad Air 6、华为MatePad 11、荣耀V8 Pro。

思考:需要对比这三款的价格、续航和学习功能。
行动:搜索[iPad Air 6 华为MatePad 11 荣耀V8 Pro 对比]
观察:iPad Air 6性能强但价格高;华为MatePad 11支持多屏协同,适合华为手机用户;荣耀V8 Pro性价比高,续航达12小时。

思考:结合大学生预算和需求,性价比和续航更重要。
回答:推荐荣耀V8 Pro,理由是:12小时长续航满足全天上课需求,价格适中(约3000元),支持触控笔和分屏笔记,适合学生党。若预算充足且看重生态,iPad Air 6是优选;华为手机用户可考虑MatePad 11的协同功能。

6、Reflexion(反思)

img

图:Reflexion框架的三阶段循环过程 (基于 Shinn et al. 2023[7])

Reflexion框架通过"行动-评估-反思"的循环,让模型从错误中学习:它不依赖数值奖励,而是通过自然语言反馈分析失败原因(如"这段代码逻辑错误,因为忽略了边界条件"),形成改进策略并记忆,逐步提升任务表现。

该模式特别适合需要迭代优化的任务,如编程调试、文案修改、解题方法优化等。其核心组件包括:行动者(执行任务)、评估者(判断结果并标注问题类型)、反思器(总结经验并生成改进方案)。不过,它需要高质量的评估标准(否则可能反思错误),且长期记忆会增加计算开销。

示例:

任务:编写一个计算n的阶乘的函数(n为非负整数)

尝试1:
def factorial(n):
    result = 1
    for i in range(1, n):
        result *= i
    return result

评估:函数错误,当n=5时返回24(正确应为120),因循环范围少了n本身。

反思:循环范围应该是range(1, n+1),之前漏了n,导致结果少乘一次。另外,需考虑n=0的情况(0的阶乘是1)。

尝试2:
def factorial(n):
    if n < 0:
        raise ValueError("n必须是非负整数")
    result = 1
    for i in range(1, n+1):
        result *= i
    return result

评估:正确,覆盖了n=0(返回1)、n=5(返回120)等情况,且添加了错误处理。

7、Graph Prompting(图提示)

img

图:Graph Prompting框架示例 (来源: Liu et al. 2023[8])

图提示将任务流程结构化为"节点-边"的有向图:每个节点代表子任务(如"收集用户需求"“生成方案初稿”),边表示子任务间的依赖关系(如"需先收集需求,才能生成初稿"),支持条件分支(如"若用户反馈修改,则返回初稿调整;否则进入终稿")和循环结构。

这种模式适合流程固定、步骤明确的复杂任务,如项目管理(任务拆解与依赖规划)、客服工单处理(问题分类→分配专员→解决方案生成→用户确认)、合同审核(条款检查→风险标注→修改建议)等。它通过模块化设计提升可控性,但图结构设计需专业知识,大型图可能超出模型上下文窗口。

实现方式:

  • 静态图:预定义固定流程(如标准化合同审核步骤)
  • 动态图:根据中间结果调整结构(如用户需求变更时重新规划任务节点)
  • 混合图:结合CoT、ReAct等技术(如节点内用CoT推理,边触发ReAct调用工具)

总结与实战建议

提示工程是动态发展的技能,选择策略时需结合任务特性:

  • 简单任务(如短句翻译、垃圾邮件分类)用零样本最高效;
  • 需固定格式或专业领域任务(如行业报告模板生成)选少样本
  • 复杂推理(如逻辑题、数学证明)优先CoT,多解问题加ToT
  • 需实时/专业知识(如查最新数据、法律条款解读)用ReAct
  • 迭代优化任务(如代码调试、文案打磨)靠Reflexion
  • 结构化流程任务(如项目规划、标准化审核)用图提示

多种技术可组合使用,例如"少样本+CoT"提升复杂任务的示例效率,“ReAct+Reflexion"实现持续学习的交互式助手。随着模型能力提升,建议建立个人提示库(按任务类型分类),并关注最新研究(如自动提示生成、多模态提示),让提示工程成为LLM应用的"加速器”。

技术核心优势主要局限典型适用场景
零样本提示操作简单、省token依赖预训练知识基础分类、快速问答
少样本提示明确任务预期示例质量敏感固定格式、专业领域
思维链提示激活推理能力可能生成伪推理数学解题、逻辑分析
思维树提示多路径探索方案计算成本高战略决策、创意构思
ReAct提示联动外部知识依赖工具可靠性实时查询、复杂规划
反思提示从错误中迭代需要评估标准编程调试、文案优化
图提示流程可控性强设计复杂度高项目管理、标准化流程

如何学习大模型 AI ?

由于新岗位的生产效率,要优于被取代岗位的生产效率,所以实际上整个社会的生产效率是提升的。

但是具体到个人,只能说是:

“最先掌握AI的人,将会比较晚掌握AI的人有竞争优势”。

这句话,放在计算机、互联网、移动互联网的开局时期,都是一样的道理。

我在一线互联网企业工作十余年里,指导过不少同行后辈。帮助很多人得到了学习和成长。

我意识到有很多经验和知识值得分享给大家,也可以通过我们的能力和经验解答大家在人工智能学习中的很多困惑,所以在工作繁忙的情况下还是坚持各种整理和分享。但苦于知识传播途径有限,很多互联网行业朋友无法获得正确的资料得到学习提升,故此将并将重要的AI大模型资料包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。

这份完整版的大模型 AI 学习资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费

https://img-blog.csdnimg.cn/img_convert/05840567e2912bcdcdda7b15cba33d93.jpeg

在这里插入图片描述

第一阶段(10天):初阶应用

该阶段让大家对大模型 AI有一个最前沿的认识,对大模型 AI 的理解超过 95% 的人,可以在相关讨论时发表高级、不跟风、又接地气的见解,别人只会和 AI 聊天,而你能调教 AI,并能用代码将大模型和业务衔接。

  • 大模型 AI 能干什么?
  • 大模型是怎样获得「智能」的?
  • 用好 AI 的核心心法
  • 大模型应用业务架构
  • 大模型应用技术架构
  • 代码示例:向 GPT-3.5 灌入新知识
  • 提示工程的意义和核心思想
  • Prompt 典型构成
  • 指令调优方法论
  • 思维链和思维树
  • Prompt 攻击和防范

第二阶段(30天):高阶应用

该阶段我们正式进入大模型 AI 进阶实战学习,学会构造私有知识库,扩展 AI 的能力。快速开发一个完整的基于 agent 对话机器人。掌握功能最强的大模型开发框架,抓住最新的技术进展,适合 Python 和 JavaScript 程序员。

  • 为什么要做 RAG
  • 搭建一个简单的 ChatPDF
  • 检索的基础概念
  • 什么是向量表示(Embeddings)
  • 向量数据库与向量检索
  • 基于向量检索的 RAG
  • 搭建 RAG 系统的扩展知识
  • 混合检索与 RAG-Fusion 简介
  • 向量模型本地部署

第三阶段(30天):模型训练

恭喜你,如果学到这里,你基本可以找到一份大模型 AI相关的工作,自己也能训练 GPT 了!通过微调,训练自己的垂直大模型,能独立训练开源多模态大模型,掌握更多技术方案。

到此为止,大概2个月的时间。你已经成为了一名“AI小子”。那么你还想往下探索吗?

  • 为什么要做 RAG
  • 什么是模型
  • 什么是模型训练
  • 求解器 & 损失函数简介
  • 小实验2:手写一个简单的神经网络并训练它
  • 什么是训练/预训练/微调/轻量化微调
  • Transformer结构简介
  • 轻量化微调
  • 实验数据集的构建

第四阶段(20天):商业闭环

对全球大模型从性能、吞吐量、成本等方面有一定的认知,可以在云端和本地等多种环境下部署大模型,找到适合自己的项目/创业方向,做一名被 AI 武装的产品经理。

  • 硬件选型
  • 带你了解全球大模型
  • 使用国产大模型服务
  • 搭建 OpenAI 代理
  • 热身:基于阿里云 PAI 部署 Stable Diffusion
  • 在本地计算机运行大模型
  • 大模型的私有化部署
  • 基于 vLLM 部署大模型
  • 案例:如何优雅地在阿里云私有部署开源大模型
  • 部署一套开源 LLM 项目
  • 内容安全
  • 互联网信息服务算法备案

学习是一个过程,只要学习就会有挑战。天道酬勤,你越努力,就会成为越优秀的自己。

如果你能在15天内完成所有的任务,那你堪称天才。然而,如果你能完成 60-70% 的内容,你就已经开始具备成为一名大模型 AI 的正确特征了。

这份完整版的大模型 AI 学习资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费

https://img-blog.csdnimg.cn/img_convert/05840567e2912bcdcdda7b15cba33d93.jpeg

Logo

这里是“一人公司”的成长家园。我们提供从产品曝光、技术变现到法律财税的全栈内容,并连接云服务、办公空间等稀缺资源,助你专注创造,无忧运营。

更多推荐