一文彻底搞懂大模型 - Prompt Engineering（提示工程）

Prompt是用户向模型提供的输入，用于引导模型生成特定类型、主题或格式的文本输出。这种输入可以是一个问题、一个描述、一组关键词或上下文信息，它告诉模型用户希望得到的输出类型和内容。提示工程（Prompt Engineering）涉及到如何设计、优化和管理这些Prompt，以确保AI模型能够准确、高效地执行用户的指令。

程序员鑫港

1238人浏览 · 2024-11-11 11:33:55

程序员鑫港 · 2024-11-11 11:33:55 发布

Prompt Engineering

前排提示，文末有大模型AGI-CSDN独家资料包哦！

Prompt是用户向模型提供的输入，用于引导模型生成特定类型、主题或格式的文本输出。这种输入可以是一个问题、一个描述、一组关键词或上下文信息，它告诉模型用户希望得到的输出类型和内容。

Prompt

提示工程（Prompt Engineering）涉及到如何设计、优化和管理这些Prompt，以确保AI模型能够准确、高效地执行用户的指令。

Prompt Engineering

一、Prompt（提示词）

为什么需要Prompt？大语言模型（LLM）本身已具备极高的性能与复杂性，但还有很大潜力需要挖掘。Prompt如同钥匙一般，能够精确引导模型生成特定需求的输出。

调整Prompt，实际上就是在改变我们与模型交流的语言和方式，这种变化往往能带来出乎意料的输出效果差异。更重要的是，这一过程无需微调模型修改参数，只需在外部灵活调整提示词输入。

Prompt

Prompt的核心要素包括：明确的任务指示、相关上下文、示例参考、用户输入以及具体的输出要求。

指示（Instructions）：想要模型执行的特定任务或指令。
上下文（Context）：包含外部信息或额外的上下文信息，引导语言模型更好地响应。
例子（Examples）：通过给出具体示例来展示期望的输出格式或风格。
输入（Input）：用户输入的内容或问题。
输出（Output）：指定输出的类型或格式。

Prompt:
  
指令：请撰写一段关于“未来科技”的描述。
输入数据：无特定输入数据，直接基于主题创作。
输出指示：生成一段约100字的文本，要求内容富有想象力且积极向上。
  
开始你的创作：

二、In-context Learning上下文学习

什么是In-contxt Learning？In-context learning，即上下文学习，是一种机器学习方法，它利用文本、语音、图像等数据的上下文环境以及数据之间的关系和上下文信息来提高预测和分类的准确性和有效性。

In-context learning的优势在于它不需要对模型进行微调（fine-tuning），从而节省了大量的计算资源和时间。

In-context Learning

在GPT-3中，In-context learning表现为模型能够在给定的任务示例或自然语言指令的上下文中，理解任务要求并生成相应的输出。具体来说，In-context learning可以分为以下几种情况：

Zero-shot Learning：不给GPT任何样例，仅通过自然语言指令来指导模型完成任务。

假设你有一个任务，需要将文本分类为三种情感之一：正面，负面或中性。
    
文本：我认为这次假期还可以。
  
情感倾向标签（选择一个）：正面、负面、中性

One-shot Learning：给GPT一个任务示例，模型根据这个示例来理解任务并生成输出。
Few-shot Learning：给GPT多个任务示例，模型通过这些示例来更好地理解任务并生成输出。

假设你有一个任务，需要将文本分类为三种情感之一：正面，负面或中性。
示例 1: 文本：“我度过了一个非常愉快的周末！” 情感倾向标签：正面
  
示例 2: 文本：“这部电影太令人失望了。” 情感倾向标签：负面
  
示例 3: 文本：“今天的天气和昨天一样。” 情感倾向标签：中性  
现在，请根据你从上述示例中学到的知识，对以下文本进行情感分类：
  
文本：“我认为这次假期还可以。”  
情感倾向标签（选择一个）：正面、负面、中性

In-context Learning

三、Chain-of-Thought（思维链）

什么是Chain-of-Thought？Chain-of-Thought（思维链，简称CoT）是一种改进的提示技术，旨在提升大型语言模型（LLMs）在复杂推理任务上的表现。

Chain-of-Thought要求模型在输出最终答案之前，先展示一系列有逻辑关系的思考步骤或想法，这些步骤相互连接，形成了一个完整的思考过程。

Chain-of-Thought

Chain-of-Thought的概念最早是在2022年由Google发布的论文《Chain-of-Thought Prompting Elicits Reasoning in Large Language Models》中提出的。该论文展示了如何通过思维链提示（chain-of-thought prompting）来引导大型语言模型生成类似人类思维过程的推理链条，从而提升模型在复杂推理任务上的性能。

Chain-of-Thought可以通过两种主要方式实现：Zero-Shot CoT和Few-Shot CoT。

Chain-of-Thought

Zero-Shot CoT：在没有示例的情况下，仅仅在指令中添加一行经典的“Let’s think step by step”，就可以激发大模型的推理能力，生成一个回答问题的思维链。

Zero-Shot CoT

Few-Shot CoT：通过提供几个包含问题、推理过程与答案的示例，让模型学会如何逐步分解问题并进行推理。这种方式需要少量的示例来引导模型，但通常能够获得更好的效果。

读者福利：如果大家对大模型感兴趣，这套大模型学习资料一定对你有用

对于0基础小白入门：

如果你是零基础小白，想快速入门大模型是可以考虑的。

一方面是学习时间相对较短，学习内容更全面更集中。
二方面是可以根据这些资料规划好学习计划和方向。

包括：大模型学习线路汇总、学习阶段，大模型实战案例，大模型学习视频，人工智能、机器学习、大模型书籍PDF。带你从零基础系统性的学好大模型！

😝有需要的小伙伴，可以保存图片到wx扫描二v码免费领取【保证100%免费】🆓

👉AI大模型学习路线汇总👈

大模型学习路线图，整体分为7个大的阶段：（全套教程文末领取哈）

第一阶段： 从大模型系统设计入手，讲解大模型的主要方法；

第二阶段： 在通过大模型提示词工程从Prompts角度入手更好发挥模型的作用；

第三阶段： 大模型平台应用开发借助阿里云PAI平台构建电商领域虚拟试衣系统；

第四阶段： 大模型知识库应用开发以LangChain框架为例，构建物流行业咨询智能问答系统；

第五阶段： 大模型微调开发借助以大健康、新零售、新媒体领域构建适合当前领域大模型；

第六阶段： 以SD多模态大模型为主，搭建了文生图小程序案例；

第七阶段： 以大模型平台应用与开发为主，通过星火大模型，文心大模型等成熟大模型构建大模型行业应用。

👉大模型实战案例👈

光学理论是没用的，要学会跟着一起做，要动手实操，才能将自己的所学运用到实际当中去，这时候可以搞点实战案例来学习。

在这里插入图片描述

👉大模型视频和PDF合集👈

观看零基础学习书籍和视频，看书籍和视频学习是最快捷也是最有效果的方式，跟着视频中老师的思路，从基础到深入，还是很容易入门的。
在这里插入图片描述

👉学会后的收获：👈

• 基于大模型全栈工程实现（前端、后端、产品经理、设计、数据分析等），通过这门课可获得不同能力；

• 能够利用大模型解决相关实际项目需求： 大数据时代，越来越多的企业和机构需要处理海量数据，利用大模型技术可以更好地处理这些数据，提高数据分析和决策的准确性。因此，掌握大模型应用开发技能，可以让程序员更好地应对实际项目需求；

• 基于大模型和企业数据AI应用开发，实现大模型理论、掌握GPU算力、硬件、LangChain开发框架和项目实战技能， 学会Fine-tuning垂直训练大模型（数据准备、数据蒸馏、大模型部署）一站式掌握；

• 能够完成时下热门大模型垂直领域模型训练能力，提高程序员的编码能力： 大模型应用开发需要掌握机器学习算法、深度学习框架等技术，这些技术的掌握可以提高程序员的编码能力和分析能力，让程序员更加熟练地编写高质量的代码。

👉获取方式：

😝有需要的小伙伴，可以保存图片到wx扫描二v码免费领取【保证100%免费】🆓

AI Agent技术社区

Agent 垂直技术社区，欢迎活跃、内容共建。

更多推荐

如何卸载openclaw

OpenClaw（俗称"龙虾"）是一个本地 AI 智能体平台，用于在电脑上部署自主运行的 AI 代理。

AI Agent技术社区

（已解决）安装openclaw龙虾[特殊字符]npm权限问题EACCES

先安装升级完成node和homebrew后。安装就很快了。但是遇到EACCESS问题！！！发现报错了。问题错误：核心问题是sharp解决（90%人遇到的）安装 macOS 编译工具很多人缺少，导致sharp无法编译。运行：xcode-select --install安装完成后重新执行：sharp编译需要 C++ 编译器和 node-gyp，这些都来自 Xcode CLI。