大模型基础认知与Prompt提示词工程完整笔记
摘要:本文从零梳理大模型基础原理、技术演进、训练流程、运行机制、行业应用,系统讲解Prompt提示词工程全套实战方法,包含零样本/少样本/RAG/角色设定/格式约束/思维链技巧,最后总结大模型风险体系与合规治理方案,适合AI入门、面试复习、职场实战。
一、大模型基础认知
1.1 生成式人工智能(AIGC)
定义:让人工智能产生结构化、复杂内容的技术,核心是赋予AI自主创作能力。
常见品类:对话类大模型、绘图类大模型、多模态模型、语音大模型等。
实用能力:修改论文、撰写邮件、文案润色、内容创作、问题解答,可作为全能办公助理。
局限性:模型受训练数据限制,存在固有偏见、知识滞后与幻觉问题。
1.2 大模型整体认知与技术演变
(1)大模型优点
能够整合海量数据与知识库,根据用户需求智能提炼、总结、重组内容,高效输出高质量答案。
(2)技术演变脉络
人工智能为顶层总领域,整体呈现嵌套式层级递进发展关系:
人工智能(总领域)→ 两大分支:机器学习ML、深度学习DL → 生成式人工智能(AIGC)
(3)机器学习 ML 三大学习范式
- 监督学习:依托标注数据集训练,用于分类、预测任务。
- 无监督学习:基于无标注原始数据,自主挖掘数据规律。
- 强化学习:模型自主试错、迭代优化,提升决策能力。
(4)深度学习 DL 神经网络架构
深度学习依托神经网络实现,主流三大架构:
- 卷积神经网络 CNNs
- 循环神经网络 RNNs
- Transformer 网络(大模型核心基础架构)
1.3 大模型训练完整流程
预训练 → 监督微调(SFT)→ RLHF(人类反馈强化学习)
核心目标:让模型输出贴合人类价值观与使用偏好,减少幻觉、规避有害及违规内容。
1.4 大模型分类体系
(1)底层技术划分
基于Transformer架构:大语言模型(LLM)、多模态模型。
(2)任务场景划分
多模态模型可处理文本、图像、音频、视频等多格式输入。
模态类型
应用场景
视觉+文本
VQR视觉问答、图像字幕、图文检索、文生图、图生图
音频+文本
语音生成、语音摘要、语音识别、语音转写
音频+视觉
音生图、虚拟人演讲人脸生成
1.5 大模型工作运行原理
用户通过 Prompt(提示词) 与大模型完成交互。
(1)分词与词表映射
分词化:将句子拆分为最小语义单元 Token。
分词粒度:
- 词粒度:适用于英文等西方语言
- 字符粒度:中文最直接分词方式
- 子词粒度:词根、词缀拆分
(2)文本生成过程
采用自回归生成:根据已有Token,概率预测下一个最大概率Token,逐字生成,直到达到长度阈值或终止Token。
1.6 大模型应用场景(通义系列为例) - 通义千问:通用大语言模型
- 通义万相:图像+文本生成模型
- 通义百聆:语音大模型
- 通义灵码:代码辅助开发
- 通义听悟:会议速记、同声传译
- 通义法睿:法律垂直场景
- 通义晓密:智能客服咨询
- 通义星尘:虚拟角色个性化创建
- 通义点金:金融财报、研报分析
二、AI大模型的使用(Prompt提示词工程)
2.1 批量数据处理方案
- 几十份数据:人工整理
- 上百份数据:大模型批量处理
- 上万份数据:调用API自动化批量处理
2.2 提示词优化体系
(1)提示词工程步骤
理解任务需求 → 构建有效提示词 → 评估提示词效果 → 持续迭代优化
(2)核心提示词技巧
① 零样本提问(直接提问)
不提供案例,依靠模型原生能力完成任务。要求:简洁、具体、无歧义、上下文完整。
② 少样本提示(增加示例)
提供少量示例,让模型学习任务规则,适合分类、判别任务。海量专业场景可结合 RAG检索增强生成。
示例选择原则:代表性、多样性、格式统一、可模型自生成。
③ 角色分配设定
给模型设定身份、性格、职业、目标、语言风格、约束规则,实现专业化输出。支持动态调整角色状态。
④ 限定输出风格与格式
风格限定:文体、语气、作者风格、情感基调、句式修辞。
格式限定:字数、段落结构、列表、表格、JSON、学术引用、公文格式。
⑤ 思维链 CoT 复杂任务拆解
引导模型分步推理,避免跳步,大幅降低逻辑错误。
(3)提示词框架分类 - 纯指令型
- 背景+指令型
- 指令/背景+输出指示型
- 综合复合型提示(高精度任务首选)
(4)通用模型与推理模型选用策略
简单、高时效任务使用通用模型;复杂逻辑、多步推理任务使用推理模型;可组合使用实现Agent决策+执行。
三、大模型风险与合规治理
3.1 风险来源
(1)个人信息风险
训练阶段隐私泄露、推理阶段用户隐私采集泄露。
(2)内容安全风险
模型幻觉、虚假内容生成,来源于数据缺陷、模型缺陷、使用不当、环境因素。
(3)模型安全风险
传统软件漏洞 + 生成模型特有攻击(Prompt注入、对抗攻击)。
(4)知识产权风险
训练数据版权、生成内容版权纠纷。
3.2 风险治理方案
(1)个人信息治理
数据分级分类、隐私脱敏、拒绝隐私生成、合规处理。
(2)内容安全保障
应用层风险拦截、内容溯源与声明、模型风险评测、训练阶段安全对齐。
(3)模型安全防控
鲁棒性对抗测试、公平性优化、可解释性溯源。
(4)知识产权保护
数据合规获取、内容溯源、制度革新监管。
四、总结
本文完整覆盖大模型底层原理、训练逻辑、运行机制、行业应用、Prompt工程全套技巧、模型风险与合规体系,是一套可直接用于学习、面试、工作落地的完整版笔记。