大模型核心名词手册(完整版,分层整理,零基础可查)
目录一、基础通用概念二、模型训练全流程名词1. 预训练 Pretrain2. 微调 Fine-tune3. 训练配套名词三、推理 部署工程名词四、提示词 应用生态名词五、模型核心架构名词Transformer 体系六、评测、对齐与安全名词七、开源 主流模型系列名词八、行业衍生名词一、基础通用概念大语言模型 LLMLarge Language Model基于 Transformer 架构、海量文本数据训练能理解、生成人类自然语言的巨型神经网络核心是预测下一个文字。生成式 AIGenerative AIAI 自主创造全新内容文字、图片、音频、视频、代码区别于判别式 AI只做分类、识别。基础大模型Base Model / 基座模型仅用海量互联网文本预训练、未做指令对齐、无对话人设的原始大模型输出不可控、不适合直接聊天。对话大模型Chat Model基座模型经过微调、人类反馈优化适配问答、多轮对话场景如 ChatGPT、文心一言、通义千问。多模态大模型Multimodal LLM同时处理文本、图片、音频、视频、3D 等多种信号输入输出代表GPT-4V、Qwen-VL、Gemini。参数Parameter模型神经网络里可学习的权重数值单位 B十亿参数规模越大理论理解能力越强训练推理成本越高。权重Weights模型训练后保存的数值文件存储所有知识与逻辑是模型的 “记忆本体”。Token词元大模型最小计算单位文字会被切分为 token中文 1 汉字≈1.5~2token1token≈0.75 个汉字。上下文窗口 Context Window模型单次能读取、记忆的总 token 上限包含历史对话 当前提问窗口越大长文档处理能力越强。上下文长度 / 上下文扩容原生窗口较小的模型通过算法扩展可读取文本长度如 8K 扩至 32K、128K。嵌入 Embedding把文字、图片转为低维数字向量用于语义检索、知识库匹配、相似度计算。二、模型训练全流程名词1. 预训练 Pretrain预训练阶段第一阶段训练用全网通用无标注文本学习语法、常识、世界知识搭建基础语言能力。预训练数据书籍、网页、论文、代码等无标签原始语料数据规模、干净度直接决定基座上限。预训练损失标准自回归损失目标最大化文本出现概率。2. 微调 Fine-tune对已预训练基座做小规模数据二次训练分多种类型SFT 有监督微调Supervised Fine-Tuning人工标注高质量问答 / 对话数据教会模型遵循人类指令是对话模型必备步骤。RLHF 基于人类反馈的强化学习三段式优化SFT→奖励模型训练→强化学习 PPO让输出贴合人类偏好、价值观、安全规范。RLAIF AI 反馈强化学习用大模型替代人工打分生成奖励信号降低人工标注成本。LoRA 低秩自适应微调轻量化微调方案冻结主模型权重仅训练极小附加矩阵显存占用极低、适配本地部署。全参数微调 Full FT更新模型全部权重效果上限最高但算力、显存成本巨大。Prefix Tuning / Prompt Tuning冻结主模型仅训练少量前缀参数 / 软提示极轻量化微调方案。3. 训练配套名词算力卡GPU/TPU/NPU显卡 / 专用 AI 芯片负责模型训练、推理计算A100、H100、昇腾 910B 为主流。集群训练多 GPU 多机器分布式并行训练超大模型。语料清洗过滤色情、暴力、重复、低质、版权违规文本提升模型安全性与效果。数据去重剔除重复文本避免模型过拟合、记忆重复内容。分词器 Tokenizer负责把文字转 token、token 转回文字模型配套专属工具。Epoch 训练轮次完整跑完一遍全部训练数据为 1 轮多轮易过拟合。Batch 批次单次送入模型计算的数据条数越大训练速度越快、显存占用越高。学习率 Learning Rate权重更新幅度大模型训练用极小学习率。过拟合 Overfit模型死记训练数据陌生新问题表现大幅下滑。欠拟合 Underfit训练不足基础能力差训练集效果也很差。三、推理 部署工程名词推理 Inference模型训练完成后接收用户输入、生成回答的运行过程即线上服务阶段。推理速度 Tokens/s每秒生成 token 数量衡量接口、本地模型响应快慢。量化 Quantization压缩模型权重精度FP16→INT8/INT4/GGUF大幅降低显存占用、提速轻微损失效果。FP3232 位浮点数原始高精度FP16/BF16半精度主流训练格式INT8/INT4低比特量化本地部署常用GGUF / GGMLllama.cpp 开源轻量化模型存储格式专门适配 CPU 本地离线运行。KV 缓存 KV Cache推理加速核心技术缓存历史对话的注意力矩阵避免重复计算大幅提升长对话速度。流式输出 Stream逐字逐 token 实时返回回答前端打字机效果非流式为完整生成后一次性返回。API 应用程序接口厂商开放模型调用接口输入文本返回生成结果企业开发通用方式。私有化部署模型部署在企业本地服务器 / 私有云数据不出内网满足数据安全合规。本地离线部署电脑 / 单机显卡加载模型无需联网、不调用第三方 API。分布式推理超大模型拆分至多块显卡并行运行单卡无法承载时使用。负载均衡多台推理服务器分摊用户请求防止单机器过载。熔断限流请求量过高时限制访问保障服务稳定不崩溃。四、提示词 应用生态名词Prompt 提示词给大模型的输入指令包含问题、角色、格式、约束直接决定输出质量。System Prompt 系统提示词全局角色设定对话全程生效定义模型身份、规则、输出规范。Few-shot 少样本提示Prompt 中附带 2~5 个示例引导模型模仿固定格式输出。Zero-shot 零样本不给示例仅靠文字指令让模型完成任务。CoT 思维链Chain of Thought提示词引导模型分步推理先拆解逻辑再给答案数学、逻辑题效果显著提升。RAG 检索增强生成Retrieval-Augmented Generation核心落地架构先从私有知识库检索真实资料再把资料塞进 Prompt 给大模型回答解决幻觉、知识过时问题。知识库企业文档、PDF、数据库、本地资料集合向量库存储文本 Embedding 向量的数据库Chroma、Milvus、FAISS文本分块 Chunk长文档切割成小段用于向量检索Agent 智能体具备自主规划、工具调用、多步骤任务执行能力的大模型应用能联网、查数据库、调用代码、操作工具。工具调用 Tool Calling模型自主识别需求调用插件 / 外部接口规划 Planning复杂任务拆分为多步执行记忆 MemoryAgent 长期存储历史任务信息Function Calling 函数调用模型输出结构化 JSON 指令自动调用自定义工具、接口。插件 Plugin给大模型扩展外部能力联网搜索、计算、表格处理。微调数据集专门用于 SFT/RLHF 的标注问答对分通用、行业垂直两类。垂直行业大模型在通用基座基础上用行业专业数据微调适配医疗、法律、工业、金融等细分场景。五、模型核心架构名词Transformer 体系Transformer当前所有大模型统一基础架构2017 谷歌提出依靠自注意力机制实现长文本理解。自注意力 Self-Attention核心机制让文字之间互相计算关联权重理解上下文语义关系。多头注意力 Multi-Head Attention拆分多组注意力并行计算同时捕捉语法、逻辑、指代多种语义关系。编码器 Encoder双向注意力同时看前文后文多用于翻译、分类、嵌入模型BERT。解码器 Decoder单向自回归注意力只能读取上文、逐字生成下文LLM 主流架构GPT、Llama。Encoder-Decoder 架构编解码组合适合翻译、摘要T5、BART。层归一化 Layer Norm稳定训练数值分布解决深层网络梯度消失。前馈网络 FFN每层注意力后的非线性转换模块存储大部分知识。位置编码 Positional Encoding给 token 注入文字顺序信息Transformer 本身无时序感知能力。自回归生成 Autoregressive当前只依据上文预测下一个 token主流 LLM 生成逻辑。六、评测、对齐与安全名词对齐 Alignment通过 SFT、RLHF 让模型输出符合人类价值观、指令、安全规范分为能力对齐、价值对齐。幻觉 Hallucination模型编造不存在事实、虚假数据、文献RAG 是主流抑制方案。基准评测 Benchmark标准化试题集量化模型能力MMLU综合知识、GSM8K数学、HumanEval代码、C-Eval中文综合。困惑度 Perplexity PPL衡量模型文本流畅度数值越低语言逻辑越通顺。有害输出生成暴力、色情、谣言、歧视、违法内容依靠安全对齐、内容审核拦截。越狱 Prompt Jailbreak恶意提示词绕过安全限制诱导模型输出违规内容。可解释性 XAI分析模型注意力权重、激活值看懂模型判断逻辑。鲁棒性 Robustness输入错别字、混乱语句、恶意诱导时模型稳定不跑偏的能力。偏见 Bias训练数据自带性别、地域、职业刻板印象导致输出不公平结论。数据泄露训练语料包含隐私、用户原始数据模型会复述隐私信息。七、开源 主流模型系列名词LlamaMeta 开源基座系列全球最通用商用 / 本地模型Llama2、Llama3Qwen 通义千问阿里开源全系列多模态、长短上下文全覆盖GLM智谱 AI 开源模型GLM3/GLM4支持超长上下文Mistral欧洲轻量化高效模型小参数对标大模型效果GPTOpenAI 闭源系列GPT-3.5、GPT-4、GPT-4V 多模态GeminiGoogle 多模态原生大模型RWKV非 Transformer 架构纯 RNN极低显存占用llama.cpp开源本地推理框架支持 CPU/GPU 量化离线运行八、行业衍生名词AIGCAI 生成内容大模型落地应用统称MLOpsAI 模型全生命周期运维训练、评测、部署、监控迭代算力租赁按需租用 GPU 显卡用于训练 / 本地推理知识库问答基于 RAG 的企业落地场景数字人多模态大模型驱动虚拟形象语音、视频对话代码大模型 Code LLM专门优化代码生成、调试、解释CodeLlama、StarCoderAgent 智能体平台可视化搭建自动化 AI 任务流程模型蒸馏 Distillation用大模型输出训练小型模型小模型低成本复刻大模型能力

相关新闻

Cesium for Unreal 3D地球开发:从插件安装到性能优化的完整指南

Cesium for Unreal 3D地球开发:从插件安装到性能优化的完整指南

1. 项目概述:为什么选择Cesium for Unreal来构建3D地球?如果你刚接触UE4,想做一个带真实地理坐标的3D地球场景,比如做个城市规划的演示、飞行模拟器,或者就是单纯想看看自己家房子在三维地图里长啥样,那你大…

2026/7/21 13:47:35阅读更多 →
OpenClaw技术架构解析:本地化AI助手与模块化设计

OpenClaw技术架构解析:本地化AI助手与模块化设计

1. OpenClaw技术架构解析:从开源助手到个人AI操作系统OpenClaw本质上是一个运行在用户本地的开源AI助手框架,其核心设计理念是将大型语言模型(LLM)与可扩展的技能系统相结合。与云端AI服务不同,OpenClaw采用去中心化架构,所有数据…

2026/7/21 19:54:58阅读更多 →
Jupyter Notebook新手必学23个高效快捷键(前三天掌握核心7个)

Jupyter Notebook新手必学23个高效快捷键(前三天掌握核心7个)

1. 为什么新手必须在前三天就掌握这些快捷键——不是为了炫技,而是为了不被打断思路你刚打开 Jupyter Notebook,新建一个 Python 文件,兴致勃勃地敲下import pandas as pd,想接着写df pd.read_csv(,手却停住了——光标…

2026/7/21 13:47:40阅读更多 →
nest-winston:如何在Nest.js中集成Winston日志系统的完整指南

nest-winston:如何在Nest.js中集成Winston日志系统的完整指南

nest-winston:如何在Nest.js中集成Winston日志系统的完整指南 【免费下载链接】nest-winston A Nest module wrapper form winston logger 项目地址: https://gitcode.com/gh_mirrors/ne/nest-winston nest-winston是一个专为Nest.js框架设计的Winston日志系…

2026/7/21 21:21:25阅读更多 →
2026纽伦堡嵌入式展:开源RTOS与边缘AI技术趋势

2026纽伦堡嵌入式展:开源RTOS与边缘AI技术趋势

1. 2026纽伦堡嵌入式展的行业风向标意义纽伦堡嵌入式展(Embedded World)作为全球规模最大的嵌入式系统专业展会,每年吸引着来自全球的顶尖企业、开发者和研究机构。2026年的展会尤其值得关注,不仅因为参展规模创下历史新高&#x…

2026/7/21 21:21:25阅读更多 →
3个高级技巧:让Swagger Codegen Maven插件成为你的API开发加速器

3个高级技巧:让Swagger Codegen Maven插件成为你的API开发加速器

3个高级技巧:让Swagger Codegen Maven插件成为你的API开发加速器 【免费下载链接】swagger-codegen swagger-codegen contains a template-driven engine to generate documentation, API clients and server stubs in different languages by parsing your OpenAPI…

2026/7/21 21:21:25阅读更多 →
Qt上位机开发:工业自动化中的跨平台实践

Qt上位机开发:工业自动化中的跨平台实践

1. 上位机与Qt协同开发的核心价值在工业自动化领域,上位机系统承担着人机交互、数据采集和流程控制的关键角色。Qt框架凭借其跨平台特性和丰富的GUI组件库,已成为上位机开发的首选工具链之一。这种组合能够实现:工业级稳定性:Qt的…

2026/7/21 21:21:25阅读更多 →
3分钟学会B站视频下载:解锁大会员4K和充电专属内容的完整指南

3分钟学会B站视频下载:解锁大会员4K和充电专属内容的完整指南

3分钟学会B站视频下载:解锁大会员4K和充电专属内容的完整指南 【免费下载链接】bilibili-downloader B站视频下载,支持下载大会员清晰度4K,持续更新中 项目地址: https://gitcode.com/gh_mirrors/bil/bilibili-downloader 你是否曾为B…

2026/7/21 21:21:25阅读更多 →
Jafka安全配置:密码保护与访问控制的最佳实践

Jafka安全配置:密码保护与访问控制的最佳实践

Jafka安全配置:密码保护与访问控制的最佳实践 【免费下载链接】jafka a fast and simple distributed publish-subscribe messaging system (mq) 项目地址: https://gitcode.com/gh_mirrors/ja/jafka Jafka作为一款快速简单的分布式发布订阅消息系统&#xf…

2026/7/21 21:19:24阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/21 0:51:49阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/21 0:51:49阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/21 0:51:49阅读更多 →
Windows+macOS 通用 OpenClaw 部署流程,内置依赖一键启动智能桌面助手

Windows+macOS 通用 OpenClaw 部署流程,内置依赖一键启动智能桌面助手

📌教程适配:OpenClaw v2.7.9 | 兼容 Windows10/11、macOS 双系统 📖前言 当下各类本地 AI 工具层出不穷,多数产品仅能完成文字问答交互,很难直接操控电脑执行实际操作。OpenClaw,业内常称小龙虾 AI&#…

2026/7/21 0:01:46阅读更多 →
Codex 接入后 Bug 反增?复盘从个人演示到团队协作的“流程陷阱”

Codex 接入后 Bug 反增?复盘从个人演示到团队协作的“流程陷阱”

聊《一次Codex项目复盘,问题最后出在流程而不是模型》之前,先说一句实在的:别急着背概念,先看它在真实项目里到底解决什么问题。摘要先把这篇文章的目标说清楚:看完之后,你应该能判断这件事值不值得做&…

2026/7/21 0:01:46阅读更多 →
手把手搓一个五子棋游戏,零代码也能当“游戏开发者”

手把手搓一个五子棋游戏,零代码也能当“游戏开发者”

大家好,还是我。前几期带大家做了心情日记本和可视化大屏,后台有朋友留言:“能不能教点好玩的?我想做游戏,但一行代码都不会。”行,这期就安排。今天的目标:从零做一个五子棋游戏。 带AI对战、三…

2026/7/21 0:03:46阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/20 22:51:39阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/21 18:53:30阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/21 18:53:30阅读更多 →