# AI基础第2章《大模型基础》10–20秒微课语音逐字稿

适用对象：高校非相关专业学生与应用型本科学生

前置知识：无专业前置，仅需一般数字素养

本章学习结果：
1. 能够按讲义顺序解释本章的核心概念与关系。
2. 能够依据画面机制判断结论成立的条件和边界。
3. 能够完成讲义原测验，并用页面证据说明理由。

预计纯语音时长：约 6～7 分钟

建议课堂时长：约 11～17 分钟，包含停顿、作答与反馈

讲解主线：问题地图 → 分节机制 → 证据与边界 → 总结 → 讲义原测验

使用说明：仅将每页“语音逐字稿”正文送入 TTS；视觉说明、媒体状态、教师反馈与答案不朗读。

---

## P1【大模型基础】

【所属章节和小节】AI基础 第2章｜章导入

【本页目标】能够说出本章的核心问题和阅读路线。

【预计播报时长】约 20 秒

【语音逐字稿】

这一章围绕“大模型基础”展开。请先看下方路线卡，建立全章问题地图；后续每一页只处理一个概念、关系或教学动作。请把节点间的连接作为判断依据。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P2【小节一 · LLM 本质： 词语接龙机器】

【所属章节和小节】AI基础 第2章｜小节一 · LLM 本质： 词语接龙机器

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

这是“小节一 · LLM 本质： 词语接龙机器”的阅读地图。画面按顺序列出后续问题，并为每一页补上机制摘要；先定位核心问题，再进入证据页面。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】小节一 · LLM 本质；LLM 本质： 词语接龙机器；Token 是语言原子；上下文窗口： 短期记忆。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P3【本节场景补充】

【核心主题】小节一 · LLM 本质： 词语接龙机器的场景补充。

【本页要点】模型根据已有上下文，从候选中继续选择下一个合理片段。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】next-token.webp

## P4【LLM 本质： 词语接龙机器】

【所属章节和小节】AI基础 第2章｜小节一 · LLM 本质

【本页目标】能够解释“LLM 本质： 词语接龙机器”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“LLM 本质： 词语接龙机器”，图中的“你输入：今天天气真、好、85%”标出关键证据。大模型不是查答案，而是在给定上文后预测最合理的下一个 Token。再用底部结论检查自己的理解。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P5【Token 是语言原子】

【所属章节和小节】AI基础 第2章｜小节一 · LLM 本质

【本页目标】能够解释“Token 是语言原子”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“Token 是语言原子”，图中的“人工智能改变世界、人工、智能”标出关键证据。Token 不是字也不是词，而是模型内部切分出的最小处理单位。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P6【上下文窗口： 短期记忆】

【所属章节和小节】AI基础 第2章｜小节一 · LLM 本质

【本页目标】能够解释“上下文窗口： 短期记忆”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请按画面的层级由外向内。本页聚焦“上下文窗口： 短期记忆”，图中的“旧内容、模型能看到的窗口、新输入”标出关键证据。上下文窗口是一次请求中模型能“看到”的最大 Token 数量。再用底部结论检查自己的理解。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】旧内容；模型能看到的窗口；新输入；窗口越大，长文档与多轮对话越稳。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P7【小节二 · 国产大模型： 各有看家本领】

【所属章节和小节】AI基础 第2章｜小节二 · 国产大模型： 各有看家本领

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

来到“小节二 · 国产大模型： 各有看家本领”。请沿着编号核对先后关系，并用每张卡的摘要确认该页承担的机制、证据或边界任务。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】小节二 · 国产大模型；国产大模型： 各有看家本领；预训练： 博览群书；监督微调： 学会答题。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P8【国产大模型： 各有看家本领】

【所属章节和小节】AI基础 第2章｜小节二 · 国产大模型

【本页目标】能够解释“国产大模型： 各有看家本领”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“国产大模型： 各有看家本领”，图中的“开放与成本、任务长度、场景适配”标出关键证据。DeepSeek 突出开源与性价比。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P9【预训练： 博览群书】

【所属章节和小节】AI基础 第2章｜小节二 · 国产大模型

【本页目标】能够解释“预训练： 博览群书”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着箭头从起点读到结果。本页聚焦“预训练： 博览群书”，图中的“TB 级公开文本、网页、书籍”标出关键证据。预训练用 TB 级公开文本，让模型学语言规律和世界知识。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P10【监督微调： 学会答题】

【所属章节和小节】AI基础 第2章｜小节二 · 国产大模型

【本页目标】能够解释“监督微调： 学会答题”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着闭环逐步追踪。本页聚焦“监督微调： 学会答题”，图中的“用户：请解释人工…、标准问答对、助手：AI 是让…”标出关键证据。SFT 给模型看标准问答，告诉它“像这样回答”。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】用户：请解释人工智能。；标准问答对；助手：AI 是让计算机完成；通常需要人类智力的任务。。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P11【RLHF： 价值观对齐】

【所属章节和小节】AI基础 第2章｜小节二 · 国产大模型

【本页目标】能够解释“RLHF： 价值观对齐”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着箭头从起点读到结果。本页聚焦“RLHF： 价值观对齐”，图中的“多个回答、A / B / C、人类排序”标出关键证据。RLHF 让人类当裁判，把模型从“会答”推向“答得更好”。再核对条件。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】多个回答；A / B / C；人类排序；哪个更好。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P12【小节三 · 三阶段训练： 顺序不能颠倒】

【所属章节和小节】AI基础 第2章｜小节三 · 三阶段训练： 顺序不能颠倒

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

这一节按讲义给出的典型训练路径阅读：先用预训练获得基础知识，再通过微调对齐具体任务，最后利用反馈阶段继续改善行为。在本章这条教学链中，后一步依赖前一步提供的表示与任务基础，因此不要跳过阶段。随后再比较云端与本地部署，最后看混合部署怎样兼顾效率与安全。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】小节三 · 三阶段训练；三阶段训练： 顺序不能颠倒；云端 vs 本地： 效率与安全；教学团队策略： 混合部署。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P13【本节场景补充】

【核心主题】小节三 · 三阶段训练： 顺序不能颠倒的场景补充。

【本页要点】先学习通用规律，再做任务微调与偏好对齐，顺序不能颠倒。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】training-stages.webp

## P14【三阶段训练： 顺序不能颠倒】

【所属章节和小节】AI基础 第2章｜小节三 · 三阶段训练

【本页目标】能够解释“三阶段训练： 顺序不能颠倒”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“三阶段训练的先后关系”，图中的“预训练、给知识、SFT”标出关键证据。现代大模型通常按“预训练 → SFT → RLHF”递进训练。再核对条件。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P15【云端 vs 本地： 效率与安全】

【所属章节和小节】AI基础 第2章｜小节三 · 三阶段训练

【本页目标】能够解释“云端 vs 本地： 效率与安全”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请对照画面左右两侧。本页聚焦“云端 vs 本地： 效率与安全”，图中的“云端部署、打开网页就能用、算力强，体验快”标出关键证据。日常学习用云端更方便，涉密数据和企业内网更适合本地部署。同时注意边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P16【教学团队策略： 混合部署】

【所属章节和小节】AI基础 第2章｜小节三 · 三阶段训练

【本页目标】能够解释“教学团队策略： 混合部署”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“教学团队策略： 混合部署”，图中的“云端 VLM、日常标注自动预标注、本地服务器”标出关键证据。工业应用常用“云端 + 本地”混合方案，在效率和安全之间取平衡。请复核。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】云端 VLM；日常标注自动预标注；本地服务器；涉密客户数据处理。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P17【本章总结： 模型心脏】

【所属章节和小节】AI基础 第2章｜章总结

【本页目标】能够用一条关系链复述本章核心结论。

【预计播报时长】约 20 秒

【语音逐字稿】

请按屏幕中的纪要卡从左到右回看本章。把每张卡的结论串成一条解释链，再用底部一句话检查自己能否说清机制、条件与边界。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】LLM 本质： 词语接龙机器；上下文窗口： 短期记忆；预训练： 博览群书；三阶段训练： 顺序不能颠倒。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P18【讲义实操：注册并体验 DeepSeek / Kimi】

【所属章节和小节】AI基础 第2章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

面对“讲义实操：注册并体验 DeepSeek / Kimi”，请先列出操作步骤和需要提交的证据，再独立作答；参考内容暂不展开，完成后才用于复核。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P19【讲义实操：对比两个 Prompt】

【所属章节和小节】AI基础 第2章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

请在“讲义实操：对比两个 Prompt”页面把任务拆成可执行步骤，记录输入、过程和结果；先提交自己的判断，再打开评分要求检查遗漏。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P20【单选题 · 10题】

【所属章节和小节】AI基础 第2章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

这是“单选题 · 10题”页面。请先独立阅读题干与全部选项，再核对本章的边界后作答；提交后才能查看本页反馈，本段不提前播报答案。同时指出这条关系依赖的条件，以及可能失效的边界。同时注意边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P21【SOURCE SHORT ANSWER // 简答题 3题】

【所属章节和小节】AI基础 第2章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

阅读“SOURCE SHORT ANSWER // 简答题 3题”后，先确认任务边界、交付格式和验证标准，再写出方案；不要提前查看参考内容或评分提示。再核对条件。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图
