# 具身智能基础第13章《把十三章组装成 一条管线》10–20秒微课语音逐字稿

适用对象：高校非相关专业学生与应用型本科学生

前置知识：无专业前置，仅需一般数字素养

本章学习结果：
1. 能够按讲义顺序解释本章的核心概念与关系。
2. 能够依据画面机制判断结论成立的条件和边界。
3. 能够完成讲义原测验，并用页面证据说明理由。

预计纯语音时长：约 6～7 分钟

建议课堂时长：约 11～17 分钟，包含停顿、作答与反馈

讲解主线：问题地图 → 分节机制 → 证据与边界 → 总结 → 讲义原测验

使用说明：仅将每页“语音逐字稿”正文送入 TTS；视觉说明、媒体状态、教师反馈与答案不朗读。

---

## P1【把十三章组装成 一条管线】

【所属章节和小节】具身智能基础 第13章｜章导入

【本页目标】能够说出本章的核心问题和阅读路线。

【预计播报时长】约 20 秒

【语音逐字稿】

这一章围绕“把十三章组装成 一条管线”展开。请先看下方路线卡，建立全章问题地图；后续每一页只处理一个概念、关系或教学动作。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P2【小节一 · 六步成模，每一步都有 交付物】

【所属章节和小节】具身智能基础 第13章｜小节一 · 六步成模，每一步都有 交付物

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

这是“小节一 · 六步成模，每一步都有 交付物”的阅读地图。画面按顺序列出后续问题，并为每一页补上机制摘要；先定位核心问题，再进入证据页面。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】小节一 · 六步成模；六步成模，每一步都有 交付物；质量门槛，不是最后才 检查；项目目标：让机器人 穿过仓库。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P3【本节场景补充】

【核心主题】小节一 · 六步成模，每一步都有 交付物的场景补充。

【本页要点】从建模到验证，每个阶段都要留下可以检查的交付物。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】project-deliverables.webp

## P4【六步成模，每一步都有 交付物】

【所属章节和小节】具身智能基础 第13章｜小节一 · 六步成模

【本页目标】能够解释“六步成模，每一步都有 交付物”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着箭头从起点读到结果。本页聚焦“六步成模，每一步都有 交付物”，图中的“1 数据采集、LeRobot、2 场景搭建”标出关键证据。数据、场景、标注、渲染、训练和部署构成一条不可跳步的证据链。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P5【质量门槛，不是最后才 检查】

【所属章节和小节】具身智能基础 第13章｜小节一 · 六步成模

【本页目标】能够解释“质量门槛，不是最后才 检查”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着箭头从起点读到结果。本页聚焦“质量门槛，不是最后才 检查”，图中的“采集、30fps、标注”标出关键证据。每个阶段都要用可量化门槛验收，避免缺陷沿管线放大到最后。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P6【项目目标：让机器人 穿过仓库】

【所属章节和小节】具身智能基础 第13章｜小节一 · 六步成模

【本页目标】能够解释“项目目标：让机器人 穿过仓库”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“项目目标：让机器人 穿过仓库”，图中的“S、G、周期 2–3 周”标出关键证据。结业项目以仓储导航为载体，要求机器人从任意起点安全到达指定终点。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】S；G；周期 2–3 周 · 平台一站式。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P7【小节二 · 先搭场景，再让两条轨迹 覆盖关键区】

【所属章节和小节】具身智能基础 第13章｜小节二 · 先搭场景，再让两条轨迹 覆盖关键区

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

来到“小节二 · 先搭场景”。请沿着编号核对先后关系，并用每张卡的摘要确认该页承担的机制、证据或边界任务。同时指出这条关系依赖的条件，以及可能失效的边界。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】小节二 · 先搭场景；先搭场景，再让两条轨迹 覆盖关键区；五轮随机化，得到 1360 帧；训练不仅看成功，还看 碰撞与路径。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P8【本节场景补充】

【核心主题】小节二 · 先搭场景，再让两条轨迹 覆盖关键区的场景补充。

【本页要点】场景与轨迹共同覆盖任务中的关键区域和关键动作。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】scene-and-trajectory.webp

## P9【先搭场景，再让两条轨迹 覆盖关键区】

【所属章节和小节】具身智能基础 第13章｜小节二 · 先搭场景

【本页目标】能够解释“先搭场景，再让两条轨迹 覆盖关键区”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请对照画面左右两侧。本页聚焦“先搭场景，再让两条轨迹 覆盖关键区”，图中的“轨迹 A、关键区、轨迹 B”标出关键证据。场景先保证存在无碰撞路径，两条轨迹再覆盖通道交叉口与障碍物附近。同时注意边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P10【五轮随机化，得到 1360 帧】

【所属章节和小节】具身智能基础 第13章｜小节二 · 先搭场景

【本页目标】能够解释“五轮随机化，得到 1360 帧”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请对照画面左右两侧。本页聚焦“五轮随机化，得到 1360 帧”，图中的“TRAJECTO…、200 + 72、巡检 + 环绕”标出关键证据。两条轨迹共 272 帧，经过五轮域随机化扩展为 1360 帧训练数据。再核对条件。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P11【训练不仅看成功，还看 碰撞与路径】

【所属章节和小节】具身智能基础 第13章｜小节二 · 先搭场景

【本页目标】能够解释“训练不仅看成功，还看 碰撞与路径”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“训练不仅看成功，还看 碰撞与路径”，图中的“BC · RES…、80 EPOCHS、BATCH 32”标出关键证据。模型验收必须同时满足到达率、安全性和路径效率，不能只看训练损失。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】BC · RESNET-18；80 EPOCHS；BATCH 32；LR .001 → .0001。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P12【小节三 · 导出只是开始，安全响应 才算部署】

【所属章节和小节】具身智能基础 第13章｜小节三 · 导出只是开始，安全响应 才算部署

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

“小节三 · 导出只是开始，安全响应 才算部署”负责把问题转成一条可检查的解释链。请依次读取标题和摘要，不把多个结论混在同一页。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】小节三 · 导出只是开始；导出只是开始，安全响应 才算部署；答辩讲清问题、方法、结果和 亮点；三条职业路径，各有任务与 成长阶梯。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P13【本节场景补充】

【核心主题】小节三 · 导出只是开始，安全响应 才算部署的场景补充。

【本页要点】导出模型只是开始，部署还要验证安全响应和复盘能力。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】safe-deployment.webp

## P14【导出只是开始，安全响应 才算部署】

【所属章节和小节】具身智能基础 第13章｜小节三 · 导出只是开始

【本页目标】能够解释“导出只是开始，安全响应 才算部署”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着箭头从起点读到结果。本页聚焦“导出只是开始，安全响应 才算部署”，图中的“MODEL、ONNX、OFFLINE …”标出关键证据。模型文件、离线输出一致性和安全层正确触发，三项共同证明部署可用。再用底部结论检查自己的理解。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P15【答辩讲清问题、方法、结果和 亮点】

【所属章节和小节】具身智能基础 第13章｜小节三 · 导出只是开始

【本页目标】能够解释“答辩讲清问题、方法、结果和 亮点”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“答辩讲清问题、方法、结果和 亮点”，图中的“问题、方法、结果”标出关键证据。三分钟答辩要形成“问题—方法—结果—亮点”闭环，并诚实分析失败案例。最后说出关键证据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P16【三条职业路径，各有任务与 成长阶梯】

【所属章节和小节】具身智能基础 第13章｜四、职业发展路径

【本页目标】能够解释“三条职业路径，各有任务与 成长阶梯”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请对照画面左右两侧。本页聚焦“三条职业路径，各有任务与 成长阶梯”，图中的“数据标注师 → …、入门：具身智能数…、核心技能”标出关键证据。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】数据标注师 → 数据工程专家；入门：具身智能数据标注师；核心技能；数据采集 · 标注 · 质量管理。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P17【环境、数据、模型，三条路径 相互成就】

【所属章节和小节】具身智能基础 第13章｜四、职业发展路径

【本页目标】能够解释“环境、数据、模型，三条路径 相互成就”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着闭环逐步追踪。本页聚焦“环境、数据、模型，三条路径 相互成就”，图中的“仿真工程 · 环境、什么样的环境能产…、数据工程 · 数据”标出关键证据。再核对条件。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】仿真工程 · 环境；什么样的环境能产生好数据；数据工程 · 数据；什么样的数据能训练好模型。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P18【十三章连成技能栈，下一步 继续深入】

【所属章节和小节】具身智能基础 第13章｜五、课程总结

【本页目标】能够解释“十三章连成技能栈，下一步 继续深入”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“十三章连成技能栈，下一步 继续深入”，图中的“13 CHAPT…、01 具身智能全…、02 机器人学基础”标出关键证据。十三章贯通数据、场景、渲染、训练和部署，下一步按目标选择一条进阶方向。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】13 CHAPTERS / 章节；01 具身智能全景认知；02 机器人学基础；03 硬件数据采集。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P19【不是训练一个模型，而是 搭好整条管线】

【所属章节和小节】具身智能基础 第13章｜章总结

【本页目标】能够用一条关系链复述本章核心结论。

【预计播报时长】约 20 秒

【语音逐字稿】

请按屏幕中的纪要卡从左到右回看本章。把每张卡的结论串成一条解释链，再用底部一句话检查自己能否说清机制、条件与边界。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】六步成模，每一步都有 交付物；项目目标：让机器人 穿过仓库；五轮随机化，得到 1360 帧；导出只是开始，安全响应 才算部署。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P20【综合项目 · 项目要求】

【所属章节和小节】具身智能基础 第13章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

请在“综合项目 · 项目要求”页面把任务拆成可执行步骤，记录输入、过程和结果；先提交自己的判断，再打开评分要求检查遗漏。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P21【综合项目 · 提交要求】

【所属章节和小节】具身智能基础 第13章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

本页要求完成“综合项目 · 提交要求”。请按画面顺序操作，保存关键截图或文字证据；答案区域保持收起，结束后再比较差异。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P22【综合项目 · 评分标准】

【所属章节和小节】具身智能基础 第13章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

阅读“综合项目 · 评分标准”后，先确认任务边界、交付格式和验证标准，再写出方案；不要提前查看参考内容或评分提示。请把节点间的连接作为判断依据。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图

