# 具身智能基础第6章《把模型积木拼成世界》10–20秒微课语音逐字稿

适用对象：高校非相关专业学生与应用型本科学生

前置知识：无专业前置，仅需一般数字素养

本章学习结果：
1. 能够按讲义顺序解释本章的核心概念与关系。
2. 能够依据画面机制判断结论成立的条件和边界。
3. 能够完成讲义原测验，并用页面证据说明理由。

预计纯语音时长：约 5～6 分钟

建议课堂时长：约 10～16 分钟，包含停顿、作答与反馈

讲解主线：问题地图 → 分节机制 → 证据与边界 → 总结 → 讲义原测验

使用说明：仅将每页“语音逐字稿”正文送入 TTS；视觉说明、媒体状态、教师反馈与答案不朗读。

---

## P1【把模型积木拼成世界】

【所属章节和小节】具身智能基础 第6章｜章导入

【本页目标】能够说出本章的核心问题和阅读路线。

【预计播报时长】约 20 秒

【语音逐字稿】

这一章围绕“把模型积木拼成世界”展开。请先看下方路线卡，建立全章问题地图；后续每一页只处理一个概念、关系或教学动作。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P2【小节一 · 四步，把资产变成场景】

【所属章节和小节】具身智能基础 第6章｜小节一 · 四步，把资产变成场景

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

这是“小节一 · 四步，把资产变成场景”的阅读地图。画面按顺序列出后续问题，并为每一页补上机制摘要；先定位核心问题，再进入证据页面。同时注意边界。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P3【本节场景补充】

【核心主题】小节一 · 四步，把资产变成场景的场景补充。

【本页要点】从导入到保存，每一步都要检查资产能否正确进入场景。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】asset-to-scene.webp

## P4【四步，把资产变成场景】

【所属章节和小节】具身智能基础 第6章｜小节一 · 四步，把资产变成 场景

【本页目标】能够解释“四步，把资产变成场景”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着箭头从起点读到结果。本页聚焦“四步，把资产变成场景”，图中的“1 导入、准备模型积木、2 布局”标出关键证据。先有资产，再定空间关系；物理检查通过后，才进入光照和保存。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P5【三种来源， 同一入口】

【所属章节和小节】具身智能基础 第6章｜小节一 · 四步，把资产变成 场景

【本页目标】能够解释“三种来源， 同一入口”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“三种来源， 同一入口”，图中的“教学专用资产、电塔 · 绝缘子…、官方 / GSO”标出关键证据。资产来源可以不同，但进入 Stage 后都应保持清晰路径和可追踪引用。最后说出关键证据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P6【位置、角度、大小， 分开控制】

【所属章节和小节】具身智能基础 第6章｜小节一 · 四步，把资产变成 场景

【本页目标】能够解释“位置、角度、大小， 分开控制”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“位置、角度、大小， 分开控制”，图中的“W · TRAN…、沿 X / Y …、E · ROTA…”标出关键证据。平移回答“在哪里”，旋转回答“朝哪里”，缩放回答“有多大”。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P7【小节二 · 好布局，先留出安全空间】

【所属章节和小节】具身智能基础 第6章｜小节二 · 好布局，先留出安全空间

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

来到“小节二 · 好布局，先留出安全空间”。请沿着编号核对先后关系，并用每张卡的摘要确认该页承担的机制、证据或边界任务。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P8【本节场景补充】

【核心主题】小节二 · 好布局，先留出安全空间的场景补充。

【本页要点】布局先为碰撞边界、通道和安全距离留出空间。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】safety-space.webp

## P9【好布局，先留出安全空间】

【所属章节和小节】具身智能基础 第6章｜小节二 · 好布局

【本页目标】能够解释“好布局，先留出安全空间”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“好布局，先留出安全空间”，图中的“ROBOT、CAMERA F…、地面先对齐”标出关键证据。布局不是装饰：地面、操作余量、相机视野和任务物体共同定义可执行空间。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P10【看见的形状，不等于碰撞形状】

【所属章节和小节】具身智能基础 第6章｜小节二 · 好布局

【本页目标】能够解释“看见的形状，不等于碰撞形状”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“看见的形状，不等于碰撞形状”，图中的“RENDER M…、COLLISION、THOUSAND…”标出关键证据。碰撞几何要足够贴合，也要足够简单；方块物体优先使用 Box。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P11【静态、动态、运动学， 别设反】

【所属章节和小节】具身智能基础 第6章｜小节二 · 好布局

【本页目标】能够解释“静态、动态、运动学， 别设反”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“静态、动态、运动学， 别设反”，图中的“STATIC、地面 · 墙壁、固定不动”标出关键证据。地面与墙壁设静态，待操作物体设动态，预设运动对象才使用运动学。最后说出关键证据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P12【小节三 · 复杂场景， 分层管理】

【所属章节和小节】具身智能基础 第6章｜小节三 · 复杂场景， 分层管理

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

“小节三 · 复杂场景， 分层管理”负责把问题转成一条可检查的解释链。请依次读取标题和摘要，不把多个结论混在同一页。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P13【本节场景补充】

【核心主题】小节三 · 复杂场景， 分层管理的场景补充。

【本页要点】复杂场景需要按对象、区域和任务层级组织，便于维护。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】scene-hierarchy.webp

## P14【复杂场景， 分层管理】

【所属章节和小节】具身智能基础 第6章｜小节三 · 复杂场景， 分层管理

【本页目标】能够解释“复杂场景， 分层管理”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请按画面的层级由外向内。本页聚焦“复杂场景， 分层管理”，图中的“warehous…、env_layer、地面 · 墙 ·…”标出关键证据。Sublayer 让环境、机器人、物体与光照独立编辑。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P15【分拣场景，先画任务蓝图】

【所属章节和小节】具身智能基础 第6章｜小节三 · 复杂场景， 分层管理

【本页目标】能够解释“分拣场景，先画任务蓝图”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“分拣场景，先画任务蓝图”，图中的“ROBOT、REACH × …、CAMERA”标出关键证据。机械臂、箱子、目标区和相机必须围绕同一个分拣任务建立空间关系。再核对条件。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P16【先跑物理，再保存场景】

【所属章节和小节】具身智能基础 第6章｜小节三 · 复杂场景， 分层管理

【本页目标】能够解释“先跑物理，再保存场景”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着闭环逐步追踪。本页聚焦“先跑物理，再保存场景”，图中的“PLAY、物理预览、发现问题”标出关键证据。物体穿透通常先查碰撞几何和刚体类型，不要用光照或相机参数解释物理错误。最后说出关键证据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P17【场景搭建，是一条验证链】

【所属章节和小节】具身智能基础 第6章｜章总结

【本页目标】能够用一条关系链复述本章核心结论。

【预计播报时长】约 20 秒

【语音逐字稿】

请按屏幕中的纪要卡从左到右回看本章。把每张卡的结论串成一条解释链，再用底部一句话检查自己能否说清机制、条件与边界。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P18【单选题 · 8题】

【所属章节和小节】具身智能基础 第6章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

这是“单选题 · 8题”页面。请先独立阅读题干与全部选项，再核对本章的证据后作答；提交后才能查看本页反馈，本段不提前播报答案。同时指出这条关系依赖的条件，以及可能失效的边界。同时注意边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P19【实操一 · 仓储分拣】

【所属章节和小节】具身智能基础 第6章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

面对“实操一 · 仓储分拣”，请先列出操作步骤和需要提交的证据，再独立作答；参考内容暂不展开，完成后才用于复核。再用底部结论检查自己的理解。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P20【实操二 · Sublayer】

【所属章节和小节】具身智能基础 第6章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

请在“实操二 · Sublayer”页面把任务拆成可执行步骤，记录输入、过程和结果；先提交自己的判断，再打开评分要求检查遗漏。再用底部结论检查自己的理解。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图

