# 具身智能基础第5章《3D 世界的 HTML》10–20秒微课语音逐字稿

适用对象：高校非相关专业学生与应用型本科学生

前置知识：无专业前置，仅需一般数字素养

本章学习结果：
1. 能够按讲义顺序解释本章的核心概念与关系。
2. 能够依据画面机制判断结论成立的条件和边界。
3. 能够完成讲义原测验，并用页面证据说明理由。

预计纯语音时长：约 5～6 分钟

建议课堂时长：约 10～16 分钟，包含停顿、作答与反馈

讲解主线：问题地图 → 分节机制 → 证据与边界 → 总结 → 讲义原测验

使用说明：仅将每页“语音逐字稿”正文送入 TTS；视觉说明、媒体状态、教师反馈与答案不朗读。

---

## P1【3D 世界的 HTML】

【所属章节和小节】具身智能基础 第5章｜章导入

【本页目标】能够说出本章的核心问题和阅读路线。

【预计播报时长】约 20 秒

【语音逐字稿】

这一章围绕“3D 世界的 HTML”展开。请先看下方路线卡，建立全章问题地图；后续每一页只处理一个概念、关系或教学动作。再用底部结论检查自己的理解。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P2【小节一 · 资产交换，为什么总出错】

【所属章节和小节】具身智能基础 第5章｜小节一 · 资产交换，为什么总出错

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

这是“小节一 · 资产交换，为什么总出错”的阅读地图。画面按顺序列出后续问题，并为每一页补上机制摘要；先定位核心问题，再进入证据页面。再核对条件。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P3【本节场景补充】

【核心主题】小节一 · 资产交换，为什么总出错的场景补充。

【本页要点】资产进入场景前，要核对格式、尺度和坐标等交换条件。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】asset-exchange.webp

## P4【资产交换，为什么总出错】

【所属章节和小节】具身智能基础 第5章｜小节一 · 资产交换

【本页目标】能够解释“资产交换，为什么总出错”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“资产交换，为什么总出错”，图中的“软件孤岛 A、软件孤岛 B、Blender …”标出关键证据。USD 诞生于格式孤岛问题：资产传递时，结构与修改意图也必须被保留。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P5【动画格式，为什么适合机器人】

【所属章节和小节】具身智能基础 第5章｜小节一 · 资产交换

【本页目标】能够解释“动画格式，为什么适合机器人”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“动画格式，为什么适合机器人”，图中的“ROBOT、SIMULATI…、层级组织”标出关键证据。机器人场景既复杂又持续变化，USD 的价值在于保存结构与组合关系。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P6【四个概念， 一座舞台】

【所属章节和小节】具身智能基础 第5章｜小节一 · 资产交换

【本页目标】能够区分 Stage、Prim、Layer 与 Composition，并说明 Property 属于 Prim。

【预计播报时长】约 40 秒

【语音逐字稿】

先看中心的 Stage，它是完整三维场景的顶层容器。左上 Prim 是场景中的基本对象，例如机器人、桌子、灯光和相机；Prim 还带有位置、质量、颜色等 Property。右上 Layer 保存基础内容或修改意见，让改动可以独立叠加。左下 Composition 再通过引用、变体和覆写，把多个来源组合成当前结果。把关系串起来就是：Stage 由 Prim 构成，Prim 带有属性，多个 Layer 通过 Composition 形成最终场景。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P7【小节二 · 每个东西，都在树上】

【所属章节和小节】具身智能基础 第5章｜小节二 · 每个东西，都在树上

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

来到“小节二 · 每个东西，都在树上”。请沿着编号核对先后关系，并用每张卡的摘要确认该页承担的机制、证据或边界任务。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P8【本节场景补充】

【核心主题】小节二 · 每个东西，都在树上的场景补充。

【本页要点】层级树让每个对象的归属、变换与关系可追踪。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】scene-tree.webp

## P9【每个东西，都在树上】

【所属章节和小节】具身智能基础 第5章｜小节二 · 每个东西，都在 树上

【本页目标】能够解释“每个东西，都在树上”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请按画面的层级由外向内。本页聚焦“每个东西，都在树上”，图中的“/World、Table、Camera”标出关键证据。Prim 路径记录对象在层级树中的位置，父子关系也表达部件归属。再核对条件。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P10【修改可以叠加， 原件不动】

【所属章节和小节】具身智能基础 第5章｜小节二 · 每个东西，都在 树上

【本页目标】能够解释“修改可以叠加， 原件不动”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请按画面的层级由外向内。本页聚焦“修改可以叠加， 原件不动”，图中的“BASE LAY…、仓储场景原资产、OVERRIDE”标出关键证据。Layer 把修改记录成独立意见，组合时生效，却不直接破坏基础资产。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P11【场景不是复制， 而是组合】

【所属章节和小节】具身智能基础 第5章｜小节二 · 每个东西，都在 树上

【本页目标】能够解释“场景不是复制， 而是组合”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着箭头从起点读到结果。本页聚焦“场景不是复制， 而是组合”，图中的“REFERENCE、引用机器人资产、VARIANT”标出关键证据。Reference 复用资产。再用底部结论检查自己的理解。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P12【小节三 · 同一种场景， 三种封装】

【所属章节和小节】具身智能基础 第5章｜小节三 · 同一种场景， 三种封装

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

“小节三 · 同一种场景， 三种封装”负责把问题转成一条可检查的解释链。请依次读取标题和摘要，不把多个结论混在同一页。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P13【本节场景补充】

【核心主题】小节三 · 同一种场景， 三种封装的场景补充。

【本页要点】同一场景可按不同封装方式复用，但需要保留对象关系。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】scene-packaging.webp

## P14【同一种场景， 三种封装】

【所属章节和小节】具身智能基础 第5章｜小节三 · 同一种场景， 三种封装

【本页目标】能够解释“同一种场景， 三种封装”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“同一种场景， 三种封装”，图中的“.USDA、ASCII 文本、可读 · 适合调试”标出关键证据。USDA 便于阅读调试。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P15【导入模型，先看三块区域】

【所属章节和小节】具身智能基础 第5章｜小节三 · 同一种场景， 三种封装

【本页目标】能够解释“导入模型，先看三块区域”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“导入模型，先看三块区域”，图中的“资产库、官方资产、GSO 物体”标出关键证据。资产库负责“从哪里来”。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P16【选中 Prim， 读懂属性】

【所属章节和小节】具身智能基础 第5章｜小节三 · 同一种场景， 三种封装

【本页目标】能够解释“选中 Prim， 读懂属性”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“选中 Prim， 读懂属性”，图中的“导入、USD、展开树”标出关键证据。位置、质量与碰撞决定仿真行为；显示颜色只改变视觉外观。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P17【从文件格式到场景语言】

【所属章节和小节】具身智能基础 第5章｜章总结

【本页目标】能够用一条关系链复述本章核心结论。

【预计播报时长】约 20 秒

【语音逐字稿】

请按屏幕中的纪要卡从左到右回看本章。把每张卡的结论串成一条解释链，再用底部一句话检查自己能否说清机制、条件与边界。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P18【单选题 · 10题】

【所属章节和小节】具身智能基础 第5章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

这是“单选题 · 10题”页面。请先独立阅读题干与全部选项，再核对本章的证据后作答；提交后才能查看本页反馈，本段不提前播报答案。同时指出这条关系依赖的条件，以及可能失效的边界。同时注意边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P19【实操一 · 导入与浏览】

【所属章节和小节】具身智能基础 第5章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

面对“实操一 · 导入与浏览”，请先列出操作步骤和需要提交的证据，再独立作答；参考内容暂不展开，完成后才用于复核。请把节点间的连接作为判断依据。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P20【实操二 · 组合机制】

【所属章节和小节】具身智能基础 第5章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

请在“实操二 · 组合机制”页面把任务拆成可执行步骤，记录输入、过程和结果；先提交自己的判断，再打开评分要求检查遗漏。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图
