# AI基础第6章《让大模型长出手脚》10–20秒微课语音逐字稿

适用对象：高校非相关专业学生与应用型本科学生

前置知识：无专业前置，仅需一般数字素养

本章学习结果：
1. 能够按讲义顺序解释本章的核心概念与关系。
2. 能够依据画面机制判断结论成立的条件和边界。
3. 能够完成讲义原测验，并用页面证据说明理由。

预计纯语音时长：约 6～7 分钟

建议课堂时长：约 11～17 分钟，包含停顿、作答与反馈

讲解主线：问题地图 → 分节机制 → 证据与边界 → 总结 → 讲义原测验

使用说明：仅将每页“语音逐字稿”正文送入 TTS；视觉说明、媒体状态、教师反馈与答案不朗读。

---

## P1【让大模型长出手脚】

【所属章节和小节】AI基础 第6章｜章导入

【本页目标】能够说出本章的核心问题和阅读路线。

【预计播报时长】约 20 秒

【语音逐字稿】

这一章围绕“让大模型长出手脚”展开。请先看下方路线卡，建立全章问题地图；后续每一页只处理一个概念、关系或教学动作。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P2【小节一 · 从“回答”到 “完成任务”】

【所属章节和小节】AI基础 第6章｜小节一 · 从“回答”到 “完成任务”

【本页目标】能够解释 Agent 如何通过感知、规划、工具、记忆和反馈持续完成任务。

【预计播报时长】约 40 秒

【语音逐字稿】

这一页回答 AI 怎样从一次回答，升级为能够持续完成任务的 Agent。LLM 更像负责理解与生成的大脑；Agent 在此基础上接入感知、工具和执行通道。它先感知任务，再规划步骤、调用工具、执行动作，并根据反馈继续修正。短期记忆保留当前上下文，长期记忆按需找回过去经验。数字孪生则让 Agent 先在虚拟环境验证策略，再连接真实设备。关键不是多说几句话，而是形成“感知、规划、行动、反馈”的可执行闭环。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】四张编号卡依次呈现：LLM 与 Agent 的差别、四步迭代闭环、短期与长期记忆、在数字孪生中先验证再行动。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P3【本节场景补充】

【核心主题】小节一 · 从“回答”到 “完成任务”的场景补充。

【本页要点】从回答问题转向完成任务，关键是让模型会调用合适的工具。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】agent-tools.webp

## P4【从“回答”到 “完成任务”】

【所属章节和小节】AI基础 第6章｜小节一 · 从“回答”到 “完成…

【本页目标】能够解释“从“回答”到 “完成任务””的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请对照画面左右两侧。本页聚焦“从“回答”到 “完成任务””，图中的“传统 LLM、AI Agent”标出关键证据。LLM 像聪明的大脑；Agent 为它接上眼、耳、手、脚与工具箱。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P5【Agent 的四步闭环】

【所属章节和小节】AI基础 第6章｜小节一 · 从“回答”到 “完成…

【本页目标】能够解释“Agent 的四步闭环”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着闭环逐步追踪。本页聚焦“Agent 的四步闭环”，图中的节点和连线标出关键证据。感知、规划、工具调用、执行不是一次直线，而是带反馈的迭代闭环。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P6【Agent 为什么需要记忆】

【所属章节和小节】AI基础 第6章｜小节一 · 从“回答”到 “完成…

【本页目标】能够解释“Agent 为什么需要记忆”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请对照画面左右两侧。本页聚焦“Agent 为什么需要记忆”，图中的“短期记忆、长期记忆”标出关键证据。上下文让 Agent 记住眼前，向量检索让它按需找回过去。再核对条件。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】短期记忆；长期记忆。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P7【在虚实之间先推演再行动】

【所属章节和小节】AI基础 第6章｜小节一 · 从“回答”到 “完成…

【本页目标】能够解释“在虚实之间先推演再行动”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“在虚实之间先推演再行动”，图中的节点和连线标出关键证据。在数字孪生平台中。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P8【小节二 · ReAct： 想一步，做一步】

【所属章节和小节】AI基础 第6章｜小节二 · ReAct： 想一步，做一步

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

来到“小节二 · ReAct： 想一步，做一步”。请沿着编号核对先后关系，并用每张卡的摘要确认该页承担的机制、证据或边界任务。再用底部结论检查自己的理解。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】小节二 · ReAct： 想一步；ReAct： 想一步，做一步；函数调用是通信协议；心法加招式。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P9【本节场景补充】

【核心主题】小节二 · ReAct： 想一步，做一步的场景补充。

【本页要点】思考、行动、观察反馈构成 ReAct 的逐步闭环。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】react-loop.webp

## P10【ReAct： 想一步，做一步】

【所属章节和小节】AI基础 第6章｜小节二 · ReAct： 想一步

【本页目标】能够解释“ReAct： 想一步，做一步”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着闭环逐步追踪。本页聚焦“ReAct： 想一步，做一步”，图中的节点和连线标出关键证据。ReAct 用“思考—行动—观察”反复校正，让复杂任务不靠一次猜完。同时注意边界。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P11【函数调用是通信协议】

【所属章节和小节】AI基础 第6章｜小节二 · ReAct： 想一步

【本页目标】能够解释“函数调用是通信协议”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着箭头从起点读到结果。本页聚焦“函数调用是通信协议”，图中的节点和连线标出关键证据。Function Calling 让模型以稳定的结构化请求。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P12【心法加招式： ReAct + Function】

【所属章节和小节】AI基础 第6章｜小节二 · ReAct： 想一步

【本页目标】能够解释“心法加招式： ReAct + Function”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“心法加招式： ReAct + Function”，图中的“ReAct、Function…”标出关键证据。ReAct 决定怎么思考。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】ReAct；Function Calling。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P13【小节三 · 任务变复杂时如何分工】

【所属章节和小节】AI基础 第6章｜小节三 · 任务变复杂时如何分工

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

“小节三 · 任务变复杂时如何分工”负责把问题转成一条可检查的解释链。请依次读取标题和摘要，不把多个结论混在同一页。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】小节三 · 任务变复杂时如何分工；任务变复杂时如何分工；多 Agent 有四种队形；大脑与身体之间需要一座桥。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P14【本节场景补充】

【核心主题】小节三 · 任务变复杂时如何分工的场景补充。

【本页要点】复杂任务可拆给不同角色，再把中间结果汇合。

【讲稿】这一页用一张场景图帮助我们把刚才的概念落到可观察的关系上。请先辨认图中的对象和环境，再看它们如何连接或相互作用。接着回到正文，核对这种关系为什么支持本节结论。图片不增加新的判断标准，真正需要记住的概念、条件与边界，仍以本节正文为准。

【对应视觉说明】ChatGPT 生成的本节场景补充图；用于支撑页面主张，不替代正文讲解。

【图片或视频文件名】multi-agent.webp

## P15【任务变复杂时如何分工】

【所属章节和小节】AI基础 第6章｜小节三 · 任务变复杂时 如何分工

【本页目标】能够解释“任务变复杂时如何分工”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请对照画面左右两侧。本页聚焦“任务变复杂时如何分工”，图中的节点和连线标出关键证据。能否清晰拆分任务、是否需要不同专长，以及预算与延迟，共同决定架构选择。再用底部结论检查自己的理解。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P16【多 Agent 有四种队形】

【所属章节和小节】AI基础 第6章｜小节三 · 任务变复杂时 如何分工

【本页目标】能够解释“多 Agent 有四种队形”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“多 Agent 有四种队形”，图中的节点和连线标出关键证据。多 Agent 的重点不在“数量”，而在于让协作拓扑匹配任务依赖关系。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面原有图解。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P17【大脑与身体之间需要一座桥】

【所属章节和小节】AI基础 第6章｜小节三 · 任务变复杂时 如何分工

【本页目标】能够解释“大脑与身体之间需要一座桥”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着箭头从起点读到结果。本页聚焦“大脑与身体之间需要一座桥”，图中的节点和连线标出关键证据。具身智能中。请把节点间的连接作为判断依据。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P18【Agent 进入现实要过四道关】

【所属章节和小节】AI基础 第6章｜小节三 · 任务变复杂时 如何分工

【本页目标】能够解释“Agent 进入现实要过四道关”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“Agent 进入现实要过四道关”，图中的节点和连线标出关键证据。从屏幕走向物理世界，实时、安全、融合与迁移都必须成为系统边界。再用底部结论检查自己的理解。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P19【Agent 如何把想法变行动】

【所属章节和小节】AI基础 第6章｜章总结

【本页目标】能够用一条关系链复述本章核心结论。

【预计播报时长】约 20 秒

【语音逐字稿】

请按屏幕中的纪要卡从左到右回看本章。把每张卡的结论串成一条解释链，再用底部一句话检查自己能否说清机制、条件与边界。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】从“回答”到 “完成任务”；Agent 为什么 需要记忆；函数调用是 通信协议；多 Agent 有 四种队形。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P20【单选题 10 题】

【所属章节和小节】AI基础 第6章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

这是“单选题 10 题”页面。请先独立阅读题干与全部选项，再核对本章的条件后作答；提交后才能查看本页反馈，本段不提前播报答案。同时指出这条关系依赖的条件，以及可能失效的边界。同时注意边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P21【实操：旅行规划 ReAct 工作流】

【所属章节和小节】AI基础 第6章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

本页要求完成“实操：旅行规划 ReAct 工作流”。请按画面顺序操作，保存关键截图或文字证据；答案区域保持收起，结束后再比较差异。请用画面的层级与连接说明结论为什么成立。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P22【实操：代码审查多 Agent 协作】

【所属章节和小节】AI基础 第6章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

阅读“实操：代码审查多 Agent 协作”后，先确认任务边界、交付格式和验证标准，再写出方案；不要提前查看参考内容或评分提示。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图
