# 具身智能基础第8章《给 AI 一双 好眼睛》10–20秒微课语音逐字稿

适用对象：高校非相关专业学生与应用型本科学生

前置知识：无专业前置，仅需一般数字素养

本章学习结果：
1. 能够按讲义顺序解释本章的核心概念与关系。
2. 能够依据画面机制判断结论成立的条件和边界。
3. 能够完成讲义原测验，并用页面证据说明理由。

预计纯语音时长：约 5～6 分钟

建议课堂时长：约 10～16 分钟，包含停顿、作答与反馈

讲解主线：问题地图 → 分节机制 → 证据与边界 → 总结 → 讲义原测验

使用说明：仅将每页“语音逐字稿”正文送入 TTS；视觉说明、媒体状态、教师反馈与答案不朗读。

---

## P1【给 AI 一双 好眼睛】

【所属章节和小节】具身智能基础 第8章｜章导入

【本页目标】能够说出本章的核心问题和阅读路线。

【预计播报时长】约 20 秒

【语音逐字稿】

这一章围绕“给 AI 一双 好眼睛”展开。请先看下方路线卡，建立全章问题地图；后续每一页只处理一个概念、关系或教学动作。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P2【小节一 · 五个参数】

【所属章节和小节】具身智能基础 第8章｜小节一 · 五个参数

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

这是“小节一 · 五个参数”的议程页。左侧按顺序列出本节问题，右侧教学场景给出观察入口；先识别相机位置与轨迹，再进入后续机制页面。同时注意边界。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】五个参数，决定 看见什么；看得更宽，也可能 变得更歪；RGB 说是什么，深度说 有多远。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】assets/chapter-scene.png


## P3【五个参数，决定 看见什么】

【所属章节和小节】具身智能基础 第8章｜小节一 · 五个参数

【本页目标】能够解释“五个参数，决定 看见什么”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“五个参数，决定 看见什么”，图中的“分辨率 1280…、FOV · 视场角、位置 · 高度 …”标出关键证据。相机参数不是画面美化选项，而是训练数据采样条件。再用底部结论检查自己的理解。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】分辨率 1280×720；FOV · 视场角；位置 · 高度 · 距离；Yaw / Pitch / Roll。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】待补视频 video-1（无伪造文件）+ HTML内联SVG


## P4【看得更宽，也可能 变得更歪】

【所属章节和小节】具身智能基础 第8章｜小节一 · 五个参数

【本页目标】能够解释“看得更宽，也可能 变得更歪”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“看得更宽，也可能 变得更歪”，图中的“45°、范围窄 · 畸变小、推荐 70°–9…”标出关键证据。导航常用 70°–90°，既覆盖前方范围，又控制超广角边缘畸变。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】45°；范围窄 · 畸变小；推荐 70°–90°；导航视野与形变平衡。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P5【RGB 说是什么，深度说 有多远】

【所属章节和小节】具身智能基础 第8章｜小节一 · 五个参数

【本页目标】能够解释“RGB 说是什么，深度说 有多远”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“RGB 说是什么，深度说 有多远”，图中的“RGB / 外观、DEPTH / …、类别 · 颜色 …”标出关键证据。深度图为每个像素记录距离，是导航避障与三维理解的关键输入。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】RGB / 外观；DEPTH / 距离；类别 · 颜色 · 纹理；PIXEL → DISTANCE。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P6【小节二 · 好轨迹】

【所属章节和小节】具身智能基础 第8章｜小节二 · 好轨迹

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

来到“小节二 · 好轨迹”。请先核对左侧议程中的先后关系，再用右侧概念图确认每一页承担的证据任务。同时指出这条关系依赖的条件，以及可能失效的边界。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】好轨迹，要满足 三个条件；环绕：目标始终在 画面中心；俯视扫描：像 扫地机器人。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】assets/chapter-concept-map.svg


## P7【好轨迹，要满足 三个条件】

【所属章节和小节】具身智能基础 第8章｜小节二 · 好轨迹

【本页目标】能够解释“好轨迹，要满足 三个条件”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“好轨迹，要满足 三个条件”，图中的“CAMERA、TRAJECTO…、全覆盖”标出关键证据。轨迹既要覆盖任务区域，又要提供多视角，并符合真实相机运动规律。再用底部结论检查自己的理解。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】CAMERA；TRAJECTORY；全覆盖；任务区域没有死角。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P8【环绕：目标始终在 画面中心】

【所属章节和小节】具身智能基础 第8章｜小节二 · 好轨迹

【本页目标】能够解释“环绕：目标始终在 画面中心”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“环绕：目标始终在 画面中心”，图中的“TARGET、半径 · 高度、角度范围”标出关键证据。环绕轨迹适合从多个方向认识同一目标，关键是持续锁定目标并避免遮挡。再核对条件。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】TARGET；半径 · 高度；角度范围 · 拍摄点；VIDEO NEED 02。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】待补视频 video-2（无伪造文件）+ HTML内联SVG


## P9【俯视扫描：像 扫地机器人】

【所属章节和小节】具身智能基础 第8章｜小节二 · 好轨迹

【本页目标】能够解释“俯视扫描：像 扫地机器人”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“俯视扫描：像 扫地机器人”，图中的“FIXED HE…、GLOBAL C…”标出关键证据。俯视扫描用蛇形路径覆盖整个区域，适合全局理解和仓储盘点。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】FIXED HEIGHT；GLOBAL COVERAGE。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P10【小节三 · 线性：模拟机器人 向…】

【所属章节和小节】具身智能基础 第8章｜小节三 · 线性：模拟机器人 向…

【本页目标】能够指出本小节的核心问题和阅读顺序。

【预计播报时长】约 20 秒

【语音逐字稿】

“小节三 · 线性：模拟机器人 向…”负责把前面的认识转成判断。画面将问题排成路线，请依次读取，不把多个结论混在同一页。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】线性：模拟机器人 向前走；多点巡检：每一站都要 看清目标；先预览，再保存 .traj。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】assets/chapter-concept-map.svg


## P11【线性：模拟机器人 向前走】

【所属章节和小节】具身智能基础 第8章｜小节三 · 线性：模拟机器人 向…

【本页目标】能够解释“线性：模拟机器人 向前走”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“线性：模拟机器人 向前走”，图中的“LINEAR、起点 · 终点 …、适用”标出关键证据。线性轨迹适合导航数据，但仍要检查前进方向上的遮挡与近地视野。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】LINEAR；起点 · 终点 · 匀速；适用；导航 · 走廊 · 道路。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P12【多点巡检：每一站都要 看清目标】

【所属章节和小节】具身智能基础 第8章｜小节三 · 线性：模拟机器人 向…

【本页目标】能够解释“多点巡检：每一站都要 看清目标”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请先看画面中心，再看周围节点。本页聚焦“多点巡检：每一站都要 看清目标”，图中的“WP1、正面 · 0.6m、设备 A”标出关键证据。Waypoint 规划同时优化覆盖、多角度和总路径长度。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】WP1；正面 · 0.6m；设备 A；WP2。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P13【先预览，再保存 .traj】

【所属章节和小节】具身智能基础 第8章｜小节三 · 线性：模拟机器人 向…

【本页目标】能够解释“先预览，再保存 .traj”的核心关系。

【预计播报时长】约 20 秒

【语音逐字稿】

请沿着箭头从起点读到结果。本页聚焦“先预览，再保存 .traj”，图中的“加载、USD、相机”标出关键证据。轨迹文件记录位置、朝向与拍摄参数，预览是发现遮挡和盲区的最后机会。再核对条件。阅读时不要跳过中间步骤。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】加载；USD；相机；1280×720。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】待补视频 video-3（无伪造文件）+ HTML内联SVG


## P14【参数定一帧，轨迹定 数据集】

【所属章节和小节】具身智能基础 第8章｜章总结

【本页目标】能够用一条关系链复述本章核心结论。

【预计播报时长】约 20 秒

【语音逐字稿】

请按屏幕中的纪要卡从左到右回看本章。把每张卡的结论串成一条解释链，再用底部一句话检查自己能否说清机制、条件与边界。再用底部结论检查自己的理解。请把节点间的连接作为判断依据。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】五个参数，决定 看见什么；RGB 说是什么，深度说 有多远；环绕：目标始终在 画面中心；线性：模拟机器人 向前走。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P15【单选题 · 8题】

【所属章节和小节】具身智能基础 第8章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

这是“单选题 · 8题”页面。请先独立阅读题干与全部选项，再核对本章的证据后作答；提交后才能查看本页反馈，本段不提前播报答案。同时指出这条关系依赖的条件，以及可能失效的边界。同时注意边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P16【实操一 · 环绕轨迹】

【所属章节和小节】具身智能基础 第8章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

面对“实操一 · 环绕轨迹”，请先列出操作步骤和需要提交的证据，再独立作答；参考内容暂不展开，完成后才用于复核。再用底部结论检查自己的理解。同时指出这条关系依赖的条件，以及可能失效的边界。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图


## P17【实操二 · 多点巡检】

【所属章节和小节】具身智能基础 第8章｜章测验

【本页目标】能够按照题目要求独立作答并说明依据。

【预计播报时长】约 20 秒

【语音逐字稿】

请在“实操二 · 多点巡检”页面把任务拆成可执行步骤，记录输入、过程和结果；先提交自己的判断，再打开评分要求检查遗漏。再用底部结论检查自己的理解。请用画面的层级与连接说明结论为什么成立。

【教师提示】以下视觉与媒体元数据不送入 TTS；测验反馈仅在学生作答后使用。

【对应视觉说明】页面标题、关系节点与结论条。画面按本页唯一概念组织，结论条负责收束。

【图片或视频文件名】HTML内联SVG / CSS教学图

