数字人增强版 v6.5
打开同目录 课程AI助手(双课教学版-v6.5-3D数字人增强版).html,选择「数字人」,点击「自我介绍」体验;拖动人物旋转,滚轮缩放,可随时停止朗读。原 v6.4 HTML 保持不变。
本次实现
- 内嵌有面部变形和骨骼的 3D 女性主持人模型、Three.js 渲染库;约 50 MB,形象不依赖在线 CDN。首次加载需要等待模型解析。
- 六种课堂身份共用同一形象,联动服装颜色、微笑幅度、身份名称和自我介绍。保留原有课程、案例及对话角色提示词。
- 增加眨眼、呼吸、头部轻微运动、聆听倾斜、思考姿态及讲解手臂动作;支持减少动作。
- 取消随机变调,保留音色原始音高,提供 0.8–1.2 倍语速。长文本分段不再静默截断。
- 句级字幕、朗读事件驱动口型、停止朗读、视角复位、科技感灯光和深色演播室、手机布局。
能力边界
模型为写实风格虚拟人物,不是真人扫描或影视级数字替身;角色切换不改变人物年龄、性别或面部身份。手势为程序化讲解动作,尚未做到每个语义对应专属动作。 浏览器实测可用声音只有 Microsoft Huihui、Kangkang、Yaoyao,未检测到 Natural 神经音色。本次优化朗读控制与韵律,不能使普通系统 TTS 自动变成真人级语音。语音服务和麦克风仍受浏览器、系统及网络条件影响。 口型按开始、结束、边界事件和估算节奏驱动,并非中文逐音素对齐。自动测试使用模拟语音事件检验状态机,未进行真人听感评估,也未验证外部 AI 服务回答或麦克风识别。
已执行验证
命令:node work/avatar-upgrade/build.cjs、node work/avatar-upgrade/test.cjs。 Edge 无头浏览器实际打开本地 HTML:3D 加载成功,6 个带表情网格,头部与手臂骨骼可用;页面 JavaScript 错误为 0。通过长文本分段、避免截断、角色切换、字幕、开始朗读、取消/过期回调、语音错误恢复检查。390px 手机宽度数字人面板无横向溢出。桌面与手机截图已人工查看。
写操作清单
以下路径均相对于本说明所在目录:
- 新建:
课程AI助手(双课教学版-v6.5-3D数字人增强版).html。 - 新建:本说明。
- 新建:
work/avatar-upgrade/studio.js、speech.js、studio.css、build.cjs、test.cjs,实现、构建与验证脚本。 - 新建:
work/avatar-upgrade/mpfb.glb、THIRD-PARTY-LICENSES.txt,模型与许可说明。 - 新建:
work/avatar-upgrade/package.json、package-lock.json、node_modules/,仅本工作目录的构建测试依赖。 - 新建:
work/avatar-upgrade/test-results.json、desktop.png、mobile.png,测试证据。
未修改源 HTML、身份认证或云服务配置,未执行文件删除或远程部署。
素材来源
模型为 TalkingHead 项目的 mpfb.glb 示例,其 README 标明该模型为 CC0。Three.js 0.180.0 为 MIT 许可,许可正文已内嵌到增强 HTML,同时保存于工作目录。