Files
English/Doc/M1-MANUAL-VALIDATION.md
T

3.7 KiB

M1 人工音频与真机验收清单

状态:待实际设备与人工听者执行。自动测试、模拟器和 Debug 构建不能替代本清单。

执行原则

  • 每个平台用真实麦克风、扬声器或耳机完成;记录系统版本、设备型号、日期和异常。
  • 测试时不要输入真实电话号码、住址或其他敏感资料。
  • 听力抽听由英语能力足以判断 A0 清晰度的人完成;TTS 清晰可懂不等于真人发音审校。
  • 原始录音仅留在测试设备;验收后按用户设置删除。

A. 种子课程与评估音频抽听

对 10 节种子课程的每个新词块、每个听力播放按钮、两套 A0 评估的每个听力题逐项确认:

  • 播放文本与显示的参考文本/正确答案一致。
  • 正常速度与慢速都能完整播放,无截断、重叠或明显失真。
  • 音量在设备默认音量下清楚;英语重音与停顿适合 A0 初学者。
  • 不因播放失败把阅读文本当作听力完成。

将发现的问题记录为:课程或评估题 ID、设备、问题描述、复现步骤、是否已替换/复听通过。

B. 三端学习闭环

在 iPhone、Android、macOS 各完成一次以下流程:

  1. 新安装后完成引导,开始 A0-01,验证预热不创建掌握或复习项。
  2. 完成听、跟读、阅读、写作、受控对话和独立尝试;中途关闭应用后继续,确认草稿与步骤恢复。
  3. 授予与拒绝麦克风/语音识别权限各一次;拒绝时能文字练习或保留待评估,不能算语言失败。
  4. 录音、回听、删除各一次;关闭“保存录音”后离开步骤,确认录音已删除。
  5. 配置一个 HTTPS AI 服务,检查连接、受控对话、动态补练、临时释义;断网时确认本地课程可用且不编造结果。
  6. 在补练中用语音输入:确认转写、编辑转写、退出并恢复草稿各一次,核对输入方式记录。
  7. 完成/模拟到期复习、一次失败复核、AI 内容举报隔离,以及 A0 评估口语待评估路径。

C. 发音可理解度抽样

M1 不提供音素级诊断。可用以下人工抽样确认“受控情境下可理解”:

  • 学习者不看文字录下 A0-10 的姓名、地点、喜好、联系方式与反问。
  • 两位独立英语听者分别听录音,写下自己听到的关键信息,不看参考答案。
  • 只有关键信息都能被稳定复述时,记录为“受控场景可理解”;否则只给出示范/慢放/回听建议,不把 ASR 错误诊断为发音错误。

本项不等同于更高阶段真人交流能力,也不改变 A0 自动升级门槛。

当前执行记录(非最终签收)

日期 范围 已验证证据 结论 / 未覆盖项
2026-09-14 自动回归 flutter analyze 无问题;flutter test 70 项通过 覆盖状态恢复、证据重算、动态内容判定等代码路径;不代表真实设备能力。
2026-09-14 三端可构建性 flutter build macos --debugflutter build apk --debugflutter build ios --debug --no-codesign 均成功 iOS 产物仍需签名后才能部署;构建成功不等于真机验收。
2026-09-14 macOS 桌面界面 已启动 Debug 应用,并通过 Computer Use 读取第 1 课写作页面、文本框与操作按钮 只完成界面可访问性确认;TTS、录音、STT 的真实输出和整课闭环仍待人工执行。
2026-09-14 iPad 连接 Flutter 发现无线 iPad;部署前检查提示设备需解锁、开启 Developer Mode,并通过 USB 或同一局域网连接 尚未部署,iPad 验收未开始。
待执行 Android 真机、人工音频抽听、两位听者可理解度抽样 不应以自动测试或系统 TTS 的存在替代这些验收。