Files
English/Doc/LEARNING-ENGINE-SPEC.md
shenleiandClaude Opus 4.8 febfd30f49 feat: A1 短材料复现本单元理解词,并加入黑夜模式
课程内容
- 重写全部 21 个 A1 单元的听读材料,把本单元理解词织进听/读文本,
  单元内理解词复现率从约 20% 提升到约 77%(各单元 56–96%)。
- 修正 U01 房间号与机场大巴同为 thirty 的撞车(改为 17/30/40)。
- 校验器容差按级别读取(A1 为 8%),materials 覆盖率、字数、
  选项子串等校验全部通过;course_content_test 通过。

黑夜模式
- app_theme 拆分明/暗两套调色板,AppColors 随亮度切换;
  main 用 theme/darkTheme/themeMode + builder 镜像已解析亮度;
  主题偏好持久化到快照;进度页新增“外观主题”切换。

文档
- COURSE-PACK-JSON.md 更新 A1 词池覆盖(840/933)与材料复现约定。

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-09-18 11:16:09 +09:00

462 lines
43 KiB
Markdown
Raw Permalink Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# 学习引擎规格:每日内容、掌握判定与阶段升级
> 适用范围:个人使用的英语学习工具
> 原则:学习目标固定为日常生活与旅行,主线终点为 B1;课程主线由主题地图和冻结的单元内容包决定并保持稳定。目标决定学哪些场景,分级数据决定难度上限,AI 决定场景怎么演,程序决定怎样算完成。AI 只在明确边界内生成变式练习与对话。
M1 范围、生成与数据契约见 [开发与验收约定](M1-IMPLEMENTATION-CONTRACT.md)A0 核心清单和四技能评估见 [A0 阶段标准](A0-STAGE-STANDARD.md)。以下规则是个人学习初始规则,不是 CEFR 认证标准。
## 1. 学习体系的边界
学习目标固定为**日常生活与旅行**,不提供目标选择。主线终点是 B1:CEFR 对 B1 的描述正是能应对在英语地区旅行时遇到的大多数情况,并能谈论熟悉的日常话题。B2 作为可选扩展,B1 通过后再规划。
不安排学校与学术场景,这类词汇不进入词池(5.4)。工作需求后续作为独立主题线增加:届时在主题地图中新增工作单元,使用 5.4 中预留的工作类词汇,不改变日常与旅行主线的单元和门槛;是否提供目标选择届时再定。
学习路径没有预设的总课数。A0 的 10 节核心课和第 5 节主题地图中的单元是主线内容;系统会根据掌握状态持续提供复习、变式任务和补救微课,直到达到阶段出口能力。它们不是“掌握英语”的终点。
阶段推进不取决于“学完多少课”。核心课用于建立能力骨架;当一个阶段的出口任务、词句掌握度和真实对话表现尚未达标时,系统继续生成符合该阶段范围的新情境与练习,而不是机械跳到下一阶段。
| 阶段 | 能力目标 | 主要学习形式 |
|---|---|---|
| A0 | 问候、自我介绍、数字、身边物品、基础短句 | 短课、模仿、受控对话 |
| A1 | 点餐、购物、问路、交通、入住、看病等固定的生活与旅行互动 | 主题单元、任务型 AI 对话 |
| A2 | 讲经历、做预订与改期、比较选择、处理行程和住宿中的小问题 | 主题单元、较长对话、分级听读 |
| B1 | 独立应对旅行和生活中的大多数情况:突发问题、投诉协商、说明理由、讲完整经历 | 主题单元、较长听读材料、叙事、讨论、写作 |
| B2(可选) | 自然语速的生活与旅行内容、复杂协商和讨论 | B1 通过后再规划 |
本工具说的“学会英语”,指达到 B1 的日常与旅行交流能力,而不是背完一套课。从 A2 起须逐步加大听读输入(第 6 节)。
**时间预期**:剑桥英语给出的累计指导学时参考为 A2 约 180–200 小时、B1 约 350400 小时、B2 约 500–600 小时。每天 20 分钟约合每年 120 小时,大致对应 A2 约 1.5 年、B1 约 3 年;30 分钟模式约 2 年到 B1。这只用于设定预期,不作为进度要求或解锁条件。
## 2. 每日内容生成引擎
每天不由 AI 从零随机生成一整课。系统先从固定的能力地图(主题地图与已冻结的单元内容包,见第 5 节)中选内容,再让 AI 生成符合当前水平的例句、对话变式和纠错。
### 2.1 每日组成
```text
到期复习(按时间选任务)
→ 教学段:词汇预热 → 带帮助的听说读写 → 受控对话 → 独立尝试
A2 起)听读输入
→ 总结与保存;未完成步骤留待续学
```
| 模块 | 来源 | 目的 | 建议用时 |
|---|---|---|---:|
| 完整教学段 | 当前能力地图 | 包含预热、听说读写、一次受控对话、独立尝试;预热不重复计时 | 合计约 10–15 分钟 |
| 其中:词汇预热 | 新词与准备词块 | 认识声音和当前句义,之后在句中应用,不再重复整套词卡 | 占教学段 1–3 分钟 |
| 其中:受控对话与独立尝试 | 已教语言 | 通常 3–5 个回答轮;结尾一轮可作为独立尝试 | 占教学段约 3–5 分钟 |
| 到期复习与补救 | 到期词句和薄弱技能 | 合并同一目标的复习与错误修复,避免重复安排 | 按每日预算 |
| 听读输入(A2 起) | 当前单元的分级材料 | 积累可理解输入 | 从教学额度中划出:A2 约 20%,B1 约 35%(第 6 节) |
每日时间是安排上限,不保证每次完成整段。10 分钟:复习/补救 3 分钟、教学或续学 6 分钟、总结 1 分钟;20 分钟:5 + 14 + 130 分钟:8 + 20 + 2。30 分钟教学额度可用于慢练或可选巩固,不强制再学新段。无到期项时可将空余时间用于教学或提前结束。预热、课程内对话均包含在教学额度中,不另外叠加。只做复习的当天,独立输出可嵌入复习任务。
预热只列出当前教学段真正会遇到的新内容:通常 3–6 项,最多 8 个词汇项加 2 个理解词块;超出则先拆教学段。每项以“英文 → 音频 → 当前句义中文 → 一个短例句”呈现,并至少有一次轻量听辨或中英匹配。用户可逐项播放、查词或跳过,之后仍能进入课程;预热是降低陌生感,不是背诵考试。
预热只记录 `exposed`,不把“看过卡片”记成认识、可回忆、可使用或已掌握。实际课程和间隔复习中的独立作答才改变掌握状态。到预算边界完成当前短题后保存下一步骤,不开启长对话;可提前结束或自主继续。10 分钟不足以做完教学段时分天完成,未完成的听、说、读、写及独立尝试保持待做,不因当天结束自动结课。
### 2.2 选择规则
1. 有到期项先按时间预算选任务,不设每天 5 个词句的硬上限。将同一词句的多条到期原因合并;从最早到期和近期真实错误两个队列轮流取项(先最早到期),某队列为空则从另一队列取。收藏扩展词也按到期时间参与,保证不会长期被错题挤占。已打开的未完成会话可先恢复。
2. 选定新教学段后,若包含未预热的新增内容,先进入课前词汇预热;恢复已开始教学段时不强制重复预热,用户可从课程页主动回看。新课按阶段主线顺序进行;用户可自行回退,不可被 AI 随机跳到未准备的高难主题。
3. 优先选最近两次失败或需要提示才能完成的词句作为错误修复项。
4. AI 对话使用“本教学段 + 已学且可回忆/可使用/已掌握”的语言范围,较弱项目必须预教;额外新词每轮最多 1 个、整段最多 2 个,先说明再使用。评估不得引入额外新词。
5. 仅对有效语言失败安排补救。提示如何撤除及复习如何推进按第 3 节,不以任意两次点击答对跳过间隔检查点。
### 2.2a 复习容量与积压
“词句项”是稳定词句 ID,“复习任务”是一道题或短对话,界面分别显示任务数与覆盖词句数。一个任务可计划覆盖 1–3 个词句,但只为有直接作答证据的目标记账。例如用户独立说 `I like tea.`,可支持 tea 与 I like 的表达证据,不能同时推断会 coffee、会听懂 tea 或会提问。选择一个句义答案不自动证明其中每个词都认识。每个目标分别保存结果和技能;同一目标同日最多推进一个间隔检查点。
按任务预计用时计算积压:若待复习预计时间超过当日复习预算的 2 倍,或存在逾期至少 7 天的项,则暂停推荐新的教学段,先续学已开始内容并处理到期项;原教学额度可转为复习/补救,仍保留总结时间。积压降至预算以内且没有逾期 7 天的项后恢复新段推荐。用户可主动选新课,首页说明推荐原因;不删除积压、不偷偷提高每日时长。预测用时以实际完成耗时滚动修正。
### 2.2b 从辅助学习到独立尝试
每个教学段必须安排一次 30–90 秒的独立尝试,优先使用结尾对话的一轮或写作的一题,不额外叠加整套测试。先完成带帮助练习,再换内容值/图片/人物并隐藏句框、答案、释义和翻译;听力隐藏提问文字,阅读保留英文材料。刚看过同一句答案后立即复述只算练习,不能充当迁移证据;当日独立成功也不替代次日及后续间隔检查点。
不会时可恢复提示:该次记辅助完成,安排下一次不同任务的独立尝试,不强制当场循环。跳过记待做,时间不够则续学。只有教学步骤已完成且独立尝试已有结果(成功、辅助、有效错误或待确认)才记录教学段完成;“待确认”仍不构成掌握。各段轮换听、说、读、写;每个种子主题结束前四技能至少各有一次独立尝试机会,见课程包映射。主题可完成而能力未掌握,后者进入复习和补练。
### 2.3 AI 生成输入格式
每次请求 AI 时必须携带以下结构化信息:
```text
当前阶段:A0 / A1 / A2 / B1 / B2
当前单元与任务:单元 ID、场景 ID、任务 ID、任务目标(例如“在咖啡店点饮料”)及任务引用的核心词句 ID
用户身份与 AI 身份
已掌握的词、句型
本教学段新词(最多 8 项)及主动句型(最多 2 项)
理解用词块(每段最多 2 个);对话额外新词(每轮 1 个、整段 2 个;评估为 0)
禁止的超纲词与复杂语法
已出现的错误与要复练的表达
目标轮次、中文辅助开关、语速
完成判定条件
```
课程生成须返回完整课程/练习结构;对话单轮须返回英文回复、信息槽、原作答证据引用、任务完成建议,以及必要时的一句中文提示和结课重说句。客户端校验后才保存和判定,不能直接采信 AI 的完成标记。结构、语义审核、一次修复和内置模板回退遵循《开发与验收约定》第 2 节。
### 2.4 随时查词
教学内容中的英文词和已定义短语均可点开查意思。查词卡按“短语优先、单词其次”显示当前句义、中文释义、示范音、慢速播放和一个当前阶段可理解的例句;用户可手动加入复习。系统不要求用户先记住再允许查,也不因为查词把学习任务判错。
AI 对话中的词条必须来自当前允许语言范围,或是事先标为可解释的新词。动态内容没有审核词条时,只能显示明确标记的临时释义,不能自动变成核心词汇、课程内容或掌握证据。离线时仅查询内置/缓存词条。
教学态的查词、翻译、字幕和提示都算帮助完成;独立练习和出口评估中默认无查词入口。用户若要查词,先切换当前题到教学态,当前题不计独立证据,随后用新题补测。该行为是帮助路径,不是语言失败。
## 3. 词汇与句型掌握模型
词汇不以“看过一次”或“答对一次”为掌握。词汇分为“会用”的产出核心和“会认”的理解词两层(见 3.5);本节五种状态与掌握规则适用于产出核心,每个词和关键句型均经历五种状态:
| 状态 | 证据 | 系统动作 |
|---|---|---|
| 新学 | 第一次在课程中出现 | 当天再次在听、读、说中出现 |
| 认识 | 能从音频/英文中选出正确意思 | 安排中文/图片到英文的回忆 |
| 可回忆 | 看中文或图片能说/写出英文 | 安排句子填空、替换和改写 |
| 可使用 | 能在新句子或 AI 对话中正确使用 | 减少提示,安排变式场景 |
| 已掌握 | 间隔后仍能独立、正确使用 | 拉长复习间隔,保留偶尔抽查 |
### 3.1 掌握的最低规则
首次教学记录为“新学”。一次有效听辨/阅读识别成功可进入“认识”;一次无答案提示的说/写回忆成功可进入“可回忆”;在不同于教学原题的场景中无提示正确使用可进入“可使用”。升级必须保留前序的识别和回忆证据,不因一次对话跳过。
一个词或句型只有同时满足下列条件,才能标记为“已掌握”:
- 完成四个间隔复习检查点,每个检查点至少一次独立成功;正常计划为该词句首次完成正式教学后第 1、3、7、14 天。
- 有效证据覆盖听辨、回忆表达、情境使用三类任务;最近两次有效作答均无提示成功。
- 至少一次在不同情境中无句框主动使用;带“合理提示”完成仅算练习,不算该迁移证据。
每个词句单独保存首次正式教学日期:已获得释义/示范并提交至少一次该项应用练习(可带帮助,不要求答对)时登记,只登记一次;不等待整课或主题完成。仅看预热、查词或跳过教学不触发;主动收藏可以创建独立的待学提醒,但不启动四个掌握检查点。若该项当天有真实错误,补救与次日复习合并。
按本地日期排复习,正常四次成功的间隔为 1、2、4、7 天。逾期不补造结果:完成当前检查点后,下一检查点从实际完成日期按后续间隔安排,每天同一项最多推进一个检查点;漏学不清空历史。第四次后按 30 天抽查。提示后答对保持当前检查点,次日换题独立复测,不计失败。遗忘处理按下一节,不因单次错误清空历史或四个检查点。
每次作答区分独立成功、带帮助完成、语言错误、待确认和技术失败。记录听/说/读/写、提示、翻译、字幕、输入与转写修改状态;看答案后复述、同题立即重做不算独立间隔或迁移证据。文字可支持词句回忆/使用,但不能补齐口语证据;看字幕或翻译不能补齐独立听力。反馈来源为转写不确定或服务异常时,不进入失败计数。
例如 `coffee` 的掌握证据不只是知道中文意思;还应能听懂它、看到图片说出它,并在点餐中说出 `Id like a coffee, please.`
### 3.2 失败处理
- 一次有效语言失败:保留原状态和检查点,标记“需复核”,次日先换题无提示复核;需要时再提供示范。需复核项暂不计入首次阶段通过的词句门槛,但不撤销已取得的阶段通过记录。技术失败或 uncertain 不计语言失败。
- 复核成功:清除需复核标记。尚未掌握的词句按原检查点继续(满足到期时间与独立成功要求时可推进);原已掌握项 7 天后再抽查一次,成功后回到 30 天抽查。复核期间的辅助完成不清除标记,也不计第二次失败。
- 同一词句在不同任务的两次独立尝试均有语言失败,且中间没有独立成功:做简短识别/回忆/应用诊断,按最高仍有复测证据的能力回到“新学/认识/可回忆/可使用”;诊断不确定时保留需复核,不猜测。原检查点退回一个(最低为 0),保留全部历史,只补该点及后续间隔,不要求统一重走四次。
- 退回检查点后次日换题复核,成功补回一个检查点,再按后续 2/4/7 天间隔推进;从第 4 点退至第 3 点者补回第 4 点后,7 天再抽查一次,成功才恢复已掌握。恢复已掌握仍须满足三类任务覆盖、迁移与最近两次独立成功。
- 连续三次有效语言失败:插入约 2 分钟补救,使用当天复习/教学预算,不额外加时,并暂停该能力的新内容。计数只看有效独立作答,技术问题、求助和立即模仿均不累计。
### 3.3 可理解沟通标准
发音和听力的目标不是获得英音、美音或笼统的“发音分数”,而是在当前阶段的真实任务中稳定互相理解。
| 能力 | 达标定义 | 不作为判错依据 |
|---|---|---|
| 口语可理解度 | 听者能稳定识别姓名、地点、数字、需求、问题等关键信息,并完成任务 | 地区口音、轻微重音差异、与示范音不完全一致 |
| 听力可理解度 | 能听出场景中的主要意思和关键细节,并作出合适回应 | 第一次就听懂所有口音、所有自然语速材料 |
| 沟通补救 | 没听清时能请求重复、放慢或确认意思 | 不能一次听懂就视为失败 |
听力材料按以下难度推进:
```text
清晰慢速英语
→ 正常语速的清晰英语
→ 不同说话人和常见口音
→ 有少量背景声的真实情境
```
每个阶段都应教并练习沟通补救句:`Could you say that again?``Please speak slowly.``Do you mean ...?`。这类句子本身是听力能力的一部分。
### 3.4 发音反馈规则
| 识别到的情况 | 系统动作 |
|---|---|
| 语音识别可信度低、无可靠置信度或用户提出异议 | 显示转写并让用户确认、修改或重说;不记录为英语错误 |
| 有口音但表达可理解 | 接受答案;最多提供可选提示,不强制纠正 |
| 同一词反复被 ASR 错误转写 | 先排查噪声和识别问题;可提供用户自选通用练习,不据此诊断音素或降低掌握度 |
| 句子结构或词汇有误 | 作为表达错误反馈;不归为发音错误 |
一次反馈只处理一个点。`three/free` 可作为通用听辨、示范和回听练习,但界面须说明“识别可能有误,这不是发音诊断”。文字 AI 没有音频证据时不能断言用户把 /θ/ 发成 /f/;个性化音素诊断不在 M1。未编辑且确认的转写仅是受控口语的代理证据,不等于真人可理解度保证。
### 3.5 两层词汇:会用与会认
| 层 | 范围 | 状态 | 是否计入升级分母 |
|---|---|---|---|
| 产出核心(会用) | 单元内容包中需要主动说、写的词、词块和句型;每单元 10–15 项 | 3.1–3.2 的五种状态和掌握规则 | 计入 |
| 理解词(会认) | 听懂、看懂即可的词;每单元 A1 20–35 项、A2 3050 项、B1 50–80 项 | 新学 → 认识 → 熟悉 | 不逐项计入;升级时抽查(4.2) |
| 扩展词 | 听读材料中查过或多次出现、由用户加入复习的词 | 同理解词 | 不计入,也不参与升级抽查 |
**学习流程**:单词不单独背,跟着单元场景学。
1. 会用的词:预热(只记“见过”)→ 在场景句中听辨 → 说、读、写的替换练习 → 受控对话中用出来 → 独立尝试 → 按 3.1 间隔复习,每次复习换语境(如从地铁站换到火车站)。
2. 会认的词:不进预热,直接出现在教学段的听读材料里,首次出现可点开释义;教学段结束时做 2–3 道快速识别题,之后按下述理解词规则复习。
3. 各等级侧重:A1 以具体名词和固定说法为主,用图片和替换练习;A2 增加词块、搭配和词形变化(如 `book a table``miss the bus`、过去式);B1 的新词主要来自听读材料和查词,增加词族和近义词辨析(如 `complain`/`complaint`),并练习用英语解释词义。
**识别题要求**(两层词的“认识”证据,以及理解词和扩展词的全部证据):
- 至少一次在句子或场景语境中答对;孤立的中英互译不能作为唯一证据。
- 干扰项取同单元或意思相近的词(如 `ticket``receipt``menu`),不用明显无关的词。
- 提供“不认识”选项:选它不算语言失败,转为教学并换题补测。
- 记录作答用时:听辨题超过约 10 秒、阅读识别题超过约 15 秒,记为带帮助完成,不算独立成功。
- 理解词只考“听或读 → 意思”,不考拼写,也不要求说出。
理解词规则:
- 一次独立的听辨或阅读识别成功进入“认识”;至少间隔 7 天后,换题、换语境再次独立识别成功,进入“熟悉”,之后每 30 天抽查。
- 识别失败回到“认识”,次日换题复核;不做诊断降级。
- 复习以 5–10 秒的快速识别题为主,可以成组出现,占复习预算不超过三分之一。
- 在听读材料中答对与某个理解词直接相关的理解题,可计一次该词的识别证据。
- 后续单元把某个理解词列为产出核心时,保留已有识别证据,从“认识”开始走完整掌握流程。
A0 的准备/辅助材料沿用《A0 阶段标准》,不套用本节。
### 3.6 免学与定级
已经会的内容不必重学,但“会”需要证据:
- **单元预检**:进入单元时可选做一次不超过 3 分钟的预检,在单元场景里考听辨和独立表达(说或写)。某项产出核心两类题都独立答对,记为“免学待确认”,教学段中跳过其讲解;至少 3 天后换题独立复测一次,成功即记为已掌握并进入 30 天抽查,失败则按新项正常教学。理解词预检识别正确直接记为“熟悉”。预检答错不计语言失败。
- **入门定级**:“完全零基础”从 A0 开始。“有一些基础”或“能简单对话”可做定级评估:依次使用各等级已冻结的出口题组中的一套(先 A0,通过后再 A1……),在第一个未通过的等级停止,从该等级开始学习。某等级题组尚未冻结时,定级最多只到该等级。
- **定级通过**:定级跳过的等级记为“定级通过”,与“阶段通过”分开保存;14 天内再通过该等级的另一套题组才算确认。未确认时首页建议回到该等级,但不强制。
- **定级免学**:跳过等级的产出核心不走四个检查点,每天从复习预算中最多抽 5 项独立复测;失败项转为需复核并安排补救。跳过的等级不参与后续等级的门槛计算。
## 4. 阶段升级规则
已完成课数只用于回顾学习历史,不能决定升级。可以提前参加评估或延后升级,但只有门槛全部满足才记录阶段通过,不能手动跳级。入门轻量定位只推荐起点,定级跳过等级须按 3.6 用出口题组证明。下一等级尚无已冻结的单元时显示待提供,不在运行时临时生成主线;单元内容包按第 5 节离线生成、校验、审核并经用户确认冻结后才可学习。
### 4.1 A0 → A1
唯一执行标准见《A0 阶段标准》:固定 60 项核心分母,至少 48 项可使用或已掌握,其中至少 30 项已掌握;两次不同题组的听说读写评估分别通过,间隔至少 24 小时,最近一次在 30 天内。每项必需能力都要有证据,不以总平均分掩盖口语或听力缺口。
初次见面对话只是口语评估的一部分,还须验证姓名拼读、数字、物品、家人、星期/整点及沟通补救;阅读和写作单独评估。带提示、修改转写或识别失败的处理按标准执行。未通过则定向补练与换题复测,不限制追加课程数量。
### 4.2 A1 及以上的升级门槛
门槛只设在等级之间,单元之间不设门槛(见 5.1)。从 A1 起,进入下一等级须同时满足:
1. 本等级产出核心(全部单元之和,等级 stageVersion 冻结的分母)中至少 80% 为可使用或已掌握,其中至少 50% 为已掌握;需复核项的处理同《A0 阶段标准》;
2. 理解词抽查:从本等级已教的理解词中随机抽 30 项做听或读的识别,独立答对至少 24 项;
3. 两套不同题组的四技能评估分别通过,间隔至少 24 小时,最近一次在 30 天内;
4. 完成本等级的出口任务(4.3)。
本等级的单元未全部冻结前,只能学习已冻结的单元,升级评估不可用。比例由程序固定,内容包不能修改。
### 4.3 出口任务
| 升级 | 出口能力 | 出口任务 |
|---|---|---|
| A1 → A2 | 在点餐、购物、问路、交通、住宿、看病等场景中完成固定互动;能写 3–5 句短消息 | **旅行日**:入住酒店、询问路线、点餐并处理一个简单问题(约 3 分钟对话);写一条告诉朋友当天安排的消息 |
| A2 → B1 | 讲经历,做预订和改期,比较选择,处理行程和住宿中的小问题 | **行程变化日**:电话改订并当面解决一个住宿问题(约 5 分钟对话);听 1–2 分钟通知后说出要点;写 4–6 句消息讲当天发生了什么 |
| B1 结业(B2 可选) | 独立应对旅行和生活中的大多数情况,说明经过和理由 | 听 2–3 分钟广播或导览后复述;5 分钟旅途突发问题的解决与协商对话;写一封说明问题并提出要求的邮件 |
A2 起的出口任务按 5.8 判定;A2 → B1 与 B1 结业须人工或通过高质量任务评估复核,不应只靠选择题自动升级。
## 5. 学习路线与单元内容包
**目标决定学哪些场景,分级数据决定难度上限,AI 决定场景怎么演,程序决定怎样算完成。** 学习目标固定为日常生活与旅行;主题地图(5.2)列出每个等级要完成的生活和旅行任务;AI 从场景出发起草单元内容,再用分级数据检查难度;程序校验、编译判定条件并执行门槛。单元冻结后,运行时 AI 不能再改变它。
### 5.1 路线结构
```text
等级(A0 / A1 / A2 / B1
→ 主题单元(一组相关的生活或旅行任务)
→ 教学段(沿用第 2 节,每段约 10–15 分钟)
→ 场景与任务(单元主场景 + 2–3 个变式场景)
```
- **单元是冻结和学习的基本单位**:某个单元冻结后即可学习,不必等整个等级。
- **单元之间不设门槛**:完成单元的教学段并尝试过单元任务后,即可进入下一单元;掌握在复习中继续推进。积压时按 2.2a 暂停推荐新单元。
- **推荐顺序按依赖排列**(如价格先于购物、日期先于预订、问路先于交通)。用户可以自选单元;跳到后面的单元时,前面单元中被引用的词句作为预热新项先教。
- **单元规模**:产出核心 10–15 项(词、词块、句型);理解词 A1 20–35 项、A2 4065 项、B1 70–110 项(两层词汇见 3.5)。三个等级的数量都已按词池和起草结果调整(5.4),以 `course-map.json` 为准。
### 5.2 主题地图
A0 保持现有 10 节核心课(见《A0 初始核心课程包》)。A1 起的单元如下,机器可读版本是 `kouyu_english/assets/courses/course-map.json`,单元内容包格式见《课程内容包 JSON 格式》(COURSE-PACK-JSON.md)。A1 按词池试建结果补了“家人与住处”“描述人和感受”,把“开口求助与数字”放在最前,并按依赖调整了顺序(如问路先于打车、公交)。“类别”表示该单元主要服务日常还是旅行。修改主题地图(增删、合并或调整单元)须用户确认;已冻结单元的 ID 不复用。
**A1:固定的生活与旅行互动**
| 单元 | 主题 | 类别 | 单元结束后能做什么 |
|---|---|---|---|
| A1-U01 | 开口求助与数字 | 旅行/日常 | 没听懂时礼貌求助,说 11–100 的数字,拼读字母 |
| A1-U02 | 价格与付款 | 日常/旅行 | 问价、说 100 以内的金额、选择现金或刷卡 |
| A1-U03 | 在咖啡店点单 | 日常 | 点饮料、说大小杯、礼貌确认 |
| A1-U04 | 问路 | 旅行 | 问地点、听懂左右和距离 |
| A1-U05 | 在餐厅点餐 | 日常/旅行 | 点餐、问推荐、要账单 |
| A1-U06 | 家人与住处 | 日常 | 介绍家人,说住在哪里和家里有什么 |
| A1-U07 | 公交与地铁 | 旅行 | 买票、问站点、确认下车 |
| A1-U08 | 超市与便利店 | 日常 | 找商品、说数量 |
| A1-U09 | 描述人和感受 | 日常 | 说一个人的外貌和性格,说自己的心情 |
| A1-U10 | 打车 | 旅行 | 说目的地、确认价格或路线 |
| A1-U11 | 我的一天 | 日常 | 说作息和常做的事 |
| A1-U12 | 买衣服 | 日常 | 问尺码和颜色、试穿 |
| A1-U13 | 日期与约时间 | 日常 | 说日期、约见面、改时间 |
| A1-U14 | 在机场 | 旅行 | 值机、问登机口、回答入境的简单问题 |
| A1-U15 | 入住酒店 | 旅行 | 说明预订信息、办理入住 |
| A1-U16 | 天气与穿着 | 日常/旅行 | 问天气、说该穿什么 |
| A1-U17 | 酒店里的需求 | 旅行 | 要物品、报告简单问题 |
| A1-U18 | 药店与不舒服 | 日常/旅行 | 说一个症状、听懂基本建议 |
| A1-U19 | 遇到麻烦时求助 | 日常/旅行 | 说明遇到的麻烦、请求帮忙、感谢与回应 |
| A1-U20 | 打电话与留言 | 日常 | 留下姓名、号码和简短信息 |
| A1-U21 | 周末计划 | 日常 | 说将要做的事、邀请朋友 |
**A2:讲经历、做安排、处理小问题**
| 单元 | 主题 | 类别 | 单元结束后能做什么 |
|---|---|---|---|
| A2-U01 | 上个周末 | 日常 | 用过去时讲做了什么 |
| A2-U02 | 上一次旅行 | 旅行 | 讲去了哪里、怎么样、感受如何 |
| A2-U03 | 预订酒店与餐厅 | 旅行 | 电话或当面预订:日期、人数、要求 |
| A2-U04 | 改期与取消 | 日常/旅行 | 说明原因、提出新时间 |
| A2-U05 | 餐厅里的问题 | 旅行 | 说明忌口或过敏、菜品有问题、分开结账 |
| A2-U06 | 比较与选择 | 日常/旅行 | 比较商品、房间或路线并做选择 |
| A2-U07 | 退换货 | 日常 | 说明问题、要求退换 |
| A2-U08 | 行程出问题 | 旅行 | 误车、延误、换乘、改票 |
| A2-U09 | 住宿里的问题 | 旅行 | 报修、换房、提出要求 |
| A2-U10 | 看病 | 日常/旅行 | 说症状和持续时间、听懂用药说明 |
| A2-U11 | 聊兴趣与家乡 | 日常 | 围绕一个话题连续聊几轮 |
| A2-U12 | 建议与意见 | 日常/旅行 | 给建议、征求意见 |
| A2-U13 | 介绍城市与景点 | 旅行 | 描述地方、推荐去处 |
| A2-U14 | 丢东西与求助 | 旅行 | 在服务台说明丢了什么、在哪里丢的 |
| A2-U15 | 消息与短邮件 | 日常 | 写邀请、感谢、说明迟到 |
**B1:独立应对大多数情况**
| 单元 | 主题 | 类别 | 单元结束后能做什么 |
|---|---|---|---|
| B1-U01 | 讲一段完整的旅行经历 | 旅行 | 按顺序叙述,加入背景和感受 |
| B1-U02 | 规划行程 | 旅行 | 比较交通和住宿方案,说明理由和预算 |
| B1-U03 | 入境与行李 | 旅行 | 回答入境问题,报告行李延误或丢失 |
| B1-U04 | 听懂广播与讲解 | 旅行 | 抓住车站、机场广播和导览讲解的要点 |
| B1-U05 | 紧急情况 | 旅行 | 证件或钱包丢失、报警、求助 |
| B1-U06 | 就医 | 日常/旅行 | 说明症状变化和病史,理解医嘱要点 |
| B1-U07 | 投诉与协商 | 日常/旅行 | 要求退款或补偿,谈出解决办法 |
| B1-U08 | 租住与长住 | 日常 | 沟通租房或短租,理解规则要点 |
| B1-U09 | 生活服务 | 日常 | 办银行和手机卡业务、寄收快递、预约维修 |
| B1-U10 | 观点与理由 | 日常 | 推荐并说明理由,回应不同意见 |
| B1-U11 | 习俗与文化 | 旅行 | 谈小费、礼仪和节日,比较不同做法 |
| B1-U12 | 深入聊天 | 日常 | 聊经历、计划和感受,维持 5 分钟对话 |
| B1-U13 | 读懂生活文本 | 日常/旅行 | 读懂评价、说明、规则和通知 |
| B1-U14 | 写说明与投诉 | 日常/旅行 | 写邮件说明经过并提出要求 |
B2 为可选扩展(自然语速的生活与旅行内容、复杂协商和讨论),B1 通过后再规划单元。
### 5.3 数据来源
| 数据 | 锁定版本 | 规模 | 用途 | 许可与要求 |
|---|---|---|---|---|
| CEFR-J Vocabulary Profile | 1.5 | 7,799 条(按词+词性),词头 6,867A1 1,164、A2 1,411、B1 2,446、B2 2,778 | 词汇难度上限;建立等级词池(5.4)。约 1,740 条自带主题标注(如 Shopping 197、Food and drink 167、Travel 120、Education 85 | 研究和商用免费;须注明出处(CEFR-J,東京外国語大学投野由紀夫研究室) |
| CEFR-J Grammar Profile | 20180315 | 500 条语法项;约 170 条标了 A1.1–B2.2 子级,其余为同一项的否定/疑问变体 | 单元主动语法的难度上限 | 同 CEFR-J 词表 |
| Octanove Vocabulary Profile C1/C2 | 1.0 | 2,136 条:C1 1,111、C2 1,025 | 判断超出 B2 的词 | CC BY-SA 4.0;须署名,衍生数据须用同一许可 |
| NGSL / NGSL-Spoken | 导入时记录 | NGSL 2,809 词 | 候选词按(口语)频率排序 | CC BY-SA,可商用;须署名 |
| ECDICT | 导入时记录提交号 | 约 76 万词条 | 中文释义、音标、考试标签和词频,供人工复核 | MIT;只用 translation、phonetic、tag、bnc、frq,不用来源不明的 collins、oxford 字段 |
不导入、不抄录:Cambridge English Vocabulary Profile / English Grammar Profile、Oxford 3000、Pearson GSE(没有开放许可)。
原始数据文件与来源说明(版本、下载地址、SHA-256、许可文本)随内容包一同存档,见 `kouyu_english/tool/courses/lexicon/SOURCES.md`。目前只导入了 CEFR-J 的两份文件,其余数据尚未导入。
### 5.4 分级数据怎么用
分级数据只做**难度上限和覆盖检查**,不决定单元的内容和顺序:
- **语法**:单元主动使用的语法项不高于本等级(A1 单元只用 A1.x,A2 不超过 A2.x,B1 不超过 B1.x);未标等级的否定/疑问变体按主项等级处理。数据等级明显不合生活场景的(如 `You are` 标为 B1.1)可以提前,须写明理由。
- **词汇**:功能词、动词、形容词不高于本等级。CEFR-J 依据日本中小学教材统计,不少旅行名词等级偏高(`passport``luggage``platform``pharmacy``reservation` 都标为 B1),因此场景必需的具体名词和固定说法可作为**场景词**提前使用:须标注,且每个单元产出核心中场景词不超过 1/3。
- **理解词**:不高于本等级加一级,场景词除外。
- **等级词池**:起草某等级的单元前,先建立该等级的词池,作为词汇覆盖目标:
1. 取 CEFR-J 中属于本等级的词头;
2. 按用途分类:通用(功能词和不限场景的常用词)、日常、旅行、工作、学校与学术、其他。分类可多选;CEFR-J 自带主题标注的直接使用,未标注的由 AI 离线分类,用户抽样审核;
3. 属于通用、日常或旅行任一类的词进入词池;只属于学校与学术或其他的词不进入;只属于工作的词单独保存,留给后续工作主题线;
4. 单元提出的场景词(包括 CEFR-J 未收录的,如 `boarding pass`)并入词池。
5. 程序把词池中尚未被前面等级覆盖的词**预分配**给本等级单元,作为各单元的候选词:有主题标注的按主题对应单元(如 Food and drink 分到点单、餐厅、超市),其余的形容词、动词、副词由 AI 按场景合适程度分配,每个单元都要分到一部分。功能词(代词、限定词、介词、连词、情态动词)不分配,靠词块和句型覆盖。
词池随等级 stageVersion 冻结,分类结果随数据来源一同存档。
- **覆盖检查**:冻结等级 stageVersion 前,本等级词池至少 85% 须被覆盖:作为产出核心或理解词,或出现在产出核心的词块、句型里(如 `Can I have ...?` 覆盖 can、I、have),A0 已教的词也算。每冻结一个单元,其候选词中未覆盖的词顺延到后面的单元;未覆盖的词逐个补进某个单元、放进听读材料,或写入排除项并说明理由。
- **A1 词池试建(2026-09-17,未经用户抽样审核)**CEFR-J 1.5 的 A1 共 1,066 个不同词头。排除只属于学校与学术或其他的 102 个(如 homework、grammar、ruler,以及 fairy、prince、lion、kite、DVD 等儿童读物词和过时词),单独保存只属于工作的 15 个(如 meeting、interview、engineer、business),合并 is/was/did 等词形变体后,词池为 932 个。其中 A0 已覆盖 68 个,约 126 个是功能词和数词,其余约 770 个是实词:无主题标注的形容词 109、名词 105、动词 88、副词 40;有标注的 Free time 68、Personal identification 60、House and home 55、Food and drink 52、Shopping 44、Travel 23、Health 23 等。85% 覆盖需要 A1 单元再覆盖约 730 个。按每单元产出核心 12 项、其中约 8 项覆盖词池词(其余是场景词或纯句型)估算,产出核心覆盖约 150 个,加上词块中的功能词约 100 个,理解词需要覆盖约 480 个,也就是每单元平均约 25 个,因此 A1 的理解词数量从 15–30 调为 20–35。试建发现主题地图的缺口:family 类(aunt、cousin、husband、daughter 等约 20 个)和住处类(kitchen、bedroom、sofa、garden 等约 15 个)没有对应的 A1 单元,描述人和情绪的形容词(tall、young、angry、lonely 等)也没有集中的单元。
- **A1B1 起草结果(2026-09-17,未审核)**:50 个单元全部起草并通过程序校验,状态为 `draft`。词池覆盖 A1 834/93389.4%)、A2 1040/107896.5%)、B1 1344/155286.6%)。A2、B1 的理解词范围按实际需要调为 40–65 和 70–110;听读材料词数 A2 听 120280、读 150250B1 听 250550、读 300500。
- **A0**:保持已冻结的 60 项(`A0-1.0`),不按数据重新生成。对照 CEFR-J 1.5:40 个单词按词形还原后有 39 个属于 A1(`movies``movie``okay``OK/okay`),`zero` 不在词表中,作为 A0 自有项保留。
### 5.5 单元内容包组成
| 部分 | 内容 |
|---|---|
| 元数据 | 单元 ID、修订号(如 `A1-U03 r1`)、数据来源与版本、起草与审核所用模型、审核记录、确认冻结日期 |
| 能力 | can-do 描述,对应主题地图中的“单元结束后能做什么” |
| 场景 | 场景 ID、学习者身份与 AI 身份、背景、开场句;一个主场景加 2–3 个变式场景 |
| 任务 | 任务 ID、目标、引用的产出核心 ID、需要收集的信息槽、示范句;判定条件由程序根据引用编译,不由 AI 填写 |
| 产出核心 | 稳定 ID(如 `A1-U03-W01` 词、`A1-U03-P01` 词块或句型)、英文、当前义中文、CEFR-J 等级、是否场景词及理由 |
| 理解词 | ID、英文、当前义中文、等级 |
| 语法项 | CEFR-J 语法 ID、主动使用或仅理解 |
| 单元预检 | 覆盖全部产出核心的听辨与独立表达题(3.6) |
| 听读材料(A2 起) | 2–3 篇材料及理解题(第 6 节) |
| 排除项 | 考虑过但不纳入的词句及理由 |
| 评分标准(A2 起) | 开放任务的评分维度、各档描述和及格档 |
等级内全部单元冻结后,再生成该等级的出口评估蓝图和至少两套题组(覆盖每个单元的能力),冻结为等级 stageVersion(如 `A1-1.0`),锁定升级分母。之后修改已冻结的单元须新建 stageVersion 并提供旧新 ID 映射,遵循《A0 阶段标准》;已通过的记录保留原版本。
### 5.6 生成与冻结流程
```text
主题地图中的一个单元(主题 + 能做什么)
→ AI 起草单元内容包:先写场景和任务,再从中提取产出核心和理解词;理解词优先从本单元的候选词(5.4)中选
→ 程序校验(失败则带错误清单退回修复,最多 2 次,仍失败则停止并提示人工处理)
→ 独立审核(另一次 AI 调用,逐项列问题;有问题则退回修复)
→ 用户确认 → 冻结单元,随应用发布
等级内全部单元冻结
→ 生成出口评估题组 → 同样校验、审核、确认 → 冻结等级 stageVersion,启用升级评估
```
程序校验至少包括:
- ID 唯一;每个词都能在锁定数据版本中查到等级,或标为人工补充并给出理由;
- 符合 5.4 的语法、词汇、场景词和理解词上限;
- 任务引用的 ID 都存在;每个产出核心至少被一个任务和单元预检覆盖;
- 示范句与开场句只使用本单元、推荐顺序在前的单元以及 A0 的词句,专名和数字除外;
- 听读材料符合第 6 节的覆盖率要求;
- 单元覆盖的候选词不少于候选词数的 60%(候选词本身少于 20 个时不检查),未覆盖的候选词顺延;
- 冻结等级 stageVersion 时,词池覆盖率符合 5.4。
单元未冻结时显示“待提供”,不能学习。运行时 AI 只能生成表面变式(人名、地点、物品等内容值,以及措辞和句子顺序),不能增删核心项,也不能改变任务目标或判定条件。
### 5.7 决定权
| 事项 | 由谁决定 |
|---|---|
| 学哪些场景和能力 | 主题地图(5.2),目标固定为日常与旅行;修改须用户确认 |
| 单元的核心词句、理解词、语法项 | AI 从场景出发起草,按 5.4 校验,审核后由用户确认冻结 |
| 场景设定、角色、开场句、示范句 | AI 离线起草,冻结后固定 |
| 每一轮说什么 | 运行时 AI,受对话调度约束(见《AI 对话模块规格》7.3) |
| 任务是否完成 | 程序按任务引用的词句和信息槽判定;A2 起再加评审(5.8) |
| 掌握状态与复习 | 程序,按第 3 节 |
| 升级门槛 | 程序固定,见 4.1 与 4.2;AI 与内容包都不能修改 |
### 5.8 A2 及以上的开放任务判定
A2 起任务包含叙述、理由、建议等开放表达,不能只靠关键词判定:
- **程序硬性检查**:句数或长度、必需信息槽、是否用到任务要求的目标语言项、清单外词比例、是否为英文;
- **AI 评审**:按单元的评分标准逐维度给档,每一档须引用用户原句作为证据;程序核对引用确实出自用户作答,引用不符则丢弃这次评审;
- **判定**:硬性检查全部通过,且各维度达到及格档,才算完成任务;评审失败或服务不可用记为待确认,不记语言失败;
- A2 → B1 与 B1 结业的出口评估须人工复核,与 4.3 一致。
## 6. 听读输入
A0–A1 的听读输入在课程和对话里完成。从 A2 起单独安排输入,并逐级提高比例:
| 等级 | 占每日时长 | 听 | 读 | 语速与声音 |
|---|---|---|---|---|
| A2 | 约 20%20 分钟模式约 4 分钟) | 1–2 分钟的对话、通知、电话留言 | 150–250 词的消息、菜单、说明、短文 | 慢速到正常;2–3 种声音 |
| B1 | 约 35%20 分钟模式约 7 分钟) | 2–4 分钟的广播、导览、访谈式对话 | 300–500 词的评价、邮件、规则、故事 | 正常语速;多种常见口音,可加轻微背景声 |
输入时间从教学额度中划出,不额外加时。
- **材料来源**:每个单元随内容包冻结 2–3 篇;另可由 AI 在运行时按同样规则生成新篇目,只作练习。不内置未授权的真实材料。
- **程序检查**:按词次计,超出“已学产出核心 + 已学理解词 + 本单元场景词”的词不超过 2%(约 98% 的词汇覆盖才能较好理解),每个超出词附当前义释义;句长与语法不高于本等级。
- **理解题**:每篇 2–4 道(要点、细节、推断),结果只更新相关理解词的识别证据,不更新产出核心。
- **查词**:材料中查过或多次出现的词可一键加入扩展词复习(3.5)。
- **记录**:进度页显示每周听读分钟数;不设硬指标,连续两周明显低于计划时在首页提示。
## 7. 个人使用检查
不需要留存指标。每周检查以下问题即可:
- 我能否无中文提示完成本周的核心 AI 场景?
- 我能否在新场景中替换并使用上周的关键句?
- 我是否能听懂本阶段材料的主要意思,而非只会背答案?
- 我在没听清时,能否用英语请求重复、放慢或确认意思?
- 我的关键信息是否能被稳定识别,而不因口音或偶尔的识别错误被误判?
- 我是否完成了阶段出口任务?
- 若没有完成,薄弱点是听、说、读、写还是词句回忆?
检查结果只用于调整下一周的复习量、课程速度和对话难度,不用于给自己贴“学得好/不好”的标签。