Files
English/Doc/LEARNING-ENGINE-SPEC.md
T

221 lines
19 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# 学习引擎规格:每日内容、掌握判定与阶段升级
> 适用范围:个人使用的英语学习工具
> 原则:课程主线保持稳定;AI 只在明确边界内生成变式练习与对话。
M1 范围、生成与数据契约见 [开发与验收约定](M1-IMPLEMENTATION-CONTRACT.md)A0 核心清单和四技能评估见 [A0 阶段标准](A0-STAGE-STANDARD.md)。以下规则是个人学习初始规则,不是 CEFR 认证标准。
## 1. 学习体系的边界
学习路径没有预设的总课数。当前 A0 的 10 节核心课和后续生活主题只是起始内容库;系统会根据掌握状态持续提供复习、变式任务和补救微课,直到达到阶段出口能力。它们不是“掌握英语”的终点。
阶段推进不取决于“学完多少课”。核心课用于建立能力骨架;当一个阶段的出口任务、词句掌握度和真实对话表现尚未达标时,系统继续生成符合该阶段范围的新情境与练习,而不是机械跳到下一阶段。
| 阶段 | 能力目标 | 主要学习形式 |
|---|---|---|
| A0 | 问候、自我介绍、数字、身边物品、基础短句 | 短课、模仿、受控对话 |
| A1 | 点餐、购物、问路、入住、预约等固定生活任务 | 场景课程、任务型 AI 对话 |
| A2 | 讲日常、过去经历、计划、比较、建议与简单问题解决 | 更长对话、短文本、变式任务 |
| B1 | 独立处理旅行、生活及一般工作交流;表达理由与经历 | 真实慢速输入、叙事、讨论、写作 |
| B2 | 较自然处理复杂讨论、长内容和工作沟通 | 自然语速输入、观点辩护、专业主题 |
“掌握英语”应被理解为逐步达成 B1/B2 的真实交流能力,而不是背完一套课。到 B1/B2 必须加入大量真实音频、视频、阅读、自由表达与阶段性任务测评。
## 2. 每日内容生成引擎
每天不由 AI 从零随机生成一整课。系统先从固定的能力地图中选内容,再让 AI 生成符合当前水平的例句、对话变式和纠错。
### 2.1 每日组成
```text
到期复习(按时间选任务)
→ 教学段:词汇预热 → 带帮助的听说读写 → 受控对话 → 独立尝试
→ 总结与保存;未完成步骤留待续学
```
| 模块 | 来源 | 目的 | 建议用时 |
|---|---|---|---:|
| 完整教学段 | 当前能力地图 | 包含预热、听说读写、一次受控对话、独立尝试;预热不重复计时 | 合计约 10–15 分钟 |
| 其中:词汇预热 | 新词与准备词块 | 认识声音和当前句义,之后在句中应用,不再重复整套词卡 | 占教学段 1–3 分钟 |
| 其中:受控对话与独立尝试 | 已教语言 | 通常 3–5 个回答轮;结尾一轮可作为独立尝试 | 占教学段约 3–5 分钟 |
| 到期复习与补救 | 到期词句和薄弱技能 | 合并同一目标的复习与错误修复,避免重复安排 | 按每日预算 |
每日时间是安排上限,不保证每次完成整段。10 分钟:复习/补救 3 分钟、教学或续学 6 分钟、总结 1 分钟;20 分钟:5 + 14 + 130 分钟:8 + 20 + 2。30 分钟教学额度可用于慢练或可选巩固,不强制再学新段。无到期项时可将空余时间用于教学或提前结束。预热、课程内对话均包含在教学额度中,不另外叠加。只做复习的当天,独立输出可嵌入复习任务。
预热只列出当前教学段真正会遇到的新内容:通常 3–6 项,最多 8 个词汇项加 2 个理解词块;超出则先拆教学段。每项以“英文 → 音频 → 当前句义中文 → 一个短例句”呈现,并至少有一次轻量听辨或中英匹配。用户可逐项播放、查词或跳过,之后仍能进入课程;预热是降低陌生感,不是背诵考试。
预热只记录 `exposed`,不把“看过卡片”记成认识、可回忆、可使用或已掌握。实际课程和间隔复习中的独立作答才改变掌握状态。到预算边界完成当前短题后保存下一步骤,不开启长对话;可提前结束或自主继续。10 分钟不足以做完教学段时分天完成,未完成的听、说、读、写及独立尝试保持待做,不因当天结束自动结课。
### 2.2 选择规则
1. 有到期项先按时间预算选任务,不设每天 5 个词句的硬上限。将同一词句的多条到期原因合并;从最早到期和近期真实错误两个队列轮流取项(先最早到期),某队列为空则从另一队列取。收藏扩展词也按到期时间参与,保证不会长期被错题挤占。已打开的未完成会话可先恢复。
2. 选定新教学段后,若包含未预热的新增内容,先进入课前词汇预热;恢复已开始教学段时不强制重复预热,用户可从课程页主动回看。新课按阶段主线顺序进行;用户可自行回退,不可被 AI 随机跳到未准备的高难主题。
3. 优先选最近两次失败或需要提示才能完成的词句作为错误修复项。
4. AI 对话使用“本教学段 + 已学且可回忆/可使用/已掌握”的语言范围,较弱项目必须预教;额外新词每轮最多 1 个、整段最多 2 个,先说明再使用。评估不得引入额外新词。
5. 仅对有效语言失败安排补救。提示如何撤除及复习如何推进按第 3 节,不以任意两次点击答对跳过间隔检查点。
### 2.2a 复习容量与积压
“词句项”是稳定词句 ID,“复习任务”是一道题或短对话,界面分别显示任务数与覆盖词句数。一个任务可计划覆盖 1–3 个词句,但只为有直接作答证据的目标记账。例如用户独立说 `I like tea.`,可支持 tea 与 I like 的表达证据,不能同时推断会 coffee、会听懂 tea 或会提问。选择一个句义答案不自动证明其中每个词都认识。每个目标分别保存结果和技能;同一目标同日最多推进一个间隔检查点。
按任务预计用时计算积压:若待复习预计时间超过当日复习预算的 2 倍,或存在逾期至少 7 天的项,则暂停推荐新的教学段,先续学已开始内容并处理到期项;原教学额度可转为复习/补救,仍保留总结时间。积压降至预算以内且没有逾期 7 天的项后恢复新段推荐。用户可主动选新课,首页说明推荐原因;不删除积压、不偷偷提高每日时长。预测用时以实际完成耗时滚动修正。
### 2.2b 从辅助学习到独立尝试
每个教学段必须安排一次 30–90 秒的独立尝试,优先使用结尾对话的一轮或写作的一题,不额外叠加整套测试。先完成带帮助练习,再换内容值/图片/人物并隐藏句框、答案、释义和翻译;听力隐藏提问文字,阅读保留英文材料。刚看过同一句答案后立即复述只算练习,不能充当迁移证据;当日独立成功也不替代次日及后续间隔检查点。
不会时可恢复提示:该次记辅助完成,安排下一次不同任务的独立尝试,不强制当场循环。跳过记待做,时间不够则续学。只有教学步骤已完成且独立尝试已有结果(成功、辅助、有效错误或待确认)才记录教学段完成;“待确认”仍不构成掌握。各段轮换听、说、读、写;每个种子主题结束前四技能至少各有一次独立尝试机会,见课程包映射。主题可完成而能力未掌握,后者进入复习和补练。
### 2.3 AI 生成输入格式
每次请求 AI 时必须携带以下结构化信息:
```text
当前阶段:A0 / A1 / A2 / B1 / B2
当前主题与任务目标:例如“在咖啡店点饮料”
用户身份与 AI 身份
已掌握的词、句型
本教学段新词(最多 8 项)及主动句型(最多 2 项)
理解用词块(每段最多 2 个);对话额外新词(每轮 1 个、整段 2 个;评估为 0)
禁止的超纲词与复杂语法
已出现的错误与要复练的表达
目标轮次、中文辅助开关、语速
完成判定条件
```
课程生成须返回完整课程/练习结构;对话单轮须返回英文回复、信息槽、原作答证据引用、任务完成建议,以及必要时的一句中文提示和结课重说句。客户端校验后才保存和判定,不能直接采信 AI 的完成标记。结构、语义审核、一次修复和内置模板回退遵循《开发与验收约定》第 2 节。
### 2.4 随时查词
教学内容中的英文词和已定义短语均可点开查意思。查词卡按“短语优先、单词其次”显示当前句义、中文释义、示范音、慢速播放和一个当前阶段可理解的例句;用户可手动加入复习。系统不要求用户先记住再允许查,也不因为查词把学习任务判错。
AI 对话中的词条必须来自当前允许语言范围,或是事先标为可解释的新词。动态内容没有审核词条时,只能显示明确标记的临时释义,不能自动变成核心词汇、课程内容或掌握证据。离线时仅查询内置/缓存词条。
教学态的查词、翻译、字幕和提示都算帮助完成;独立练习和出口评估中默认无查词入口。用户若要查词,先切换当前题到教学态,当前题不计独立证据,随后用新题补测。该行为是帮助路径,不是语言失败。
## 3. 词汇与句型掌握模型
词汇不以“看过一次”或“答对一次”为掌握。每个词和关键句型均经历五种状态:
| 状态 | 证据 | 系统动作 |
|---|---|---|
| 新学 | 第一次在课程中出现 | 当天再次在听、读、说中出现 |
| 认识 | 能从音频/英文中选出正确意思 | 安排中文/图片到英文的回忆 |
| 可回忆 | 看中文或图片能说/写出英文 | 安排句子填空、替换和改写 |
| 可使用 | 能在新句子或 AI 对话中正确使用 | 减少提示,安排变式场景 |
| 已掌握 | 间隔后仍能独立、正确使用 | 拉长复习间隔,保留偶尔抽查 |
### 3.1 掌握的最低规则
首次教学记录为“新学”。一次有效听辨/阅读识别成功可进入“认识”;一次无答案提示的说/写回忆成功可进入“可回忆”;在不同于教学原题的场景中无提示正确使用可进入“可使用”。升级必须保留前序的识别和回忆证据,不因一次对话跳过。
一个词或句型只有同时满足下列条件,才能标记为“已掌握”:
- 完成四个间隔复习检查点,每个检查点至少一次独立成功;正常计划为该词句首次完成正式教学后第 1、3、7、14 天。
- 有效证据覆盖听辨、回忆表达、情境使用三类任务;最近两次有效作答均无提示成功。
- 至少一次在不同情境中无句框主动使用;带“合理提示”完成仅算练习,不算该迁移证据。
每个词句单独保存首次正式教学日期:已获得释义/示范并提交至少一次该项应用练习(可带帮助,不要求答对)时登记,只登记一次;不等待整课或主题完成。仅看预热、查词或跳过教学不触发;主动收藏可以创建独立的待学提醒,但不启动四个掌握检查点。若该项当天有真实错误,补救与次日复习合并。
按本地日期排复习,正常四次成功的间隔为 1、2、4、7 天。逾期不补造结果:完成当前检查点后,下一检查点从实际完成日期按后续间隔安排,每天同一项最多推进一个检查点;漏学不清空历史。第四次后按 30 天抽查。提示后答对保持当前检查点,次日换题独立复测,不计失败。遗忘处理按下一节,不因单次错误清空历史或四个检查点。
每次作答区分独立成功、带帮助完成、语言错误、待确认和技术失败。记录听/说/读/写、提示、翻译、字幕、输入与转写修改状态;看答案后复述、同题立即重做不算独立间隔或迁移证据。文字可支持词句回忆/使用,但不能补齐口语证据;看字幕或翻译不能补齐独立听力。反馈来源为转写不确定或服务异常时,不进入失败计数。
例如 `coffee` 的掌握证据不只是知道中文意思;还应能听懂它、看到图片说出它,并在点餐中说出 `Id like a coffee, please.`
### 3.2 失败处理
- 一次有效语言失败:保留原状态和检查点,标记“需复核”,次日先换题无提示复核;需要时再提供示范。需复核项暂不计入首次阶段通过的词句门槛,但不撤销已取得的阶段通过记录。技术失败或 uncertain 不计语言失败。
- 复核成功:清除需复核标记。尚未掌握的词句按原检查点继续(满足到期时间与独立成功要求时可推进);原已掌握项 7 天后再抽查一次,成功后回到 30 天抽查。复核期间的辅助完成不清除标记,也不计第二次失败。
- 同一词句在不同任务的两次独立尝试均有语言失败,且中间没有独立成功:做简短识别/回忆/应用诊断,按最高仍有复测证据的能力回到“新学/认识/可回忆/可使用”;诊断不确定时保留需复核,不猜测。原检查点退回一个(最低为 0),保留全部历史,只补该点及后续间隔,不要求统一重走四次。
- 退回检查点后次日换题复核,成功补回一个检查点,再按后续 2/4/7 天间隔推进;从第 4 点退至第 3 点者补回第 4 点后,7 天再抽查一次,成功才恢复已掌握。恢复已掌握仍须满足三类任务覆盖、迁移与最近两次独立成功。
- 连续三次有效语言失败:插入约 2 分钟补救,使用当天复习/教学预算,不额外加时,并暂停该能力的新内容。计数只看有效独立作答,技术问题、求助和立即模仿均不累计。
### 3.3 可理解沟通标准
发音和听力的目标不是获得英音、美音或笼统的“发音分数”,而是在当前阶段的真实任务中稳定互相理解。
| 能力 | 达标定义 | 不作为判错依据 |
|---|---|---|
| 口语可理解度 | 听者能稳定识别姓名、地点、数字、需求、问题等关键信息,并完成任务 | 地区口音、轻微重音差异、与示范音不完全一致 |
| 听力可理解度 | 能听出场景中的主要意思和关键细节,并作出合适回应 | 第一次就听懂所有口音、所有自然语速材料 |
| 沟通补救 | 没听清时能请求重复、放慢或确认意思 | 不能一次听懂就视为失败 |
听力材料按以下难度推进:
```text
清晰慢速英语
→ 正常语速的清晰英语
→ 不同说话人和常见口音
→ 有少量背景声的真实情境
```
每个阶段都应教并练习沟通补救句:`Could you say that again?``Please speak slowly.``Do you mean ...?`。这类句子本身是听力能力的一部分。
### 3.4 发音反馈规则
| 识别到的情况 | 系统动作 |
|---|---|
| 语音识别可信度低、无可靠置信度或用户提出异议 | 显示转写并让用户确认、修改或重说;不记录为英语错误 |
| 有口音但表达可理解 | 接受答案;最多提供可选提示,不强制纠正 |
| 同一词反复被 ASR 错误转写 | 先排查噪声和识别问题;可提供用户自选通用练习,不据此诊断音素或降低掌握度 |
| 句子结构或词汇有误 | 作为表达错误反馈;不归为发音错误 |
一次反馈只处理一个点。`three/free` 可作为通用听辨、示范和回听练习,但界面须说明“识别可能有误,这不是发音诊断”。文字 AI 没有音频证据时不能断言用户把 /θ/ 发成 /f/;个性化音素诊断不在 M1。未编辑且确认的转写仅是受控口语的代理证据,不等于真人可理解度保证。
## 4. 阶段升级规则
已完成课数只用于回顾学习历史,不能决定升级。可以提前参加评估或延后升级,但只有门槛全部满足才记录阶段通过,不能手动跳级。入门轻量定位只推荐当前阶段内的教学起点,不替代出口评估。下一阶段内容未就绪时显示待提供,不自动生成未定义的主线。
### 4.1 A0 → A1
唯一执行标准见《A0 阶段标准》:固定 60 项核心分母,至少 48 项可使用或已掌握,其中至少 30 项已掌握;两次不同题组的听说读写评估分别通过,间隔至少 24 小时,最近一次在 30 天内。每项必需能力都要有证据,不以总平均分掩盖口语或听力缺口。
初次见面对话只是口语评估的一部分,还须验证姓名拼读、数字、物品、家人、星期/整点及沟通补救;阅读和写作单独评估。带提示、修改转写或识别失败的处理按标准执行。未通过则定向补练与换题复测,不限制追加课程数量。
### 4.2 A1 → A2
以下为 M2 的能力方向,尚不是可直接启用的 A1 自动升级规则。启用 A1 前须另行冻结核心清单、四技能题组和阈值;未冻结前禁用 A1→A2 自动升级:
- 能在点餐、购物、问路、交通、酒店等 8–10 个场景中完成目标;
- 能听懂慢速日常对话的主要信息;
- 能写 46 句连贯的短消息;
- 能完成约 3 分钟任务型 AI 对话;
- 能表达一个过去经历和一个简单计划;
- A1 的核心词句门槛以未来有版本的 A1 标准为准,不复用未定义分母的“约 80%”。
**出口任务**:完成一次旅行日:入住酒店、询问路线、点餐并处理一个简单问题。
### 4.3 A2 → B1、B1 → B2
| 升级 | 出口能力 | 建议任务 |
|---|---|---|
| A2 → B1 | 能讲经历、说明理由、处理多数日常突发情况 | 听 2–3 分钟慢速素材后复述;完成 5 分钟旅行问题解决对话;写一封短邮件 |
| B1 → B2 | 能理解自然语速主要内容、清楚支持观点、处理工作沟通 | 阅读/收听真实材料后总结和讨论;完成 10 分钟工作情境模拟;写结构化说明或意见 |
这两个阶段必须人工或通过高质量任务评估复核,不应只靠选择题自动升级。
## 5. 长期内容扩展
| 目标 | 新增内容 | 不可缺少的练习 |
|---|---|---|
| A2 | 过去时、将来计划、比较、建议、情绪、关系、问题解决 | 1–3 分钟叙述、短消息、生活变式对话 |
| B1 | 旅行问题、工作日常、观点与理由、故事复述 | 慢速真实音频/视频、段落写作、5 分钟讨论 |
| B2 | 复杂观点、会议、协商、跨文化表达、专业主题 | 自然语速材料、总结、辩护观点、10 分钟任务模拟 |
系统要成为从零到 B1/B2 的骨架,必须逐阶段增加“可理解输入”和“开放输出”的比例:A0/A1 以受控短句为主;A2 开始加入短文本和变式表达;B1/B2 以真实材料、观点表达、长对话和写作为主。
## 6. 个人使用检查
不需要留存指标。每周检查以下问题即可:
- 我能否无中文提示完成本周的核心 AI 场景?
- 我能否在新场景中替换并使用上周的关键句?
- 我是否能听懂本阶段材料的主要意思,而非只会背答案?
- 我在没听清时,能否用英语请求重复、放慢或确认意思?
- 我的关键信息是否能被稳定识别,而不因口音或偶尔的识别错误被误判?
- 我是否完成了阶段出口任务?
- 若没有完成,薄弱点是听、说、读、写还是词句回忆?
检查结果只用于调整下一周的复习量、课程速度和对话难度,不用于给自己贴“学得好/不好”的标签。