Files
English/Doc/LEARNING-ENGINE-SPEC.md
T
shenleiandClaude Opus 4.8 febfd30f49 feat: A1 短材料复现本单元理解词,并加入黑夜模式
课程内容
- 重写全部 21 个 A1 单元的听读材料,把本单元理解词织进听/读文本,
  单元内理解词复现率从约 20% 提升到约 77%(各单元 56–96%)。
- 修正 U01 房间号与机场大巴同为 thirty 的撞车(改为 17/30/40)。
- 校验器容差按级别读取(A1 为 8%),materials 覆盖率、字数、
  选项子串等校验全部通过;course_content_test 通过。

黑夜模式
- app_theme 拆分明/暗两套调色板,AppColors 随亮度切换;
  main 用 theme/darkTheme/themeMode + builder 镜像已解析亮度;
  主题偏好持久化到快照;进度页新增“外观主题”切换。

文档
- COURSE-PACK-JSON.md 更新 A1 词池覆盖(840/933)与材料复现约定。

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-09-18 11:16:09 +09:00

43 KiB
Raw Blame History

学习引擎规格:每日内容、掌握判定与阶段升级

适用范围:个人使用的英语学习工具
原则:学习目标固定为日常生活与旅行,主线终点为 B1;课程主线由主题地图和冻结的单元内容包决定并保持稳定。目标决定学哪些场景,分级数据决定难度上限,AI 决定场景怎么演,程序决定怎样算完成。AI 只在明确边界内生成变式练习与对话。

M1 范围、生成与数据契约见 开发与验收约定A0 核心清单和四技能评估见 A0 阶段标准。以下规则是个人学习初始规则,不是 CEFR 认证标准。

1. 学习体系的边界

学习目标固定为日常生活与旅行,不提供目标选择。主线终点是 B1:CEFR 对 B1 的描述正是能应对在英语地区旅行时遇到的大多数情况,并能谈论熟悉的日常话题。B2 作为可选扩展,B1 通过后再规划。

不安排学校与学术场景,这类词汇不进入词池(5.4)。工作需求后续作为独立主题线增加:届时在主题地图中新增工作单元,使用 5.4 中预留的工作类词汇,不改变日常与旅行主线的单元和门槛;是否提供目标选择届时再定。

学习路径没有预设的总课数。A0 的 10 节核心课和第 5 节主题地图中的单元是主线内容;系统会根据掌握状态持续提供复习、变式任务和补救微课,直到达到阶段出口能力。它们不是“掌握英语”的终点。

阶段推进不取决于“学完多少课”。核心课用于建立能力骨架;当一个阶段的出口任务、词句掌握度和真实对话表现尚未达标时,系统继续生成符合该阶段范围的新情境与练习,而不是机械跳到下一阶段。

阶段 能力目标 主要学习形式
A0 问候、自我介绍、数字、身边物品、基础短句 短课、模仿、受控对话
A1 点餐、购物、问路、交通、入住、看病等固定的生活与旅行互动 主题单元、任务型 AI 对话
A2 讲经历、做预订与改期、比较选择、处理行程和住宿中的小问题 主题单元、较长对话、分级听读
B1 独立应对旅行和生活中的大多数情况:突发问题、投诉协商、说明理由、讲完整经历 主题单元、较长听读材料、叙事、讨论、写作
B2(可选) 自然语速的生活与旅行内容、复杂协商和讨论 B1 通过后再规划

本工具说的“学会英语”,指达到 B1 的日常与旅行交流能力,而不是背完一套课。从 A2 起须逐步加大听读输入(第 6 节)。

时间预期:剑桥英语给出的累计指导学时参考为 A2 约 180–200 小时、B1 约 350400 小时、B2 约 500–600 小时。每天 20 分钟约合每年 120 小时,大致对应 A2 约 1.5 年、B1 约 3 年;30 分钟模式约 2 年到 B1。这只用于设定预期,不作为进度要求或解锁条件。

2. 每日内容生成引擎

每天不由 AI 从零随机生成一整课。系统先从固定的能力地图(主题地图与已冻结的单元内容包,见第 5 节)中选内容,再让 AI 生成符合当前水平的例句、对话变式和纠错。

2.1 每日组成

到期复习(按时间选任务)
    → 教学段:词汇预热 → 带帮助的听说读写 → 受控对话 → 独立尝试
    → (A2 起)听读输入
    → 总结与保存;未完成步骤留待续学
模块 来源 目的 建议用时
完整教学段 当前能力地图 包含预热、听说读写、一次受控对话、独立尝试;预热不重复计时 合计约 1015 分钟
其中:词汇预热 新词与准备词块 认识声音和当前句义,之后在句中应用,不再重复整套词卡 占教学段 13 分钟
其中:受控对话与独立尝试 已教语言 通常 3–5 个回答轮;结尾一轮可作为独立尝试 占教学段约 35 分钟
到期复习与补救 到期词句和薄弱技能 合并同一目标的复习与错误修复,避免重复安排 按每日预算
听读输入(A2 起) 当前单元的分级材料 积累可理解输入 从教学额度中划出:A2 约 20%,B1 约 35%(第 6 节)

每日时间是安排上限,不保证每次完成整段。10 分钟:复习/补救 3 分钟、教学或续学 6 分钟、总结 1 分钟;20 分钟:5 + 14 + 130 分钟:8 + 20 + 2。30 分钟教学额度可用于慢练或可选巩固,不强制再学新段。无到期项时可将空余时间用于教学或提前结束。预热、课程内对话均包含在教学额度中,不另外叠加。只做复习的当天,独立输出可嵌入复习任务。

预热只列出当前教学段真正会遇到的新内容:通常 3–6 项,最多 8 个词汇项加 2 个理解词块;超出则先拆教学段。每项以“英文 → 音频 → 当前句义中文 → 一个短例句”呈现,并至少有一次轻量听辨或中英匹配。用户可逐项播放、查词或跳过,之后仍能进入课程;预热是降低陌生感,不是背诵考试。

预热只记录 exposed,不把“看过卡片”记成认识、可回忆、可使用或已掌握。实际课程和间隔复习中的独立作答才改变掌握状态。到预算边界完成当前短题后保存下一步骤,不开启长对话;可提前结束或自主继续。10 分钟不足以做完教学段时分天完成,未完成的听、说、读、写及独立尝试保持待做,不因当天结束自动结课。

2.2 选择规则

  1. 有到期项先按时间预算选任务,不设每天 5 个词句的硬上限。将同一词句的多条到期原因合并;从最早到期和近期真实错误两个队列轮流取项(先最早到期),某队列为空则从另一队列取。收藏扩展词也按到期时间参与,保证不会长期被错题挤占。已打开的未完成会话可先恢复。
  2. 选定新教学段后,若包含未预热的新增内容,先进入课前词汇预热;恢复已开始教学段时不强制重复预热,用户可从课程页主动回看。新课按阶段主线顺序进行;用户可自行回退,不可被 AI 随机跳到未准备的高难主题。
  3. 优先选最近两次失败或需要提示才能完成的词句作为错误修复项。
  4. AI 对话使用“本教学段 + 已学且可回忆/可使用/已掌握”的语言范围,较弱项目必须预教;额外新词每轮最多 1 个、整段最多 2 个,先说明再使用。评估不得引入额外新词。
  5. 仅对有效语言失败安排补救。提示如何撤除及复习如何推进按第 3 节,不以任意两次点击答对跳过间隔检查点。

2.2a 复习容量与积压

“词句项”是稳定词句 ID,“复习任务”是一道题或短对话,界面分别显示任务数与覆盖词句数。一个任务可计划覆盖 1–3 个词句,但只为有直接作答证据的目标记账。例如用户独立说 I like tea.,可支持 tea 与 I like 的表达证据,不能同时推断会 coffee、会听懂 tea 或会提问。选择一个句义答案不自动证明其中每个词都认识。每个目标分别保存结果和技能;同一目标同日最多推进一个间隔检查点。

按任务预计用时计算积压:若待复习预计时间超过当日复习预算的 2 倍,或存在逾期至少 7 天的项,则暂停推荐新的教学段,先续学已开始内容并处理到期项;原教学额度可转为复习/补救,仍保留总结时间。积压降至预算以内且没有逾期 7 天的项后恢复新段推荐。用户可主动选新课,首页说明推荐原因;不删除积压、不偷偷提高每日时长。预测用时以实际完成耗时滚动修正。

2.2b 从辅助学习到独立尝试

每个教学段必须安排一次 30–90 秒的独立尝试,优先使用结尾对话的一轮或写作的一题,不额外叠加整套测试。先完成带帮助练习,再换内容值/图片/人物并隐藏句框、答案、释义和翻译;听力隐藏提问文字,阅读保留英文材料。刚看过同一句答案后立即复述只算练习,不能充当迁移证据;当日独立成功也不替代次日及后续间隔检查点。

不会时可恢复提示:该次记辅助完成,安排下一次不同任务的独立尝试,不强制当场循环。跳过记待做,时间不够则续学。只有教学步骤已完成且独立尝试已有结果(成功、辅助、有效错误或待确认)才记录教学段完成;“待确认”仍不构成掌握。各段轮换听、说、读、写;每个种子主题结束前四技能至少各有一次独立尝试机会,见课程包映射。主题可完成而能力未掌握,后者进入复习和补练。

2.3 AI 生成输入格式

每次请求 AI 时必须携带以下结构化信息:

当前阶段:A0 / A1 / A2 / B1 / B2
当前单元与任务:单元 ID、场景 ID、任务 ID、任务目标(例如“在咖啡店点饮料”)及任务引用的核心词句 ID
用户身份与 AI 身份
已掌握的词、句型
本教学段新词(最多 8 项)及主动句型(最多 2 项)
理解用词块(每段最多 2 个);对话额外新词(每轮 1 个、整段 2 个;评估为 0)
禁止的超纲词与复杂语法
已出现的错误与要复练的表达
目标轮次、中文辅助开关、语速
完成判定条件

课程生成须返回完整课程/练习结构;对话单轮须返回英文回复、信息槽、原作答证据引用、任务完成建议,以及必要时的一句中文提示和结课重说句。客户端校验后才保存和判定,不能直接采信 AI 的完成标记。结构、语义审核、一次修复和内置模板回退遵循《开发与验收约定》第 2 节。

2.4 随时查词

教学内容中的英文词和已定义短语均可点开查意思。查词卡按“短语优先、单词其次”显示当前句义、中文释义、示范音、慢速播放和一个当前阶段可理解的例句;用户可手动加入复习。系统不要求用户先记住再允许查,也不因为查词把学习任务判错。

AI 对话中的词条必须来自当前允许语言范围,或是事先标为可解释的新词。动态内容没有审核词条时,只能显示明确标记的临时释义,不能自动变成核心词汇、课程内容或掌握证据。离线时仅查询内置/缓存词条。

教学态的查词、翻译、字幕和提示都算帮助完成;独立练习和出口评估中默认无查词入口。用户若要查词,先切换当前题到教学态,当前题不计独立证据,随后用新题补测。该行为是帮助路径,不是语言失败。

3. 词汇与句型掌握模型

词汇不以“看过一次”或“答对一次”为掌握。词汇分为“会用”的产出核心和“会认”的理解词两层(见 3.5);本节五种状态与掌握规则适用于产出核心,每个词和关键句型均经历五种状态:

状态 证据 系统动作
新学 第一次在课程中出现 当天再次在听、读、说中出现
认识 能从音频/英文中选出正确意思 安排中文/图片到英文的回忆
可回忆 看中文或图片能说/写出英文 安排句子填空、替换和改写
可使用 能在新句子或 AI 对话中正确使用 减少提示,安排变式场景
已掌握 间隔后仍能独立、正确使用 拉长复习间隔,保留偶尔抽查

3.1 掌握的最低规则

首次教学记录为“新学”。一次有效听辨/阅读识别成功可进入“认识”;一次无答案提示的说/写回忆成功可进入“可回忆”;在不同于教学原题的场景中无提示正确使用可进入“可使用”。升级必须保留前序的识别和回忆证据,不因一次对话跳过。

一个词或句型只有同时满足下列条件,才能标记为“已掌握”:

  • 完成四个间隔复习检查点,每个检查点至少一次独立成功;正常计划为该词句首次完成正式教学后第 1、3、7、14 天。
  • 有效证据覆盖听辨、回忆表达、情境使用三类任务;最近两次有效作答均无提示成功。
  • 至少一次在不同情境中无句框主动使用;带“合理提示”完成仅算练习,不算该迁移证据。

每个词句单独保存首次正式教学日期:已获得释义/示范并提交至少一次该项应用练习(可带帮助,不要求答对)时登记,只登记一次;不等待整课或主题完成。仅看预热、查词或跳过教学不触发;主动收藏可以创建独立的待学提醒,但不启动四个掌握检查点。若该项当天有真实错误,补救与次日复习合并。

按本地日期排复习,正常四次成功的间隔为 1、2、4、7 天。逾期不补造结果:完成当前检查点后,下一检查点从实际完成日期按后续间隔安排,每天同一项最多推进一个检查点;漏学不清空历史。第四次后按 30 天抽查。提示后答对保持当前检查点,次日换题独立复测,不计失败。遗忘处理按下一节,不因单次错误清空历史或四个检查点。

每次作答区分独立成功、带帮助完成、语言错误、待确认和技术失败。记录听/说/读/写、提示、翻译、字幕、输入与转写修改状态;看答案后复述、同题立即重做不算独立间隔或迁移证据。文字可支持词句回忆/使用,但不能补齐口语证据;看字幕或翻译不能补齐独立听力。反馈来源为转写不确定或服务异常时,不进入失败计数。

例如 coffee 的掌握证据不只是知道中文意思;还应能听懂它、看到图片说出它,并在点餐中说出 Id like a coffee, please.

3.2 失败处理

  • 一次有效语言失败:保留原状态和检查点,标记“需复核”,次日先换题无提示复核;需要时再提供示范。需复核项暂不计入首次阶段通过的词句门槛,但不撤销已取得的阶段通过记录。技术失败或 uncertain 不计语言失败。
  • 复核成功:清除需复核标记。尚未掌握的词句按原检查点继续(满足到期时间与独立成功要求时可推进);原已掌握项 7 天后再抽查一次,成功后回到 30 天抽查。复核期间的辅助完成不清除标记,也不计第二次失败。
  • 同一词句在不同任务的两次独立尝试均有语言失败,且中间没有独立成功:做简短识别/回忆/应用诊断,按最高仍有复测证据的能力回到“新学/认识/可回忆/可使用”;诊断不确定时保留需复核,不猜测。原检查点退回一个(最低为 0),保留全部历史,只补该点及后续间隔,不要求统一重走四次。
  • 退回检查点后次日换题复核,成功补回一个检查点,再按后续 2/4/7 天间隔推进;从第 4 点退至第 3 点者补回第 4 点后,7 天再抽查一次,成功才恢复已掌握。恢复已掌握仍须满足三类任务覆盖、迁移与最近两次独立成功。
  • 连续三次有效语言失败:插入约 2 分钟补救,使用当天复习/教学预算,不额外加时,并暂停该能力的新内容。计数只看有效独立作答,技术问题、求助和立即模仿均不累计。

3.3 可理解沟通标准

发音和听力的目标不是获得英音、美音或笼统的“发音分数”,而是在当前阶段的真实任务中稳定互相理解。

能力 达标定义 不作为判错依据
口语可理解度 听者能稳定识别姓名、地点、数字、需求、问题等关键信息,并完成任务 地区口音、轻微重音差异、与示范音不完全一致
听力可理解度 能听出场景中的主要意思和关键细节,并作出合适回应 第一次就听懂所有口音、所有自然语速材料
沟通补救 没听清时能请求重复、放慢或确认意思 不能一次听懂就视为失败

听力材料按以下难度推进:

清晰慢速英语
    → 正常语速的清晰英语
    → 不同说话人和常见口音
    → 有少量背景声的真实情境

每个阶段都应教并练习沟通补救句:Could you say that again?Please speak slowly.Do you mean ...?。这类句子本身是听力能力的一部分。

3.4 发音反馈规则

识别到的情况 系统动作
语音识别可信度低、无可靠置信度或用户提出异议 显示转写并让用户确认、修改或重说;不记录为英语错误
有口音但表达可理解 接受答案;最多提供可选提示,不强制纠正
同一词反复被 ASR 错误转写 先排查噪声和识别问题;可提供用户自选通用练习,不据此诊断音素或降低掌握度
句子结构或词汇有误 作为表达错误反馈;不归为发音错误

一次反馈只处理一个点。three/free 可作为通用听辨、示范和回听练习,但界面须说明“识别可能有误,这不是发音诊断”。文字 AI 没有音频证据时不能断言用户把 /θ/ 发成 /f/;个性化音素诊断不在 M1。未编辑且确认的转写仅是受控口语的代理证据,不等于真人可理解度保证。

3.5 两层词汇:会用与会认

范围 状态 是否计入升级分母
产出核心(会用) 单元内容包中需要主动说、写的词、词块和句型;每单元 10–15 项 3.13.2 的五种状态和掌握规则 计入
理解词(会认) 听懂、看懂即可的词;每单元 A1 20–35 项、A2 3050 项、B1 5080 项 新学 → 认识 → 熟悉 不逐项计入;升级时抽查(4.2
扩展词 听读材料中查过或多次出现、由用户加入复习的词 同理解词 不计入,也不参与升级抽查

学习流程:单词不单独背,跟着单元场景学。

  1. 会用的词:预热(只记“见过”)→ 在场景句中听辨 → 说、读、写的替换练习 → 受控对话中用出来 → 独立尝试 → 按 3.1 间隔复习,每次复习换语境(如从地铁站换到火车站)。
  2. 会认的词:不进预热,直接出现在教学段的听读材料里,首次出现可点开释义;教学段结束时做 2–3 道快速识别题,之后按下述理解词规则复习。
  3. 各等级侧重:A1 以具体名词和固定说法为主,用图片和替换练习;A2 增加词块、搭配和词形变化(如 book a tablemiss the bus、过去式);B1 的新词主要来自听读材料和查词,增加词族和近义词辨析(如 complain/complaint),并练习用英语解释词义。

识别题要求(两层词的“认识”证据,以及理解词和扩展词的全部证据):

  • 至少一次在句子或场景语境中答对;孤立的中英互译不能作为唯一证据。
  • 干扰项取同单元或意思相近的词(如 ticketreceiptmenu),不用明显无关的词。
  • 提供“不认识”选项:选它不算语言失败,转为教学并换题补测。
  • 记录作答用时:听辨题超过约 10 秒、阅读识别题超过约 15 秒,记为带帮助完成,不算独立成功。
  • 理解词只考“听或读 → 意思”,不考拼写,也不要求说出。

理解词规则:

  • 一次独立的听辨或阅读识别成功进入“认识”;至少间隔 7 天后,换题、换语境再次独立识别成功,进入“熟悉”,之后每 30 天抽查。
  • 识别失败回到“认识”,次日换题复核;不做诊断降级。
  • 复习以 5–10 秒的快速识别题为主,可以成组出现,占复习预算不超过三分之一。
  • 在听读材料中答对与某个理解词直接相关的理解题,可计一次该词的识别证据。
  • 后续单元把某个理解词列为产出核心时,保留已有识别证据,从“认识”开始走完整掌握流程。

A0 的准备/辅助材料沿用《A0 阶段标准》,不套用本节。

3.6 免学与定级

已经会的内容不必重学,但“会”需要证据:

  • 单元预检:进入单元时可选做一次不超过 3 分钟的预检,在单元场景里考听辨和独立表达(说或写)。某项产出核心两类题都独立答对,记为“免学待确认”,教学段中跳过其讲解;至少 3 天后换题独立复测一次,成功即记为已掌握并进入 30 天抽查,失败则按新项正常教学。理解词预检识别正确直接记为“熟悉”。预检答错不计语言失败。
  • 入门定级:“完全零基础”从 A0 开始。“有一些基础”或“能简单对话”可做定级评估:依次使用各等级已冻结的出口题组中的一套(先 A0,通过后再 A1……),在第一个未通过的等级停止,从该等级开始学习。某等级题组尚未冻结时,定级最多只到该等级。
  • 定级通过:定级跳过的等级记为“定级通过”,与“阶段通过”分开保存;14 天内再通过该等级的另一套题组才算确认。未确认时首页建议回到该等级,但不强制。
  • 定级免学:跳过等级的产出核心不走四个检查点,每天从复习预算中最多抽 5 项独立复测;失败项转为需复核并安排补救。跳过的等级不参与后续等级的门槛计算。

4. 阶段升级规则

已完成课数只用于回顾学习历史,不能决定升级。可以提前参加评估或延后升级,但只有门槛全部满足才记录阶段通过,不能手动跳级。入门轻量定位只推荐起点,定级跳过等级须按 3.6 用出口题组证明。下一等级尚无已冻结的单元时显示待提供,不在运行时临时生成主线;单元内容包按第 5 节离线生成、校验、审核并经用户确认冻结后才可学习。

4.1 A0 → A1

唯一执行标准见《A0 阶段标准》:固定 60 项核心分母,至少 48 项可使用或已掌握,其中至少 30 项已掌握;两次不同题组的听说读写评估分别通过,间隔至少 24 小时,最近一次在 30 天内。每项必需能力都要有证据,不以总平均分掩盖口语或听力缺口。

初次见面对话只是口语评估的一部分,还须验证姓名拼读、数字、物品、家人、星期/整点及沟通补救;阅读和写作单独评估。带提示、修改转写或识别失败的处理按标准执行。未通过则定向补练与换题复测,不限制追加课程数量。

4.2 A1 及以上的升级门槛

门槛只设在等级之间,单元之间不设门槛(见 5.1)。从 A1 起,进入下一等级须同时满足:

  1. 本等级产出核心(全部单元之和,等级 stageVersion 冻结的分母)中至少 80% 为可使用或已掌握,其中至少 50% 为已掌握;需复核项的处理同《A0 阶段标准》;
  2. 理解词抽查:从本等级已教的理解词中随机抽 30 项做听或读的识别,独立答对至少 24 项;
  3. 两套不同题组的四技能评估分别通过,间隔至少 24 小时,最近一次在 30 天内;
  4. 完成本等级的出口任务(4.3)。

本等级的单元未全部冻结前,只能学习已冻结的单元,升级评估不可用。比例由程序固定,内容包不能修改。

4.3 出口任务

升级 出口能力 出口任务
A1 → A2 在点餐、购物、问路、交通、住宿、看病等场景中完成固定互动;能写 3–5 句短消息 旅行日:入住酒店、询问路线、点餐并处理一个简单问题(约 3 分钟对话);写一条告诉朋友当天安排的消息
A2 → B1 讲经历,做预订和改期,比较选择,处理行程和住宿中的小问题 行程变化日:电话改订并当面解决一个住宿问题(约 5 分钟对话);听 1–2 分钟通知后说出要点;写 4–6 句消息讲当天发生了什么
B1 结业(B2 可选) 独立应对旅行和生活中的大多数情况,说明经过和理由 听 2–3 分钟广播或导览后复述;5 分钟旅途突发问题的解决与协商对话;写一封说明问题并提出要求的邮件

A2 起的出口任务按 5.8 判定;A2 → B1 与 B1 结业须人工或通过高质量任务评估复核,不应只靠选择题自动升级。

5. 学习路线与单元内容包

目标决定学哪些场景,分级数据决定难度上限,AI 决定场景怎么演,程序决定怎样算完成。 学习目标固定为日常生活与旅行;主题地图(5.2)列出每个等级要完成的生活和旅行任务;AI 从场景出发起草单元内容,再用分级数据检查难度;程序校验、编译判定条件并执行门槛。单元冻结后,运行时 AI 不能再改变它。

5.1 路线结构

等级(A0 / A1 / A2 / B1)
    → 主题单元(一组相关的生活或旅行任务)
        → 教学段(沿用第 2 节,每段约 10–15 分钟)
            → 场景与任务(单元主场景 + 2–3 个变式场景)
  • 单元是冻结和学习的基本单位:某个单元冻结后即可学习,不必等整个等级。
  • 单元之间不设门槛:完成单元的教学段并尝试过单元任务后,即可进入下一单元;掌握在复习中继续推进。积压时按 2.2a 暂停推荐新单元。
  • 推荐顺序按依赖排列(如价格先于购物、日期先于预订、问路先于交通)。用户可以自选单元;跳到后面的单元时,前面单元中被引用的词句作为预热新项先教。
  • 单元规模:产出核心 10–15 项(词、词块、句型);理解词 A1 20–35 项、A2 4065 项、B1 70–110 项(两层词汇见 3.5)。三个等级的数量都已按词池和起草结果调整(5.4),以 course-map.json 为准。

5.2 主题地图

A0 保持现有 10 节核心课(见《A0 初始核心课程包》)。A1 起的单元如下,机器可读版本是 kouyu_english/assets/courses/course-map.json,单元内容包格式见《课程内容包 JSON 格式》(COURSE-PACK-JSON.md)。A1 按词池试建结果补了“家人与住处”“描述人和感受”,把“开口求助与数字”放在最前,并按依赖调整了顺序(如问路先于打车、公交)。“类别”表示该单元主要服务日常还是旅行。修改主题地图(增删、合并或调整单元)须用户确认;已冻结单元的 ID 不复用。

A1:固定的生活与旅行互动

单元 主题 类别 单元结束后能做什么
A1-U01 开口求助与数字 旅行/日常 没听懂时礼貌求助,说 11–100 的数字,拼读字母
A1-U02 价格与付款 日常/旅行 问价、说 100 以内的金额、选择现金或刷卡
A1-U03 在咖啡店点单 日常 点饮料、说大小杯、礼貌确认
A1-U04 问路 旅行 问地点、听懂左右和距离
A1-U05 在餐厅点餐 日常/旅行 点餐、问推荐、要账单
A1-U06 家人与住处 日常 介绍家人,说住在哪里和家里有什么
A1-U07 公交与地铁 旅行 买票、问站点、确认下车
A1-U08 超市与便利店 日常 找商品、说数量
A1-U09 描述人和感受 日常 说一个人的外貌和性格,说自己的心情
A1-U10 打车 旅行 说目的地、确认价格或路线
A1-U11 我的一天 日常 说作息和常做的事
A1-U12 买衣服 日常 问尺码和颜色、试穿
A1-U13 日期与约时间 日常 说日期、约见面、改时间
A1-U14 在机场 旅行 值机、问登机口、回答入境的简单问题
A1-U15 入住酒店 旅行 说明预订信息、办理入住
A1-U16 天气与穿着 日常/旅行 问天气、说该穿什么
A1-U17 酒店里的需求 旅行 要物品、报告简单问题
A1-U18 药店与不舒服 日常/旅行 说一个症状、听懂基本建议
A1-U19 遇到麻烦时求助 日常/旅行 说明遇到的麻烦、请求帮忙、感谢与回应
A1-U20 打电话与留言 日常 留下姓名、号码和简短信息
A1-U21 周末计划 日常 说将要做的事、邀请朋友

A2:讲经历、做安排、处理小问题

单元 主题 类别 单元结束后能做什么
A2-U01 上个周末 日常 用过去时讲做了什么
A2-U02 上一次旅行 旅行 讲去了哪里、怎么样、感受如何
A2-U03 预订酒店与餐厅 旅行 电话或当面预订:日期、人数、要求
A2-U04 改期与取消 日常/旅行 说明原因、提出新时间
A2-U05 餐厅里的问题 旅行 说明忌口或过敏、菜品有问题、分开结账
A2-U06 比较与选择 日常/旅行 比较商品、房间或路线并做选择
A2-U07 退换货 日常 说明问题、要求退换
A2-U08 行程出问题 旅行 误车、延误、换乘、改票
A2-U09 住宿里的问题 旅行 报修、换房、提出要求
A2-U10 看病 日常/旅行 说症状和持续时间、听懂用药说明
A2-U11 聊兴趣与家乡 日常 围绕一个话题连续聊几轮
A2-U12 建议与意见 日常/旅行 给建议、征求意见
A2-U13 介绍城市与景点 旅行 描述地方、推荐去处
A2-U14 丢东西与求助 旅行 在服务台说明丢了什么、在哪里丢的
A2-U15 消息与短邮件 日常 写邀请、感谢、说明迟到

B1:独立应对大多数情况

单元 主题 类别 单元结束后能做什么
B1-U01 讲一段完整的旅行经历 旅行 按顺序叙述,加入背景和感受
B1-U02 规划行程 旅行 比较交通和住宿方案,说明理由和预算
B1-U03 入境与行李 旅行 回答入境问题,报告行李延误或丢失
B1-U04 听懂广播与讲解 旅行 抓住车站、机场广播和导览讲解的要点
B1-U05 紧急情况 旅行 证件或钱包丢失、报警、求助
B1-U06 就医 日常/旅行 说明症状变化和病史,理解医嘱要点
B1-U07 投诉与协商 日常/旅行 要求退款或补偿,谈出解决办法
B1-U08 租住与长住 日常 沟通租房或短租,理解规则要点
B1-U09 生活服务 日常 办银行和手机卡业务、寄收快递、预约维修
B1-U10 观点与理由 日常 推荐并说明理由,回应不同意见
B1-U11 习俗与文化 旅行 谈小费、礼仪和节日,比较不同做法
B1-U12 深入聊天 日常 聊经历、计划和感受,维持 5 分钟对话
B1-U13 读懂生活文本 日常/旅行 读懂评价、说明、规则和通知
B1-U14 写说明与投诉 日常/旅行 写邮件说明经过并提出要求

B2 为可选扩展(自然语速的生活与旅行内容、复杂协商和讨论),B1 通过后再规划单元。

5.3 数据来源

数据 锁定版本 规模 用途 许可与要求
CEFR-J Vocabulary Profile 1.5 7,799 条(按词+词性),词头 6,867A1 1,164、A2 1,411、B1 2,446、B2 2,778 词汇难度上限;建立等级词池(5.4)。约 1,740 条自带主题标注(如 Shopping 197、Food and drink 167、Travel 120、Education 85 研究和商用免费;须注明出处(CEFR-J,東京外国語大学投野由紀夫研究室)
CEFR-J Grammar Profile 20180315 500 条语法项;约 170 条标了 A1.1–B2.2 子级,其余为同一项的否定/疑问变体 单元主动语法的难度上限 同 CEFR-J 词表
Octanove Vocabulary Profile C1/C2 1.0 2,136 条:C1 1,111、C2 1,025 判断超出 B2 的词 CC BY-SA 4.0;须署名,衍生数据须用同一许可
NGSL / NGSL-Spoken 导入时记录 NGSL 2,809 词 候选词按(口语)频率排序 CC BY-SA,可商用;须署名
ECDICT 导入时记录提交号 约 76 万词条 中文释义、音标、考试标签和词频,供人工复核 MIT;只用 translation、phonetic、tag、bnc、frq,不用来源不明的 collins、oxford 字段

不导入、不抄录:Cambridge English Vocabulary Profile / English Grammar Profile、Oxford 3000、Pearson GSE(没有开放许可)。

原始数据文件与来源说明(版本、下载地址、SHA-256、许可文本)随内容包一同存档,见 kouyu_english/tool/courses/lexicon/SOURCES.md。目前只导入了 CEFR-J 的两份文件,其余数据尚未导入。

5.4 分级数据怎么用

分级数据只做难度上限和覆盖检查,不决定单元的内容和顺序:

  • 语法:单元主动使用的语法项不高于本等级(A1 单元只用 A1.x,A2 不超过 A2.x,B1 不超过 B1.x);未标等级的否定/疑问变体按主项等级处理。数据等级明显不合生活场景的(如 You are 标为 B1.1)可以提前,须写明理由。
  • 词汇:功能词、动词、形容词不高于本等级。CEFR-J 依据日本中小学教材统计,不少旅行名词等级偏高(passportluggageplatformpharmacyreservation 都标为 B1),因此场景必需的具体名词和固定说法可作为场景词提前使用:须标注,且每个单元产出核心中场景词不超过 1/3。
  • 理解词:不高于本等级加一级,场景词除外。
  • 等级词池:起草某等级的单元前,先建立该等级的词池,作为词汇覆盖目标:
    1. 取 CEFR-J 中属于本等级的词头;
    2. 按用途分类:通用(功能词和不限场景的常用词)、日常、旅行、工作、学校与学术、其他。分类可多选;CEFR-J 自带主题标注的直接使用,未标注的由 AI 离线分类,用户抽样审核;
    3. 属于通用、日常或旅行任一类的词进入词池;只属于学校与学术或其他的词不进入;只属于工作的词单独保存,留给后续工作主题线;
    4. 单元提出的场景词(包括 CEFR-J 未收录的,如 boarding pass)并入词池。
    5. 程序把词池中尚未被前面等级覆盖的词预分配给本等级单元,作为各单元的候选词:有主题标注的按主题对应单元(如 Food and drink 分到点单、餐厅、超市),其余的形容词、动词、副词由 AI 按场景合适程度分配,每个单元都要分到一部分。功能词(代词、限定词、介词、连词、情态动词)不分配,靠词块和句型覆盖。 词池随等级 stageVersion 冻结,分类结果随数据来源一同存档。
  • 覆盖检查:冻结等级 stageVersion 前,本等级词池至少 85% 须被覆盖:作为产出核心或理解词,或出现在产出核心的词块、句型里(如 Can I have ...? 覆盖 can、I、have),A0 已教的词也算。每冻结一个单元,其候选词中未覆盖的词顺延到后面的单元;未覆盖的词逐个补进某个单元、放进听读材料,或写入排除项并说明理由。
  • A1 词池试建(2026-09-17,未经用户抽样审核)CEFR-J 1.5 的 A1 共 1,066 个不同词头。排除只属于学校与学术或其他的 102 个(如 homework、grammar、ruler,以及 fairy、prince、lion、kite、DVD 等儿童读物词和过时词),单独保存只属于工作的 15 个(如 meeting、interview、engineer、business),合并 is/was/did 等词形变体后,词池为 932 个。其中 A0 已覆盖 68 个,约 126 个是功能词和数词,其余约 770 个是实词:无主题标注的形容词 109、名词 105、动词 88、副词 40;有标注的 Free time 68、Personal identification 60、House and home 55、Food and drink 52、Shopping 44、Travel 23、Health 23 等。85% 覆盖需要 A1 单元再覆盖约 730 个。按每单元产出核心 12 项、其中约 8 项覆盖词池词(其余是场景词或纯句型)估算,产出核心覆盖约 150 个,加上词块中的功能词约 100 个,理解词需要覆盖约 480 个,也就是每单元平均约 25 个,因此 A1 的理解词数量从 15–30 调为 20–35。试建发现主题地图的缺口:family 类(aunt、cousin、husband、daughter 等约 20 个)和住处类(kitchen、bedroom、sofa、garden 等约 15 个)没有对应的 A1 单元,描述人和情绪的形容词(tall、young、angry、lonely 等)也没有集中的单元。
  • A1B1 起草结果(2026-09-17,未审核):50 个单元全部起草并通过程序校验,状态为 draft。词池覆盖 A1 834/93389.4%)、A2 1040/107896.5%)、B1 1344/155286.6%)。A2、B1 的理解词范围按实际需要调为 40–65 和 70–110;听读材料词数 A2 听 120280、读 150250B1 听 250550、读 300500。
  • A0:保持已冻结的 60 项(A0-1.0),不按数据重新生成。对照 CEFR-J 1.5:40 个单词按词形还原后有 39 个属于 A1(moviesmovieokayOK/okay),zero 不在词表中,作为 A0 自有项保留。

5.5 单元内容包组成

部分 内容
元数据 单元 ID、修订号(如 A1-U03 r1)、数据来源与版本、起草与审核所用模型、审核记录、确认冻结日期
能力 can-do 描述,对应主题地图中的“单元结束后能做什么”
场景 场景 ID、学习者身份与 AI 身份、背景、开场句;一个主场景加 2–3 个变式场景
任务 任务 ID、目标、引用的产出核心 ID、需要收集的信息槽、示范句;判定条件由程序根据引用编译,不由 AI 填写
产出核心 稳定 ID(如 A1-U03-W01 词、A1-U03-P01 词块或句型)、英文、当前义中文、CEFR-J 等级、是否场景词及理由
理解词 ID、英文、当前义中文、等级
语法项 CEFR-J 语法 ID、主动使用或仅理解
单元预检 覆盖全部产出核心的听辨与独立表达题(3.6)
听读材料(A2 起) 23 篇材料及理解题(第 6 节)
排除项 考虑过但不纳入的词句及理由
评分标准(A2 起) 开放任务的评分维度、各档描述和及格档

等级内全部单元冻结后,再生成该等级的出口评估蓝图和至少两套题组(覆盖每个单元的能力),冻结为等级 stageVersion(如 A1-1.0),锁定升级分母。之后修改已冻结的单元须新建 stageVersion 并提供旧新 ID 映射,遵循《A0 阶段标准》;已通过的记录保留原版本。

5.6 生成与冻结流程

主题地图中的一个单元(主题 + 能做什么)
    → AI 起草单元内容包:先写场景和任务,再从中提取产出核心和理解词;理解词优先从本单元的候选词(5.4)中选
    → 程序校验(失败则带错误清单退回修复,最多 2 次,仍失败则停止并提示人工处理)
    → 独立审核(另一次 AI 调用,逐项列问题;有问题则退回修复)
    → 用户确认 → 冻结单元,随应用发布

等级内全部单元冻结
    → 生成出口评估题组 → 同样校验、审核、确认 → 冻结等级 stageVersion,启用升级评估

程序校验至少包括:

  • ID 唯一;每个词都能在锁定数据版本中查到等级,或标为人工补充并给出理由;
  • 符合 5.4 的语法、词汇、场景词和理解词上限;
  • 任务引用的 ID 都存在;每个产出核心至少被一个任务和单元预检覆盖;
  • 示范句与开场句只使用本单元、推荐顺序在前的单元以及 A0 的词句,专名和数字除外;
  • 听读材料符合第 6 节的覆盖率要求;
  • 单元覆盖的候选词不少于候选词数的 60%(候选词本身少于 20 个时不检查),未覆盖的候选词顺延;
  • 冻结等级 stageVersion 时,词池覆盖率符合 5.4。

单元未冻结时显示“待提供”,不能学习。运行时 AI 只能生成表面变式(人名、地点、物品等内容值,以及措辞和句子顺序),不能增删核心项,也不能改变任务目标或判定条件。

5.7 决定权

事项 由谁决定
学哪些场景和能力 主题地图(5.2),目标固定为日常与旅行;修改须用户确认
单元的核心词句、理解词、语法项 AI 从场景出发起草,按 5.4 校验,审核后由用户确认冻结
场景设定、角色、开场句、示范句 AI 离线起草,冻结后固定
每一轮说什么 运行时 AI,受对话调度约束(见《AI 对话模块规格》7.3)
任务是否完成 程序按任务引用的词句和信息槽判定;A2 起再加评审(5.8)
掌握状态与复习 程序,按第 3 节
升级门槛 程序固定,见 4.1 与 4.2;AI 与内容包都不能修改

5.8 A2 及以上的开放任务判定

A2 起任务包含叙述、理由、建议等开放表达,不能只靠关键词判定:

  • 程序硬性检查:句数或长度、必需信息槽、是否用到任务要求的目标语言项、清单外词比例、是否为英文;
  • AI 评审:按单元的评分标准逐维度给档,每一档须引用用户原句作为证据;程序核对引用确实出自用户作答,引用不符则丢弃这次评审;
  • 判定:硬性检查全部通过,且各维度达到及格档,才算完成任务;评审失败或服务不可用记为待确认,不记语言失败;
  • A2 → B1 与 B1 结业的出口评估须人工复核,与 4.3 一致。

6. 听读输入

A0–A1 的听读输入在课程和对话里完成。从 A2 起单独安排输入,并逐级提高比例:

等级 占每日时长 语速与声音
A2 约 20%(20 分钟模式约 4 分钟) 12 分钟的对话、通知、电话留言 150–250 词的消息、菜单、说明、短文 慢速到正常;23 种声音
B1 约 35%(20 分钟模式约 7 分钟) 24 分钟的广播、导览、访谈式对话 300–500 词的评价、邮件、规则、故事 正常语速;多种常见口音,可加轻微背景声

输入时间从教学额度中划出,不额外加时。

  • 材料来源:每个单元随内容包冻结 2–3 篇;另可由 AI 在运行时按同样规则生成新篇目,只作练习。不内置未授权的真实材料。
  • 程序检查:按词次计,超出“已学产出核心 + 已学理解词 + 本单元场景词”的词不超过 2%(约 98% 的词汇覆盖才能较好理解),每个超出词附当前义释义;句长与语法不高于本等级。
  • 理解题:每篇 2–4 道(要点、细节、推断),结果只更新相关理解词的识别证据,不更新产出核心。
  • 查词:材料中查过或多次出现的词可一键加入扩展词复习(3.5)。
  • 记录:进度页显示每周听读分钟数;不设硬指标,连续两周明显低于计划时在首页提示。

7. 个人使用检查

不需要留存指标。每周检查以下问题即可:

  • 我能否无中文提示完成本周的核心 AI 场景?
  • 我能否在新场景中替换并使用上周的关键句?
  • 我是否能听懂本阶段材料的主要意思,而非只会背答案?
  • 我在没听清时,能否用英语请求重复、放慢或确认意思?
  • 我的关键信息是否能被稳定识别,而不因口音或偶尔的识别错误被误判?
  • 我是否完成了阶段出口任务?
  • 若没有完成,薄弱点是听、说、读、写还是词句回忆?

检查结果只用于调整下一周的复习量、课程速度和对话难度,不用于给自己贴“学得好/不好”的标签。