# 学习引擎规格:每日内容、掌握判定与阶段升级 > 适用范围:个人使用的英语学习工具 > 原则:学习目标固定为日常生活与旅行,主线终点为 B1;课程主线由主题地图和冻结的单元内容包决定并保持稳定。目标决定学哪些场景,分级数据决定难度上限,AI 决定场景怎么演,程序决定怎样算完成。AI 只在明确边界内生成变式练习与对话。 M1 范围、生成与数据契约见 [开发与验收约定](M1-IMPLEMENTATION-CONTRACT.md);A0 核心清单和四技能评估见 [A0 阶段标准](A0-STAGE-STANDARD.md)。以下规则是个人学习初始规则,不是 CEFR 认证标准。 ## 1. 学习体系的边界 学习目标固定为**日常生活与旅行**,不提供目标选择。主线终点是 B1:CEFR 对 B1 的描述正是能应对在英语地区旅行时遇到的大多数情况,并能谈论熟悉的日常话题。B2 作为可选扩展,B1 通过后再规划。 不安排学校与学术场景,这类词汇不进入词池(5.4)。工作需求后续作为独立主题线增加:届时在主题地图中新增工作单元,使用 5.4 中预留的工作类词汇,不改变日常与旅行主线的单元和门槛;是否提供目标选择届时再定。 学习路径没有预设的总课数。A0 的 10 节核心课和第 5 节主题地图中的单元是主线内容;系统会根据掌握状态持续提供复习、变式任务和补救微课,直到达到阶段出口能力。它们不是“掌握英语”的终点。 阶段推进不取决于“学完多少课”。核心课用于建立能力骨架;当一个阶段的出口任务、词句掌握度和真实对话表现尚未达标时,系统继续生成符合该阶段范围的新情境与练习,而不是机械跳到下一阶段。 | 阶段 | 能力目标 | 主要学习形式 | |---|---|---| | A0 | 问候、自我介绍、数字、身边物品、基础短句 | 短课、模仿、受控对话 | | A1 | 点餐、购物、问路、交通、入住、看病等固定的生活与旅行互动 | 主题单元、任务型 AI 对话 | | A2 | 讲经历、做预订与改期、比较选择、处理行程和住宿中的小问题 | 主题单元、较长对话、分级听读 | | B1 | 独立应对旅行和生活中的大多数情况:突发问题、投诉协商、说明理由、讲完整经历 | 主题单元、较长听读材料、叙事、讨论、写作 | | B2(可选) | 自然语速的生活与旅行内容、复杂协商和讨论 | B1 通过后再规划 | 本工具说的“学会英语”,指达到 B1 的日常与旅行交流能力,而不是背完一套课。从 A2 起须逐步加大听读输入(第 6 节)。 **时间预期**:剑桥英语给出的累计指导学时参考为 A2 约 180–200 小时、B1 约 350–400 小时、B2 约 500–600 小时。每天 20 分钟约合每年 120 小时,大致对应 A2 约 1.5 年、B1 约 3 年;30 分钟模式约 2 年到 B1。这只用于设定预期,不作为进度要求或解锁条件。 ## 2. 每日内容生成引擎 每天不由 AI 从零随机生成一整课。系统先从固定的能力地图(主题地图与已冻结的单元内容包,见第 5 节)中选内容,再让 AI 生成符合当前水平的例句、对话变式和纠错。 ### 2.1 每日组成 ```text 到期复习(按时间选任务) → 教学段:词汇预热 → 带帮助的听说读写 → 受控对话 → 独立尝试 → (A2 起)听读输入 → 总结与保存;未完成步骤留待续学 ``` | 模块 | 来源 | 目的 | 建议用时 | |---|---|---|---:| | 完整教学段 | 当前能力地图 | 包含预热、听说读写、一次受控对话、独立尝试;预热不重复计时 | 合计约 10–15 分钟 | | 其中:词汇预热 | 新词与准备词块 | 认识声音和当前句义,之后在句中应用,不再重复整套词卡 | 占教学段 1–3 分钟 | | 其中:受控对话与独立尝试 | 已教语言 | 通常 3–5 个回答轮;结尾一轮可作为独立尝试 | 占教学段约 3–5 分钟 | | 到期复习与补救 | 到期词句和薄弱技能 | 合并同一目标的复习与错误修复,避免重复安排 | 按每日预算 | | 听读输入(A2 起) | 当前单元的分级材料 | 积累可理解输入 | 从教学额度中划出:A2 约 20%,B1 约 35%(第 6 节) | 每日时间是安排上限,不保证每次完成整段。10 分钟:复习/补救 3 分钟、教学或续学 6 分钟、总结 1 分钟;20 分钟:5 + 14 + 1;30 分钟:8 + 20 + 2。30 分钟教学额度可用于慢练或可选巩固,不强制再学新段。无到期项时可将空余时间用于教学或提前结束。预热、课程内对话均包含在教学额度中,不另外叠加。只做复习的当天,独立输出可嵌入复习任务。 预热只列出当前教学段真正会遇到的新内容:通常 3–6 项,最多 8 个词汇项加 2 个理解词块;超出则先拆教学段。每项以“英文 → 音频 → 当前句义中文 → 一个短例句”呈现,并至少有一次轻量听辨或中英匹配。用户可逐项播放、查词或跳过,之后仍能进入课程;预热是降低陌生感,不是背诵考试。 预热只记录 `exposed`,不把“看过卡片”记成认识、可回忆、可使用或已掌握。实际课程和间隔复习中的独立作答才改变掌握状态。到预算边界完成当前短题后保存下一步骤,不开启长对话;可提前结束或自主继续。10 分钟不足以做完教学段时分天完成,未完成的听、说、读、写及独立尝试保持待做,不因当天结束自动结课。 ### 2.2 选择规则 1. 有到期项先按时间预算选任务,不设每天 5 个词句的硬上限。将同一词句的多条到期原因合并;从最早到期和近期真实错误两个队列轮流取项(先最早到期),某队列为空则从另一队列取。收藏扩展词也按到期时间参与,保证不会长期被错题挤占。已打开的未完成会话可先恢复。 2. 选定新教学段后,若包含未预热的新增内容,先进入课前词汇预热;恢复已开始教学段时不强制重复预热,用户可从课程页主动回看。新课按阶段主线顺序进行;用户可自行回退,不可被 AI 随机跳到未准备的高难主题。 3. 优先选最近两次失败或需要提示才能完成的词句作为错误修复项。 4. AI 对话使用“本教学段 + 已学且可回忆/可使用/已掌握”的语言范围,较弱项目必须预教;额外新词每轮最多 1 个、整段最多 2 个,先说明再使用。评估不得引入额外新词。 5. 仅对有效语言失败安排补救。提示如何撤除及复习如何推进按第 3 节,不以任意两次点击答对跳过间隔检查点。 ### 2.2a 复习容量与积压 “词句项”是稳定词句 ID,“复习任务”是一道题或短对话,界面分别显示任务数与覆盖词句数。一个任务可计划覆盖 1–3 个词句,但只为有直接作答证据的目标记账。例如用户独立说 `I like tea.`,可支持 tea 与 I like 的表达证据,不能同时推断会 coffee、会听懂 tea 或会提问。选择一个句义答案不自动证明其中每个词都认识。每个目标分别保存结果和技能;同一目标同日最多推进一个间隔检查点。 按任务预计用时计算积压:若待复习预计时间超过当日复习预算的 2 倍,或存在逾期至少 7 天的项,则暂停推荐新的教学段,先续学已开始内容并处理到期项;原教学额度可转为复习/补救,仍保留总结时间。积压降至预算以内且没有逾期 7 天的项后恢复新段推荐。用户可主动选新课,首页说明推荐原因;不删除积压、不偷偷提高每日时长。预测用时以实际完成耗时滚动修正。 ### 2.2b 从辅助学习到独立尝试 每个教学段必须安排一次 30–90 秒的独立尝试,优先使用结尾对话的一轮或写作的一题,不额外叠加整套测试。先完成带帮助练习,再换内容值/图片/人物并隐藏句框、答案、释义和翻译;听力隐藏提问文字,阅读保留英文材料。刚看过同一句答案后立即复述只算练习,不能充当迁移证据;当日独立成功也不替代次日及后续间隔检查点。 不会时可恢复提示:该次记辅助完成,安排下一次不同任务的独立尝试,不强制当场循环。跳过记待做,时间不够则续学。只有教学步骤已完成且独立尝试已有结果(成功、辅助、有效错误或待确认)才记录教学段完成;“待确认”仍不构成掌握。各段轮换听、说、读、写;每个种子主题结束前四技能至少各有一次独立尝试机会,见课程包映射。主题可完成而能力未掌握,后者进入复习和补练。 ### 2.3 AI 生成输入格式 每次请求 AI 时必须携带以下结构化信息: ```text 当前阶段:A0 / A1 / A2 / B1 / B2 当前单元与任务:单元 ID、场景 ID、任务 ID、任务目标(例如“在咖啡店点饮料”)及任务引用的核心词句 ID 用户身份与 AI 身份 已掌握的词、句型 本教学段新词(最多 8 项)及主动句型(最多 2 项) 理解用词块(每段最多 2 个);对话额外新词(每轮 1 个、整段 2 个;评估为 0) 禁止的超纲词与复杂语法 已出现的错误与要复练的表达 目标轮次、中文辅助开关、语速 完成判定条件 ``` 课程生成须返回完整课程/练习结构;对话单轮须返回英文回复、信息槽、原作答证据引用、任务完成建议,以及必要时的一句中文提示和结课重说句。客户端校验后才保存和判定,不能直接采信 AI 的完成标记。结构、语义审核、一次修复和内置模板回退遵循《开发与验收约定》第 2 节。 ### 2.4 随时查词 教学内容中的英文词和已定义短语均可点开查意思。查词卡按“短语优先、单词其次”显示当前句义、中文释义、示范音、慢速播放和一个当前阶段可理解的例句;用户可手动加入复习。系统不要求用户先记住再允许查,也不因为查词把学习任务判错。 AI 对话中的词条必须来自当前允许语言范围,或是事先标为可解释的新词。动态内容没有审核词条时,只能显示明确标记的临时释义,不能自动变成核心词汇、课程内容或掌握证据。离线时仅查询内置/缓存词条。 教学态的查词、翻译、字幕和提示都算帮助完成;独立练习和出口评估中默认无查词入口。用户若要查词,先切换当前题到教学态,当前题不计独立证据,随后用新题补测。该行为是帮助路径,不是语言失败。 ## 3. 词汇与句型掌握模型 词汇不以“看过一次”或“答对一次”为掌握。词汇分为“会用”的产出核心和“会认”的理解词两层(见 3.5);本节五种状态与掌握规则适用于产出核心,每个词和关键句型均经历五种状态: | 状态 | 证据 | 系统动作 | |---|---|---| | 新学 | 第一次在课程中出现 | 当天再次在听、读、说中出现 | | 认识 | 能从音频/英文中选出正确意思 | 安排中文/图片到英文的回忆 | | 可回忆 | 看中文或图片能说/写出英文 | 安排句子填空、替换和改写 | | 可使用 | 能在新句子或 AI 对话中正确使用 | 减少提示,安排变式场景 | | 已掌握 | 间隔后仍能独立、正确使用 | 拉长复习间隔,保留偶尔抽查 | ### 3.1 掌握的最低规则 首次教学记录为“新学”。一次有效听辨/阅读识别成功可进入“认识”;一次无答案提示的说/写回忆成功可进入“可回忆”;在不同于教学原题的场景中无提示正确使用可进入“可使用”。升级必须保留前序的识别和回忆证据,不因一次对话跳过。 一个词或句型只有同时满足下列条件,才能标记为“已掌握”: - 完成四个间隔复习检查点,每个检查点至少一次独立成功;正常计划为该词句首次完成正式教学后第 1、3、7、14 天。 - 有效证据覆盖听辨、回忆表达、情境使用三类任务;最近两次有效作答均无提示成功。 - 至少一次在不同情境中无句框主动使用;带“合理提示”完成仅算练习,不算该迁移证据。 每个词句单独保存首次正式教学日期:已获得释义/示范并提交至少一次该项应用练习(可带帮助,不要求答对)时登记,只登记一次;不等待整课或主题完成。仅看预热、查词或跳过教学不触发;主动收藏可以创建独立的待学提醒,但不启动四个掌握检查点。若该项当天有真实错误,补救与次日复习合并。 按本地日期排复习,正常四次成功的间隔为 1、2、4、7 天。逾期不补造结果:完成当前检查点后,下一检查点从实际完成日期按后续间隔安排,每天同一项最多推进一个检查点;漏学不清空历史。第四次后按 30 天抽查。提示后答对保持当前检查点,次日换题独立复测,不计失败。遗忘处理按下一节,不因单次错误清空历史或四个检查点。 每次作答区分独立成功、带帮助完成、语言错误、待确认和技术失败。记录听/说/读/写、提示、翻译、字幕、输入与转写修改状态;看答案后复述、同题立即重做不算独立间隔或迁移证据。文字可支持词句回忆/使用,但不能补齐口语证据;看字幕或翻译不能补齐独立听力。反馈来源为转写不确定或服务异常时,不进入失败计数。 例如 `coffee` 的掌握证据不只是知道中文意思;还应能听懂它、看到图片说出它,并在点餐中说出 `I’d like a coffee, please.` ### 3.2 失败处理 - 一次有效语言失败:保留原状态和检查点,标记“需复核”,次日先换题无提示复核;需要时再提供示范。需复核项暂不计入首次阶段通过的词句门槛,但不撤销已取得的阶段通过记录。技术失败或 uncertain 不计语言失败。 - 复核成功:清除需复核标记。尚未掌握的词句按原检查点继续(满足到期时间与独立成功要求时可推进);原已掌握项 7 天后再抽查一次,成功后回到 30 天抽查。复核期间的辅助完成不清除标记,也不计第二次失败。 - 同一词句在不同任务的两次独立尝试均有语言失败,且中间没有独立成功:做简短识别/回忆/应用诊断,按最高仍有复测证据的能力回到“新学/认识/可回忆/可使用”;诊断不确定时保留需复核,不猜测。原检查点退回一个(最低为 0),保留全部历史,只补该点及后续间隔,不要求统一重走四次。 - 退回检查点后次日换题复核,成功补回一个检查点,再按后续 2/4/7 天间隔推进;从第 4 点退至第 3 点者补回第 4 点后,7 天再抽查一次,成功才恢复已掌握。恢复已掌握仍须满足三类任务覆盖、迁移与最近两次独立成功。 - 连续三次有效语言失败:插入约 2 分钟补救,使用当天复习/教学预算,不额外加时,并暂停该能力的新内容。计数只看有效独立作答,技术问题、求助和立即模仿均不累计。 ### 3.3 可理解沟通标准 发音和听力的目标不是获得英音、美音或笼统的“发音分数”,而是在当前阶段的真实任务中稳定互相理解。 | 能力 | 达标定义 | 不作为判错依据 | |---|---|---| | 口语可理解度 | 听者能稳定识别姓名、地点、数字、需求、问题等关键信息,并完成任务 | 地区口音、轻微重音差异、与示范音不完全一致 | | 听力可理解度 | 能听出场景中的主要意思和关键细节,并作出合适回应 | 第一次就听懂所有口音、所有自然语速材料 | | 沟通补救 | 没听清时能请求重复、放慢或确认意思 | 不能一次听懂就视为失败 | 听力材料按以下难度推进: ```text 清晰慢速英语 → 正常语速的清晰英语 → 不同说话人和常见口音 → 有少量背景声的真实情境 ``` 每个阶段都应教并练习沟通补救句:`Could you say that again?`、`Please speak slowly.`、`Do you mean ...?`。这类句子本身是听力能力的一部分。 ### 3.4 发音反馈规则 | 识别到的情况 | 系统动作 | |---|---| | 语音识别可信度低、无可靠置信度或用户提出异议 | 显示转写并让用户确认、修改或重说;不记录为英语错误 | | 有口音但表达可理解 | 接受答案;最多提供可选提示,不强制纠正 | | 同一词反复被 ASR 错误转写 | 先排查噪声和识别问题;可提供用户自选通用练习,不据此诊断音素或降低掌握度 | | 句子结构或词汇有误 | 作为表达错误反馈;不归为发音错误 | 一次反馈只处理一个点。`three/free` 可作为通用听辨、示范和回听练习,但界面须说明“识别可能有误,这不是发音诊断”。文字 AI 没有音频证据时不能断言用户把 /θ/ 发成 /f/;个性化音素诊断不在 M1。未编辑且确认的转写仅是受控口语的代理证据,不等于真人可理解度保证。 ### 3.5 两层词汇:会用与会认 | 层 | 范围 | 状态 | 是否计入升级分母 | |---|---|---|---| | 产出核心(会用) | 单元内容包中需要主动说、写的词、词块和句型;每单元 10–15 项 | 3.1–3.2 的五种状态和掌握规则 | 计入 | | 理解词(会认) | 听懂、看懂即可的词;每单元 A1 20–35 项、A2 30–50 项、B1 50–80 项 | 新学 → 认识 → 熟悉 | 不逐项计入;升级时抽查(4.2) | | 扩展词 | 听读材料中查过或多次出现、由用户加入复习的词 | 同理解词 | 不计入,也不参与升级抽查 | **学习流程**:单词不单独背,跟着单元场景学。 1. 会用的词:预热(只记“见过”)→ 在场景句中听辨 → 说、读、写的替换练习 → 受控对话中用出来 → 独立尝试 → 按 3.1 间隔复习,每次复习换语境(如从地铁站换到火车站)。 2. 会认的词:不进预热,直接出现在教学段的听读材料里,首次出现可点开释义;教学段结束时做 2–3 道快速识别题,之后按下述理解词规则复习。 3. 各等级侧重:A1 以具体名词和固定说法为主,用图片和替换练习;A2 增加词块、搭配和词形变化(如 `book a table`、`miss the bus`、过去式);B1 的新词主要来自听读材料和查词,增加词族和近义词辨析(如 `complain`/`complaint`),并练习用英语解释词义。 **识别题要求**(两层词的“认识”证据,以及理解词和扩展词的全部证据): - 至少一次在句子或场景语境中答对;孤立的中英互译不能作为唯一证据。 - 干扰项取同单元或意思相近的词(如 `ticket` 配 `receipt`、`menu`),不用明显无关的词。 - 提供“不认识”选项:选它不算语言失败,转为教学并换题补测。 - 记录作答用时:听辨题超过约 10 秒、阅读识别题超过约 15 秒,记为带帮助完成,不算独立成功。 - 理解词只考“听或读 → 意思”,不考拼写,也不要求说出。 理解词规则: - 一次独立的听辨或阅读识别成功进入“认识”;至少间隔 7 天后,换题、换语境再次独立识别成功,进入“熟悉”,之后每 30 天抽查。 - 识别失败回到“认识”,次日换题复核;不做诊断降级。 - 复习以 5–10 秒的快速识别题为主,可以成组出现,占复习预算不超过三分之一。 - 在听读材料中答对与某个理解词直接相关的理解题,可计一次该词的识别证据。 - 后续单元把某个理解词列为产出核心时,保留已有识别证据,从“认识”开始走完整掌握流程。 A0 的准备/辅助材料沿用《A0 阶段标准》,不套用本节。 ### 3.6 免学与定级 已经会的内容不必重学,但“会”需要证据: - **单元预检**:进入单元时可选做一次不超过 3 分钟的预检,在单元场景里考听辨和独立表达(说或写)。某项产出核心两类题都独立答对,记为“免学待确认”,教学段中跳过其讲解;至少 3 天后换题独立复测一次,成功即记为已掌握并进入 30 天抽查,失败则按新项正常教学。理解词预检识别正确直接记为“熟悉”。预检答错不计语言失败。 - **入门定级**:“完全零基础”从 A0 开始。“有一些基础”或“能简单对话”可做定级评估:依次使用各等级已冻结的出口题组中的一套(先 A0,通过后再 A1……),在第一个未通过的等级停止,从该等级开始学习。某等级题组尚未冻结时,定级最多只到该等级。 - **定级通过**:定级跳过的等级记为“定级通过”,与“阶段通过”分开保存;14 天内再通过该等级的另一套题组才算确认。未确认时首页建议回到该等级,但不强制。 - **定级免学**:跳过等级的产出核心不走四个检查点,每天从复习预算中最多抽 5 项独立复测;失败项转为需复核并安排补救。跳过的等级不参与后续等级的门槛计算。 ## 4. 阶段升级规则 已完成课数只用于回顾学习历史,不能决定升级。可以提前参加评估或延后升级,但只有门槛全部满足才记录阶段通过,不能手动跳级。入门轻量定位只推荐起点,定级跳过等级须按 3.6 用出口题组证明。下一等级尚无已冻结的单元时显示待提供,不在运行时临时生成主线;单元内容包按第 5 节离线生成、校验、审核并经用户确认冻结后才可学习。 ### 4.1 A0 → A1 唯一执行标准见《A0 阶段标准》:固定 60 项核心分母,至少 48 项可使用或已掌握,其中至少 30 项已掌握;两次不同题组的听说读写评估分别通过,间隔至少 24 小时,最近一次在 30 天内。每项必需能力都要有证据,不以总平均分掩盖口语或听力缺口。 初次见面对话只是口语评估的一部分,还须验证姓名拼读、数字、物品、家人、星期/整点及沟通补救;阅读和写作单独评估。带提示、修改转写或识别失败的处理按标准执行。未通过则定向补练与换题复测,不限制追加课程数量。 ### 4.2 A1 及以上的升级门槛 门槛只设在等级之间,单元之间不设门槛(见 5.1)。从 A1 起,进入下一等级须同时满足: 1. 本等级产出核心(全部单元之和,等级 stageVersion 冻结的分母)中至少 80% 为可使用或已掌握,其中至少 50% 为已掌握;需复核项的处理同《A0 阶段标准》; 2. 理解词抽查:从本等级已教的理解词中随机抽 30 项做听或读的识别,独立答对至少 24 项; 3. 两套不同题组的四技能评估分别通过,间隔至少 24 小时,最近一次在 30 天内; 4. 完成本等级的出口任务(4.3)。 本等级的单元未全部冻结前,只能学习已冻结的单元,升级评估不可用。比例由程序固定,内容包不能修改。 ### 4.3 出口任务 | 升级 | 出口能力 | 出口任务 | |---|---|---| | A1 → A2 | 在点餐、购物、问路、交通、住宿、看病等场景中完成固定互动;能写 3–5 句短消息 | **旅行日**:入住酒店、询问路线、点餐并处理一个简单问题(约 3 分钟对话);写一条告诉朋友当天安排的消息 | | A2 → B1 | 讲经历,做预订和改期,比较选择,处理行程和住宿中的小问题 | **行程变化日**:电话改订并当面解决一个住宿问题(约 5 分钟对话);听 1–2 分钟通知后说出要点;写 4–6 句消息讲当天发生了什么 | | B1 结业(B2 可选) | 独立应对旅行和生活中的大多数情况,说明经过和理由 | 听 2–3 分钟广播或导览后复述;5 分钟旅途突发问题的解决与协商对话;写一封说明问题并提出要求的邮件 | A2 起的出口任务按 5.8 判定;A2 → B1 与 B1 结业须人工或通过高质量任务评估复核,不应只靠选择题自动升级。 ## 5. 学习路线与单元内容包 **目标决定学哪些场景,分级数据决定难度上限,AI 决定场景怎么演,程序决定怎样算完成。** 学习目标固定为日常生活与旅行;主题地图(5.2)列出每个等级要完成的生活和旅行任务;AI 从场景出发起草单元内容,再用分级数据检查难度;程序校验、编译判定条件并执行门槛。单元冻结后,运行时 AI 不能再改变它。 ### 5.1 路线结构 ```text 等级(A0 / A1 / A2 / B1) → 主题单元(一组相关的生活或旅行任务) → 教学段(沿用第 2 节,每段约 10–15 分钟) → 场景与任务(单元主场景 + 2–3 个变式场景) ``` - **单元是冻结和学习的基本单位**:某个单元冻结后即可学习,不必等整个等级。 - **单元之间不设门槛**:完成单元的教学段并尝试过单元任务后,即可进入下一单元;掌握在复习中继续推进。积压时按 2.2a 暂停推荐新单元。 - **推荐顺序按依赖排列**(如价格先于购物、日期先于预订、问路先于交通)。用户可以自选单元;跳到后面的单元时,前面单元中被引用的词句作为预热新项先教。 - **单元规模**:产出核心 10–15 项(词、词块、句型);理解词 A1 20–35 项、A2 30–50 项、B1 50–80 项(两层词汇见 3.5)。A1 数量已按词池试建结果调整(5.4);A2、B1 仍是初始估计,建好词池后再调整。 ### 5.2 主题地图 A0 保持现有 10 节核心课(见《A0 初始核心课程包》)。A1 起的单元如下,“类别”表示该单元主要服务日常还是旅行。修改主题地图(增删、合并或调整单元)须用户确认;已冻结单元的 ID 不复用。 **A1:固定的生活与旅行互动** | 单元 | 主题 | 类别 | 单元结束后能做什么 | |---|---|---|---| | A1-U01 | 在咖啡店点单 | 日常 | 点饮料、说规格、礼貌确认 | | A1-U02 | 价格与付款 | 日常/旅行 | 问价、说 100 以内的金额、选择现金或刷卡 | | A1-U03 | 在餐厅点餐 | 日常/旅行 | 点餐、问推荐、要账单 | | A1-U04 | 超市与便利店 | 日常 | 找商品、说数量 | | A1-U05 | 买衣服 | 日常 | 问尺码和颜色、试穿 | | A1-U06 | 认识新朋友 | 日常 | 问职业、兴趣和住在哪里 | | A1-U07 | 我的一天 | 日常 | 说作息和常做的事 | | A1-U08 | 天气与穿着 | 日常/旅行 | 问天气、说该穿什么 | | A1-U09 | 日期与约时间 | 日常 | 说日期、约见面、改时间 | | A1-U10 | 问路 | 旅行 | 问地点、听懂左右和距离 | | A1-U11 | 公交与地铁 | 旅行 | 买票、问站点、确认下车 | | A1-U12 | 打车 | 旅行 | 说目的地、确认价格或路线 | | A1-U13 | 在机场 | 旅行 | 值机、问登机口、回答入境的简单问题 | | A1-U14 | 入住酒店 | 旅行 | 说明预订信息、办理入住 | | A1-U15 | 酒店里的需求 | 旅行 | 要物品、报告简单问题 | | A1-U16 | 药店与不舒服 | 日常/旅行 | 说一个症状、听懂基本建议 | | A1-U17 | 请求帮助 | 日常/旅行 | 礼貌求助、感谢与回应 | | A1-U18 | 打电话与留言 | 日常 | 留下姓名、号码和简短信息 | | A1-U19 | 周末计划 | 日常 | 说将要做的事 | **A2:讲经历、做安排、处理小问题** | 单元 | 主题 | 类别 | 单元结束后能做什么 | |---|---|---|---| | A2-U01 | 上个周末 | 日常 | 用过去时讲做了什么 | | A2-U02 | 上一次旅行 | 旅行 | 讲去了哪里、怎么样、感受如何 | | A2-U03 | 预订酒店与餐厅 | 旅行 | 电话或当面预订:日期、人数、要求 | | A2-U04 | 改期与取消 | 日常/旅行 | 说明原因、提出新时间 | | A2-U05 | 餐厅里的问题 | 旅行 | 说明忌口或过敏、菜品有问题、分开结账 | | A2-U06 | 比较与选择 | 日常/旅行 | 比较商品、房间或路线并做选择 | | A2-U07 | 退换货 | 日常 | 说明问题、要求退换 | | A2-U08 | 行程出问题 | 旅行 | 误车、延误、换乘、改票 | | A2-U09 | 住宿里的问题 | 旅行 | 报修、换房、提出要求 | | A2-U10 | 看病 | 日常/旅行 | 说症状和持续时间、听懂用药说明 | | A2-U11 | 聊兴趣与家乡 | 日常 | 围绕一个话题连续聊几轮 | | A2-U12 | 建议与意见 | 日常/旅行 | 给建议、征求意见 | | A2-U13 | 介绍城市与景点 | 旅行 | 描述地方、推荐去处 | | A2-U14 | 丢东西与求助 | 旅行 | 在服务台说明丢了什么、在哪里丢的 | | A2-U15 | 消息与短邮件 | 日常 | 写邀请、感谢、说明迟到 | **B1:独立应对大多数情况** | 单元 | 主题 | 类别 | 单元结束后能做什么 | |---|---|---|---| | B1-U01 | 讲一段完整的旅行经历 | 旅行 | 按顺序叙述,加入背景和感受 | | B1-U02 | 规划行程 | 旅行 | 比较交通和住宿方案,说明理由和预算 | | B1-U03 | 入境与行李 | 旅行 | 回答入境问题,报告行李延误或丢失 | | B1-U04 | 听懂广播与讲解 | 旅行 | 抓住车站、机场广播和导览讲解的要点 | | B1-U05 | 紧急情况 | 旅行 | 证件或钱包丢失、报警、求助 | | B1-U06 | 就医 | 日常/旅行 | 说明症状变化和病史,理解医嘱要点 | | B1-U07 | 投诉与协商 | 日常/旅行 | 要求退款或补偿,谈出解决办法 | | B1-U08 | 租住与长住 | 日常 | 沟通租房或短租,理解规则要点 | | B1-U09 | 生活服务 | 日常 | 办银行和手机卡业务、寄收快递、预约维修 | | B1-U10 | 观点与理由 | 日常 | 推荐并说明理由,回应不同意见 | | B1-U11 | 习俗与文化 | 旅行 | 谈小费、礼仪和节日,比较不同做法 | | B1-U12 | 深入聊天 | 日常 | 聊经历、计划和感受,维持 5 分钟对话 | | B1-U13 | 读懂生活文本 | 日常/旅行 | 读懂评价、说明、规则和通知 | | B1-U14 | 写说明与投诉 | 日常/旅行 | 写邮件说明经过并提出要求 | B2 为可选扩展(自然语速的生活与旅行内容、复杂协商和讨论),B1 通过后再规划单元。 ### 5.3 数据来源 | 数据 | 锁定版本 | 规模 | 用途 | 许可与要求 | |---|---|---|---|---| | CEFR-J Vocabulary Profile | 1.5 | 7,799 条(按词+词性),词头 6,867;A1 1,164、A2 1,411、B1 2,446、B2 2,778 | 词汇难度上限;建立等级词池(5.4)。约 1,740 条自带主题标注(如 Shopping 197、Food and drink 167、Travel 120、Education 85) | 研究和商用免费;须注明出处(CEFR-J,東京外国語大学投野由紀夫研究室) | | CEFR-J Grammar Profile | 20180315 | 500 条语法项;约 170 条标了 A1.1–B2.2 子级,其余为同一项的否定/疑问变体 | 单元主动语法的难度上限 | 同 CEFR-J 词表 | | Octanove Vocabulary Profile C1/C2 | 1.0 | 2,136 条:C1 1,111、C2 1,025 | 判断超出 B2 的词 | CC BY-SA 4.0;须署名,衍生数据须用同一许可 | | NGSL / NGSL-Spoken | 导入时记录 | NGSL 2,809 词 | 候选词按(口语)频率排序 | CC BY-SA,可商用;须署名 | | ECDICT | 导入时记录提交号 | 约 76 万词条 | 中文释义、音标、考试标签和词频,供人工复核 | MIT;只用 translation、phonetic、tag、bnc、frq,不用来源不明的 collins、oxford 字段 | 不导入、不抄录:Cambridge English Vocabulary Profile / English Grammar Profile、Oxford 3000、Pearson GSE(没有开放许可)。 原始数据文件与来源说明(版本、下载地址、SHA-256、许可文本)随内容包一同存档。 ### 5.4 分级数据怎么用 分级数据只做**难度上限和覆盖检查**,不决定单元的内容和顺序: - **语法**:单元主动使用的语法项不高于本等级(A1 单元只用 A1.x,A2 不超过 A2.x,B1 不超过 B1.x);未标等级的否定/疑问变体按主项等级处理。数据等级明显不合生活场景的(如 `You are` 标为 B1.1)可以提前,须写明理由。 - **词汇**:功能词、动词、形容词不高于本等级。CEFR-J 依据日本中小学教材统计,不少旅行名词等级偏高(`passport`、`luggage`、`platform`、`pharmacy`、`reservation` 都标为 B1),因此场景必需的具体名词和固定说法可作为**场景词**提前使用:须标注,且每个单元产出核心中场景词不超过 1/3。 - **理解词**:不高于本等级加一级,场景词除外。 - **等级词池**:起草某等级的单元前,先建立该等级的词池,作为词汇覆盖目标: 1. 取 CEFR-J 中属于本等级的词头; 2. 按用途分类:通用(功能词和不限场景的常用词)、日常、旅行、工作、学校与学术、其他。分类可多选;CEFR-J 自带主题标注的直接使用,未标注的由 AI 离线分类,用户抽样审核; 3. 属于通用、日常或旅行任一类的词进入词池;只属于学校与学术或其他的词不进入;只属于工作的词单独保存,留给后续工作主题线; 4. 单元提出的场景词(包括 CEFR-J 未收录的,如 `boarding pass`)并入词池。 5. 程序把词池中尚未被前面等级覆盖的词**预分配**给本等级单元,作为各单元的候选词:有主题标注的按主题对应单元(如 Food and drink 分到点单、餐厅、超市),其余的形容词、动词、副词由 AI 按场景合适程度分配,每个单元都要分到一部分。功能词(代词、限定词、介词、连词、情态动词)不分配,靠词块和句型覆盖。 词池随等级 stageVersion 冻结,分类结果随数据来源一同存档。 - **覆盖检查**:冻结等级 stageVersion 前,本等级词池至少 85% 须被覆盖:作为产出核心或理解词,或出现在产出核心的词块、句型里(如 `Can I have ...?` 覆盖 can、I、have),A0 已教的词也算。每冻结一个单元,其候选词中未覆盖的词顺延到后面的单元;未覆盖的词逐个补进某个单元、放进听读材料,或写入排除项并说明理由。 - **A1 词池试建(2026-09-17,未经用户抽样审核)**:CEFR-J 1.5 的 A1 共 1,066 个不同词头。排除只属于学校与学术或其他的 102 个(如 homework、grammar、ruler,以及 fairy、prince、lion、kite、DVD 等儿童读物词和过时词),单独保存只属于工作的 15 个(如 meeting、interview、engineer、business),合并 is/was/did 等词形变体后,词池为 932 个。其中 A0 已覆盖 68 个,约 126 个是功能词和数词,其余约 770 个是实词:无主题标注的形容词 109、名词 105、动词 88、副词 40;有标注的 Free time 68、Personal identification 60、House and home 55、Food and drink 52、Shopping 44、Travel 23、Health 23 等。85% 覆盖需要 A1 单元再覆盖约 730 个。按每单元产出核心 12 项、其中约 8 项覆盖词池词(其余是场景词或纯句型)估算,产出核心覆盖约 150 个,加上词块中的功能词约 100 个,理解词需要覆盖约 480 个,也就是每单元平均约 25 个,因此 A1 的理解词数量从 15–30 调为 20–35。试建发现主题地图的缺口:family 类(aunt、cousin、husband、daughter 等约 20 个)和住处类(kitchen、bedroom、sofa、garden 等约 15 个)没有对应的 A1 单元,描述人和情绪的形容词(tall、young、angry、lonely 等)也没有集中的单元。 - **A0**:保持已冻结的 60 项(`A0-1.0`),不按数据重新生成。对照 CEFR-J 1.5:40 个单词按词形还原后有 39 个属于 A1(`movies`→`movie`、`okay`→`OK/okay`),`zero` 不在词表中,作为 A0 自有项保留。 ### 5.5 单元内容包组成 | 部分 | 内容 | |---|---| | 元数据 | 单元 ID、修订号(如 `A1-U03 r1`)、数据来源与版本、起草与审核所用模型、审核记录、确认冻结日期 | | 能力 | can-do 描述,对应主题地图中的“单元结束后能做什么” | | 场景 | 场景 ID、学习者身份与 AI 身份、背景、开场句;一个主场景加 2–3 个变式场景 | | 任务 | 任务 ID、目标、引用的产出核心 ID、需要收集的信息槽、示范句;判定条件由程序根据引用编译,不由 AI 填写 | | 产出核心 | 稳定 ID(如 `A1-U03-W01` 词、`A1-U03-P01` 词块或句型)、英文、当前义中文、CEFR-J 等级、是否场景词及理由 | | 理解词 | ID、英文、当前义中文、等级 | | 语法项 | CEFR-J 语法 ID、主动使用或仅理解 | | 单元预检 | 覆盖全部产出核心的听辨与独立表达题(3.6) | | 听读材料(A2 起) | 2–3 篇材料及理解题(第 6 节) | | 排除项 | 考虑过但不纳入的词句及理由 | | 评分标准(A2 起) | 开放任务的评分维度、各档描述和及格档 | 等级内全部单元冻结后,再生成该等级的出口评估蓝图和至少两套题组(覆盖每个单元的能力),冻结为等级 stageVersion(如 `A1-1.0`),锁定升级分母。之后修改已冻结的单元须新建 stageVersion 并提供旧新 ID 映射,遵循《A0 阶段标准》;已通过的记录保留原版本。 ### 5.6 生成与冻结流程 ```text 主题地图中的一个单元(主题 + 能做什么) → AI 起草单元内容包:先写场景和任务,再从中提取产出核心和理解词;理解词优先从本单元的候选词(5.4)中选 → 程序校验(失败则带错误清单退回修复,最多 2 次,仍失败则停止并提示人工处理) → 独立审核(另一次 AI 调用,逐项列问题;有问题则退回修复) → 用户确认 → 冻结单元,随应用发布 等级内全部单元冻结 → 生成出口评估题组 → 同样校验、审核、确认 → 冻结等级 stageVersion,启用升级评估 ``` 程序校验至少包括: - ID 唯一;每个词都能在锁定数据版本中查到等级,或标为人工补充并给出理由; - 符合 5.4 的语法、词汇、场景词和理解词上限; - 任务引用的 ID 都存在;每个产出核心至少被一个任务和单元预检覆盖; - 示范句与开场句只使用本单元、推荐顺序在前的单元以及 A0 的词句,专名和数字除外; - 听读材料符合第 6 节的覆盖率要求; - 单元覆盖的候选词不少于候选词数的 60%(候选词本身少于 20 个时不检查),未覆盖的候选词顺延; - 冻结等级 stageVersion 时,词池覆盖率符合 5.4。 单元未冻结时显示“待提供”,不能学习。运行时 AI 只能生成表面变式(人名、地点、物品等内容值,以及措辞和句子顺序),不能增删核心项,也不能改变任务目标或判定条件。 ### 5.7 决定权 | 事项 | 由谁决定 | |---|---| | 学哪些场景和能力 | 主题地图(5.2),目标固定为日常与旅行;修改须用户确认 | | 单元的核心词句、理解词、语法项 | AI 从场景出发起草,按 5.4 校验,审核后由用户确认冻结 | | 场景设定、角色、开场句、示范句 | AI 离线起草,冻结后固定 | | 每一轮说什么 | 运行时 AI,受对话调度约束(见《AI 对话模块规格》7.3) | | 任务是否完成 | 程序按任务引用的词句和信息槽判定;A2 起再加评审(5.8) | | 掌握状态与复习 | 程序,按第 3 节 | | 升级门槛 | 程序固定,见 4.1 与 4.2;AI 与内容包都不能修改 | ### 5.8 A2 及以上的开放任务判定 A2 起任务包含叙述、理由、建议等开放表达,不能只靠关键词判定: - **程序硬性检查**:句数或长度、必需信息槽、是否用到任务要求的目标语言项、清单外词比例、是否为英文; - **AI 评审**:按单元的评分标准逐维度给档,每一档须引用用户原句作为证据;程序核对引用确实出自用户作答,引用不符则丢弃这次评审; - **判定**:硬性检查全部通过,且各维度达到及格档,才算完成任务;评审失败或服务不可用记为待确认,不记语言失败; - A2 → B1 与 B1 结业的出口评估须人工复核,与 4.3 一致。 ## 6. 听读输入 A0–A1 的听读输入在课程和对话里完成。从 A2 起单独安排输入,并逐级提高比例: | 等级 | 占每日时长 | 听 | 读 | 语速与声音 | |---|---|---|---|---| | A2 | 约 20%(20 分钟模式约 4 分钟) | 1–2 分钟的对话、通知、电话留言 | 150–250 词的消息、菜单、说明、短文 | 慢速到正常;2–3 种声音 | | B1 | 约 35%(20 分钟模式约 7 分钟) | 2–4 分钟的广播、导览、访谈式对话 | 300–500 词的评价、邮件、规则、故事 | 正常语速;多种常见口音,可加轻微背景声 | 输入时间从教学额度中划出,不额外加时。 - **材料来源**:每个单元随内容包冻结 2–3 篇;另可由 AI 在运行时按同样规则生成新篇目,只作练习。不内置未授权的真实材料。 - **程序检查**:按词次计,超出“已学产出核心 + 已学理解词 + 本单元场景词”的词不超过 2%(约 98% 的词汇覆盖才能较好理解),每个超出词附当前义释义;句长与语法不高于本等级。 - **理解题**:每篇 2–4 道(要点、细节、推断),结果只更新相关理解词的识别证据,不更新产出核心。 - **查词**:材料中查过或多次出现的词可一键加入扩展词复习(3.5)。 - **记录**:进度页显示每周听读分钟数;不设硬指标,连续两周明显低于计划时在首页提示。 ## 7. 个人使用检查 不需要留存指标。每周检查以下问题即可: - 我能否无中文提示完成本周的核心 AI 场景? - 我能否在新场景中替换并使用上周的关键句? - 我是否能听懂本阶段材料的主要意思,而非只会背答案? - 我在没听清时,能否用英语请求重复、放慢或确认意思? - 我的关键信息是否能被稳定识别,而不因口音或偶尔的识别错误被误判? - 我是否完成了阶段出口任务? - 若没有完成,薄弱点是听、说、读、写还是词句回忆? 检查结果只用于调整下一周的复习量、课程速度和对话难度,不用于给自己贴“学得好/不好”的标签。