知因私教 · 缺口补齐模块总入口
2026-09-03 一次补齐:写作批改 / 分级阅读 / 词汇引擎 / 题目级题库 / A/B 效果框架 / 家长·教师端 | 纯标准库,真实数据优先,诚实标注边界
数据真实性声明(铁律):
所有"真实"标签均指真实算法 + 真实公开数据(NGSL 词表 CC BY-SA、Project Gutenberg 公有领域语料、CoNLL-2014 学习者语料、ASSISTments 真实作答);"synthetic"标签仅用于演示链路或算法自检,
不构成任何效果证据
。 任何"提分/流利"类对外宣称须等真实 A/B(ab_test 框架)出数后。
写作批改 writing/
真实 LLM + 规则
IELTS 官方 rubric · CoNLL-2014 错因分类 · Socratic 不代写
四维给分(GRA/LR=规则信号映射,TR/CC=真实 DeepSeek 语义评分);错误定位到句;错因分布对比真实学习者基线;教学引导按语料校准优先级。拼写示例词来自 CoNLL-14 真实错误。
分级阅读 reading/
真实语料
Flesch/SMOG/CL/ARI 公开公式 · NGSL 覆盖 · 生词负担 i+1 推荐
10 本 Gutenberg 公有领域原著自动分级索引(含 Black Beauty/Anne 等低龄文学);按学生词汇档案+兴趣推荐段落并给生词预习表(原文语境)。诚实:无 Lexile(MetaMetrics 专有);原版文学对任何学生 NGSL 覆盖仅 ~82-87% → 低水平学生如实返回"语料缺口诊断";A1-B1 受控语料抓取器 reading/fetch_elt_corpus.py 就绪(VOA 公有领域 / Wikijunior CC BY-SA,网络可达即跑)。
词汇引擎 vocabulary/
NGSL + LLM 释义
NGSL 1.2(CC BY-SA)· 真实语料例句 · FSRS-4.5 调度
2801 词按 rank 分 5 档学习路径;词卡=真实 DeepSeek 释义+本地语料原文例句;复习间隔由记忆曲线驱动(非固定课表);文本词汇档案可反推学生词表掌握。
题目级题库 sde/item
算法自检 synthetic
IRT 题级标定 · CDM 连接型 Q 矩阵(一题多技能)
引擎原生题目级接口全打通:θ 恢复相关 0.92、技能 α 相关 0.79-0.85(合成自检)。真实数据转换器(item_data.py)就绪,接入后引擎零改动。synthetic 仅验证算法管线。
效果 A/B 框架 ab_test/
管线演示 synthetic
功效分析 · 分层随机 · Welch t / Cohen's d / Mann-Whitney
北极星 Δθ 的 RCT 统计管线(统计方法真实,p 值与 R 对照一致)。预注册样本量(MDE 0.2 → 每组 393 人);引擎内置结论规则:样本不足/不显著 → 输出"无证据",禁止话术。含上线检查清单。
家长端看板
演示源 synthetic
孩子卡在哪 + 可监督指标 + 趋势
"先关注 X —— 这不是粗心"式通俗诊断;掌握度趋势图;每天 2 分钟监督清单;效果增益区如实标注(无 A/B 前不做宣称)。
教师端看板
真实语料
教学干预起点 · 全班错因分布 · overlay 状态
CoNLL-2014 真实错因占比驱动干预选题(word_choice 30.6% → 干预起点 #1);用"类型占比"而非随卷漂移的得分率;复查占比下降 = 干预有效的诚实证据。
知因私教 · 缺口补齐交付 2026-09-03 | 模块:writing/ reading/ vocabulary/ ab_test/ sde/item_data.py + item_demo.py + app/make_portal.py | SOE 发音评测密钥已就位、新版 WSS 客户端真实联调通过(code=0)