精选

8月25日 · 周二
最新精选

8月24日周一

8月22日周六

8月21日周五

8月25日

星期二 · 2 条
04:04
OpenAI Academy:教育动态(RSS)精选
AI 评分 62/100
ChatGPT Edu 升级:面向学校的 AI 助教新增「分层提示词」与作业防作弊双机制

OpenAI 面向高校的 ChatGPT Edu 版本更新,新增按学生学段分层的提示词模板,并上线作业过程留痕与 AI 生成文本检测双机制,帮助教师区分「辅助」与「代写」。该版本同步开放课堂数据分析看板,可按班级维度统计提问质量与知识薄弱点。


推荐理由:把「分层提示词 + 过程留痕」并置,说明 AI 助教落地课堂的瓶颈已从模型能力转向「如何证明学生在学」,对采购教育 AI 的院校是可复用的功能清单。
03:56
可汗学院 Khan Academy(Blog)精选
AI 评分 68/100
Khanmigo 发布「苏格拉底式追问」2.0:AI 导师不再直接给答案

可汗学院宣布 Khanmigo 升级苏格拉底式教学策略,AI 导师在数学与写作场景中不再直接给出答案,而是通过连续反问引导学生自行推导,并可识别学生「卡壳」类型(概念不清、计算失误、读题偏差)切换引导路径。


推荐理由:把「不给答案」从一句口号变成可识别的卡壳分类与路径切换,是 AI 导师与「搜题软件」拉开差异的关键设计,对做自适应学习的团队有直接借鉴意义。

8月24日

星期一 · 3 条
23:27
教育部:政策发布(RSS)精选
AI 评分 75/100
教育部发布《中小学人工智能通识教育指南》:AI 素养纳入必修

教育部印发《中小学人工智能通识教育指南》,明确小学以体验感知、初中以理解应用、高中以创作评价为主的分学段目标,并将 AI 伦理与安全作为独立模块。指南同时要求加强教师 AI 素养培训,避免「只装设备、不教思维」。


推荐理由:分学段目标 + 伦理独立模块,把「AI 进课堂」从设备采购导向转向课程与素养导向,是观察各省市落地节奏与配套经费的基准文件。
23:24
Google for Education(Blog)精选
AI 评分 64/100
Google Classroom 接入 Gemini:一键生成分层作业与个性化反馈

Google Classroom 集成 Gemini 能力,教师可一键按学生水平生成分层作业与个性化反馈,系统自动识别需要补差的学困生并推荐干预策略。官方称试点班级的教师批改时间平均下降约 40%。


推荐理由:把「个性化」落到「分层作业 + 补差干预」的具体动作,且给出批改时间下降 40% 的量化锚点,为评估教师端 AI 工具的投入产出提供了参照。
22:54
多鲸资本:教育科技周报精选
AI 评分 58/100
全球 AI 教育融资半年超 40 亿美元,自适应学习与 AI 口语陪练最受追捧

报告显示,2026 上半年全球 AI+教育赛道融资超 40 亿美元,其中自适应学习平台与 AI 口语陪练成为最受资本追捧的细分方向,K12 课后辅导与成人职业教育各占约三成。融资集中在少数头部项目,马太效应明显。


推荐理由:把热度从「AI 概念」拆到「自适应学习 / 口语陪练」两个可验证付费意愿的细分,提醒从业者资本集中的马太效应比总量更值得关注。

8月23日

星期日 · 2 条
22:24
微软教育 Microsoft Education(Blog)精选
AI 评分 66/100
微软推出 Reading Coach 中文版:AI 朗读纠正覆盖普通话声调

微软教育上线 Reading Coach 中文版,AI 朗读教练可识别普通话声调、断句与情感表达并给出逐字纠正,覆盖普通话与部分方言口音。产品面向 6-14 岁学生免费开放,教师端可查看班级朗读水平分布。


推荐理由:把语音识别从「对不对」细化到「声调、断句、情感」的逐字纠正,是 AI 口语测评从玩具走向教学工具的分水岭,中文口音覆盖是落地关键。
08:56
EdSurge(RSS)精选
AI 评分 72/100
一线教师真实反馈:用了半年 AI 备课工具,我反而更忙了

EdSurge 采访多国一线教师后发现,AI 备课工具虽能快速生成教案,但教师仍需逐条核验事实、调整学情适配,部分人花费的时间不降反升。文章指出,工具的价值取决于「默认输出质量」与「信任边界」是否清晰。


推荐理由:把「AI 提效」的叙事拉回教师的真实时间账,指出信任成本是隐形开销,为教育 AI 产品的「默认质量」与「可核验性」提出了更高的产品要求。

8月22日

星期六 · 5 条
22:24
斯坦福 HAI:研究简报精选
AI 评分 70/100
大规模随机对照:AI 导师让低收入学区数学成绩提升 0.4 个标准差

斯坦福 HAI 发布一项覆盖数万名学生的随机对照研究,使用 AI 数学导师的低收入学区学生成绩平均提升 0.4 个标准差,效果接近一对一人工辅导的一半,但成本仅为后者的约 1/20。


推荐理由:给出「0.4 个标准差 + 成本 1/20」的可比量纲,把 AI 导师的争论从「是否有效」推进到「效费比是否足以规模化」,是政策采购最需要的证据类型。
04:05
Duolingo:官方博客精选
AI 评分 61/100
Duolingo 上线 AI 语法纠错教练:解释「为什么错」而不只是「改对」

Duolingo 推出 AI 语法纠错教练,不仅改正句子,还用学习者母语解释错误背后的语法规则,并生成针对性的巩固练习。该功能优先覆盖中文、日语等英语学习者规模较大的市场。


推荐理由:把纠错从「改对」升级到「解释为什么 + 针对性巩固」,直击语言学习遗忘曲线的核心,说明可解释性正成为消费级教育 AI 的标配能力。
01:58
好未来(学而思):官方发布精选
AI 评分 63/100
学而思发布自研教育大模型「九章」3.0:主打数学推理与分步讲解

学而思发布教育大模型九章 3.0,聚焦数学推理与分步讲解,在高考数学真题与竞赛题的「过程可解释性」评测上领先通用模型。模型同时开放 API,供第三方教育机构接入个性化出题与答疑。


推荐理由:把竞争点从「刷分」转向「过程可解释」与「分步讲解」,契合家长与教师对数学辅导的核心诉求,也为教育大模型建立了差异化评测维度。
01:56
北师大智慧学习研究院精选
AI 评分 55/100
研究:AI 写作助手可能削弱学生论证能力,但「受限模式」可缓解

北师大团队研究发现,无条件使用 AI 写作助手的学生在后续独立写作中论证深度下降,但采用「先列提纲、AI 仅润色」的受限模式可基本消除该负面效应。研究建议教师明确 AI 使用的场景边界。


推荐理由:把「AI 是否损害能力」的争论细化为「何种使用方式损害/缓解」,受限模式的可操作定义(先提纲、仅润色)为课堂政策提供了可落地的边界。
01:56
LMSYS 教育评测(Chatbot Arena 教育版)精选
AI 评分 60/100
教育大模型排行榜更新:中文小学数学讲解能力成为新分水岭

教育版 Chatbot Arena 更新榜单,新增中文小学数学分步讲解评测维度后,多个通用大模型排名出现明显分化,专门针对教育场景微调的模型在「讲解耐心」与「错误识别」上表现更优。


推荐理由:引入「讲解耐心」「错误识别」等教育特有维度后排名剧烈分化,说明通用榜单无法替代教育场景评测,也为选型提供了更贴近课堂的参考。

8月21日

星期五 · 8 条
22:28
Coursera:Blog精选
AI 评分 67/100
Coursera 推出 AI 职业导师:基于技能图谱规划终身学习路径

Coursera 上线 AI 职业导师,基于用户的技能图谱与目标岗位的技能缺口,动态规划学习路径并推荐课程组合,覆盖从职业转型到晋升的长期规划。早期数据显示路径完成率较自由选课提升约 30%。


推荐理由:把「推荐课程」升级为「技能缺口驱动的路径规划」,并用完成率提升 30% 佐证,为终身学习平台从内容电商转向能力服务提供了可量化的方向。
22:06
Hugging Face:Blog(RSS)精选
AI 评分 69/100
开源教育评测集 EdBench 发布:覆盖 12 种语言的课堂问答与作业批改

Hugging Face 联合多所高校发布开源教育评测集 EdBench,覆盖 12 种语言的课堂问答、作业批改与教案生成任务,并提供教师评分与 AI 评分的对齐基线,旨在推动教育大模型的可比性评测。


推荐理由:把教育模型评测从「各说各话」拉到「跨语言 + 教师对齐」的开放基线上,教师评分与 AI 评分的对齐是区分「会答题」与「会教学」的关键信号。
21:07
讯飞星火:教育发布精选
AI 评分 65/100
讯飞发布 AI 口语评测 5.0:支持方言识别与跨文化交际纠偏

科大讯飞发布 AI 口语评测 5.0,新增方言识别与跨文化交际表达纠偏,覆盖中高考英语口语、普通话测试与留学面试等场景,宣称评测结果与人工考官的相关性达 0.95。


推荐理由:「方言识别 + 跨文化纠偏 + 与考官相关性 0.95」三者并置,说明口语评测的竞争已从打分准确性转向覆盖真实语言生态的广度。
17:56
联合国教科文组织 UNESCO:教育精选
AI 评分 74/100
UNESCO 呼吁建立全球 AI 教育伦理框架:警惕「数字鸿沟」加深

UNESCO 发布报告,呼吁各国建立 AI 教育伦理框架,重点防范生成式 AI 在教育中加深「数字鸿沟」——资源匮乏地区的学生可能同时失去数据、算力与优质师资的三重红利。报告提出 12 项可操作的治理建议。


推荐理由:把 AI 教育的公平性议题具体化为「数据、算力、师资三重鸿沟」,为政策制定者提供了超越单一技术视角的治理清单,也提醒商业产品关注普惠责任。
17:26
DeepSeek:API 更新日志精选
AI 评分 60/100
DeepSeek 推出教育微调接口:一键定制学科专属答疑模型

DeepSeek 上线面向教育开发者的微调接口,机构可基于少量学科题库快速定制专属答疑模型,支持解题步骤约束与知识点溯源,降低中小机构自建学科模型的门槛。


推荐理由:「少量题库 + 步骤约束 + 知识点溯源」的组合,把教育大模型从通用能力推向机构可负担的学科定制,是教育 AI 基础设施下沉的信号。
04:27
网易有道:官方博客精选
AI 评分 62/100
有道推出 AI 全科作业辅导「小 P 老师」:拍照即得分层讲解

网易有道发布 AI 作业辅导产品「小 P 老师」,学生拍照上传题目即可获得按学力分层的讲解,家长端同步查看知识点掌握度与专注时长。产品强调「讲思路不给答案」,覆盖 K12 全科。


推荐理由:「拍照即得 + 分层讲解 + 家长看板」形成从学生到家长的产品闭环,而「讲思路不给答案」的自我约束,回应了作业辅导场景最敏感的伦理争议。
03:38
Duolingo:官方博客精选
AI 评分 80/100
Duolingo Max 用户破 5000 万:AI 角色扮演对话成为留存引擎

Duolingo 宣布其 AI 订阅版 Duolingo Max 用户突破 5000 万,其中 AI 角色扮演对话功能被官方称为「留存引擎」——参与过角色扮演的用户次日留存率高出平均值约 18 个百分点。


推荐理由:用「留存率 +18 个百分点」量化 AI 角色扮演对学习动机的拉动,把「有趣」变成可衡量的留存指标,为语言学习产品验证了 AI 互动的商业价值。
01:56
Anthropic:教育 Blog精选
AI 评分 59/100
Claude 推出教育版「Claude for Education」:默认开启防作弊与引用溯源

Anthropic 发布 Claude for Education,面向学校默认开启防作弊保护与引用溯源,教师可查看学生与 AI 的完整交互过程。官方同步推出 AI 教学法资源库,强调以问题为中心而非功能操作为中心的教学。


推荐理由:「默认防作弊 + 交互过程可查 + 问题中心教学法」的打包思路,把教育 AI 的信任机制从可选开关变成默认配置,为机构采购提供了更低的合规门槛。