跳到正文
10月7日周三
  1. arXiv cs.CL55

    arXiv 论文:通过多轮强化学习解决 LLM 教学中的协助困境

    研究提出 Eduardo 多轮强化学习训练方案,引入掩码近迁移后测以抑制 LLM 导师直接告知答案的行为。Eduardo-27B 模型在 MathTutorBench 和 TutorMoments 上分别匹敌 Gemini-3.1-Pro 和 Claude Opus 4.8,且思考 token 消耗减少 2.4-6.2 倍。研究开源了训练环境、8671 题近迁移数据集及训练好的模型。

  2. arXiv cs.CL40

    AI 赋能选择题质量保障:自动化缺陷检测与评估综述

    该研究对自动化选择题缺陷检测、修订及心理测量筛查进行了叙述性综述,基于 14 份研究报告构建了 19 项标准评估框架。研究发现高标签准确率常伴随弱阳性案例检测,且现有修订证据混杂,无法确立修复效果。作者建议将质量保障视为独立验证决策序列,采用基于结果的评估方法。

  3. GitHub · AI 教育18

    Agentic AI Academy 开源课程发布

    Agentic AI Academy 发布开源课程,提供从设计到生产的全栈 AI 智能体工程实验室与参考架构。该体系包含 104 个跨 8 个领域的专家合成基准测试用例,支持 OpenAI、Anthropic 等提供商的 Provider-neutral 运行时。项目采用 30% 理论、50% 实施、20% 反思的学习路径,旨在培养具备安全、治理及可观测性能力的 AI 工程人才。

  4. GitHub · AI in 教育52

    Learning Commons 开源 Evaluators 工具集

    Learning Commons 开源了 Evaluators 工具集,旨在通过教育科学视角衡量 LLM 生成文本的属性。该工具包含文本复杂度、反馈质量、学术标准对齐和持久技能四个评估器家族,提供 Python 和 TypeScript SDK 以及本地运行环境,支持优化 AI 内容、监控模型表现及对比候选模型。

  5. GitHub · AI 教育40

    Braivo 开源自适应学习平台发布

    Braivo 是一个开源自适应学习平台,利用 AI 将现有教育内容转化为个性化 AI 导师。它通过记录学习者证据并更新知识估计,动态决定下一步学习路径(引入、重教或复习)。该平台支持自托管和 API 优先架构,允许机构以白标形式运行,目前处于预发布阶段,支持从 PDF 或视频字幕生成课程。

  6. GitHub · AI in 教育23

    melanie-ldi/genai-irr-calculator:基于浏览器的 GenAI 证据库 IRR 计算器

    melanie-ldi/genai-irr-calculator 是一个基于浏览器的评分者间信度(IRR)计算器,专为 GenAI 证据库系统文献综述设计。该工具以单文件 HTML 形式运行,无需安装,所有计算均在客户端完成。它支持上传 .csv、.xlsx 等编码表,自动检测版本并计算 Krippendorff's α,结果可导出为 CSV 或 Excel。

  7. GitHub · AI in 教育52

    Learning Commons 发布 Knowledge Graph 教育知识图谱平台

    Learning Commons 发布 Knowledge Graph,这是一个连接学术标准、课程和学习科学数据的结构化数据集集合。该平台采用标准化图模式,支持通过 REST API、MCP 服务器或本地文件访问,允许开发者无需构建数据管道即可开发 AI 驱动的教育工具。数据集涵盖美国学术标准、数学与 ELA 学习组件、学习进阶及 IM v.360 等课程资源,部分数据开放下载,部分需审批。

  8. The 7442

    观点:AI 进校园成“雷区”,国会如何助力 K-12 教育转型

    2026 年 6 月报告显示超 4/5 青少年使用 AI 工具,但学区缺乏资金与指导,导致实施风险激增。A-I Policy Forum 提出五项建议,包括建立国家技术援助中心、设立区域试点项目、将 AI 素养融入核心课程、更新联邦资金机制及启动创新资助。国会应通过针对性联邦资源支持地方,以应对 2030 年预计 65% 的技能转变。

10月6日周二
  1. GitHub · AI 教育42

    ai-xuexuele 发布:面向中小学生的本地部署互动自学应用

    ai-xuexuele 是一款面向中小学生的本地部署互动自学应用,包含 670 节课、18 个学科及 3905 道题,覆盖小学至高中全学段。应用采用“课本式讲解+参数互动演示”模式,AI 仅用于独立答疑,支持错题闭环与间隔复习。技术栈基于 Vite 7 与 React 19,通过 209 个单元测试验证,确保 670 课 0 错误。

  2. GitHub · AI 教育12

    ai-skill-lab 双语 Next.js 网站发布

    ai-skill-lab 发布面向成人、AI 构建者及 8-18 岁青少年的双语 Next.js 网站,提供一对一 AI 教育服务。当前静态版本通过 /api/lead 接口提交 JSON 数据至独立 ingress 服务,并保留 Telegram 等直接联系渠道。青少年申请仅使用成人联系方式,且未包含任何虚构的学员数据或收入声明。

  3. EdSurge35

    家长携AI工具参加IEP会议

    当家长在IEP会议上提出AI生成的问题或建议时,教育工作者表示透明度至关重要。 教师可以展现开放态度,询问相关建议,并将重点始终放在孩子的需求上。 https://www.edsurge.com/news/parents-are-bringing-ai-to-the-iep-meeting-heres-how-teachers-should-respond

  4. Ethan Mollick35

    AI学术写作缺乏反馈校准

    AI撰写的学术论文存在一个微妙的问题:AI并未针对反馈进行校准。AI往往直接妥协,但如果你提交论文进行评审,来自同行评审者的质疑应当促使你尝试捍卫自己的观点(当然,如果确实错了,还是要放弃)。

  5. Frontiers in Education42

    AI 介入高校课堂中教师与 AI 智能体沟通的迷你综述:基于互补-替代轴

    基于 2023 年后 32 项同行评审研究的迷你综述指出,教师沟通行为仍显著预测学生结果,元分析显示中到大效应量(r = 0.443)。学生使用人类沟通类别评估 AI 智能体,但在善意维度存在系统性差距,需通过即时性和礼貌线索弥补。当 AI 替代人际互动时,会引发孤独感和归属感下降等负面结果。

  6. Frontiers in Education33

    麻醉教育中人工智能作为建构主义支架:迷你综述

    该迷你综述基于建构主义学习理论,将人工智能定位为麻醉教育中需随学习者表现调整并逐步撤除的临时支架,而非自主教师。现有麻醉特异性研究在区域麻醉训练、超声解读及虚拟患者等场景展示了可行性,但尚未证实能提升临床推理或胜任力。AI生成的反馈与评分应视为有缺陷的决策支持,不得独立用于总结性评估或授权。

  7. Coursera Blog68

    Coursera 上线 10 门免费 Anthropic AI 课程

    Coursera 上线 10 门免费 Anthropic AI 课程,面向开发者、小企业主、创作者和教师。课程涵盖 Claude Code 101、AI Fluency for pK-12 Educators 等,旨在帮助学习者提升 AI 技能。

    推荐理由:课程覆盖开发者、教师及小企业主等角色,提供了从基础 AI 素养到具体工具应用的完整学习路径。

  8. Google for Education65

    特殊教师使用 Gemini 帮助无法书写的学生表达想法

    特殊教师使用 Gemini 为无法书写的学生生成视觉引导,并通过语音提示词帮助学生生成图像表达想法。作者正与同事合作开发一款整合特殊教育规划与编程的 AI 应用,旨在确保残疾不再决定学生的学习量。

    推荐理由:展示了特殊教师利用 Gemini 视觉引导与语音交互,帮助无法书写的学生表达想法并参与学习的具体路径。

  9. Google for Education62

    高校教师用 Gemini 替代传统编程测试,通过口头面试评估学生 AI 协作能力

    一位高校教师将数据挖掘课程的编程测试替换为关于学生如何使用 AI 解决问题的真实对话。学生使用 Google Colab 中的 Gemini 作为个人导师,需对 AI 建议的代码和替代方案进行判断、质疑并论证最终建模决策。教师通过口头面试让学生辩护其选择、排查问题并识别 AI 建议中的错误,同时利用 Gemini Canvas 和 Gemini Notebook 进行大规模评估。

    推荐理由:展示了如何用 Gemini 替代传统代码测试,通过口头面试评估学生对 AI 建议的判断力,为 AI 时代的编程评估提供了可迁移方法。