跳到正文
今天10月8日周四2 条
  1. arXiv cs.CY70

    arXiv 论文审计 LLM 生成数学应用题跨语言文化翻译的一致性

    该研究分析了 Claude Opus 4、GPT-4.1 和 Gemini 2.5 Pro 将 60 道英语数学应用题适配为孟加拉语、印地语等 7 种语言的过程。研究标注了 6,489 个实体转换,发现模型在转换类型上的一致率为 62.5%,在具体替换上仅为 33.5%。所有语言-模型组合均出现熵坍缩,导致文化多样性压缩而非扩展,且存在将孟加拉塔卡误用于印度学生等区域误配现象。

    推荐理由:研究通过语料级分析揭示了大模型在数学题文化适配中存在的多样性坍缩与区域误配问题,为评估AI教育内容的文化准确性提供了实证依据。

  2. arXiv cs.CY50

    双建议与单建议 AI 辅助放射影像判读对住院医师的影响:随机多读者研究

    一项在中国三家医院进行的随机多读者研究显示,双建议 AI 支持能更有效地缓解错误 AI 建议的影响。放射科住院医师在双建议支持下的准确率提升显著高于单建议组,而非放射科住院医师无显著差异。当 GPT-5.4 建议错误时,双建议组(含 Kimi-K2.6 或 Gemini-3.6 Flash)的准确率显著高于单建议组。

10月7日周三
  1. EdSurge · AI42

    编程如何培养深度公民参与

    一位教师将编程教学与公民参与结合,指导学生开发纪念伯明翰黑人先驱的交互式 iOS 应用。学生利用 Swift Playground 构建包含人物传记、趣味事实及数字档案的四屏应用,并借助 Gemini、Claude 和 ChatGPT 辅助历史研究。该项目旨在通过跨学科学习,将技术技能转化为社区叙事与公民行动的工具。

  2. Frontiers in Education52

    基于 AI 分析与专家评估同步的编程知识多因子评估模型研究

    该研究针对生成式 AI 普及带来的编程评估挑战,提出包含功能正确性、解释质量和 AI 使用水平的多因子评估模型。研究涉及哈萨克斯坦三所大学 187 名本科生,对比了 GPT-5.2、Claude Opus 4.5 和 Gemini 3 在基线(仅功能正确性)和多因子条件下的评估结果。

  3. arXiv cs.CL78

    K12-KGraph:面向教育大模型评测与训练的课标对齐知识图谱

    研究团队提出 K12-KGraph,一个从人教版数学、物理、化学、生物教材中提取的课程对齐知识图谱,涵盖 9 种节点和 14 种关系。基于该图谱构建了包含 23,640 道多选题的 K12-Bench 基准和 7,335 个样本的 K12-Train 微调数据集。

    推荐理由:该研究构建了基于人教版教材的知识图谱与评测基准,揭示了当前大模型在课程认知上的短板及微调改进路径。

  4. arXiv cs.CL55

    arXiv 论文:通过多轮强化学习解决 LLM 教学中的协助困境

    研究提出 Eduardo 多轮强化学习训练方案,引入掩码近迁移后测以抑制 LLM 导师直接告知答案的行为。Eduardo-27B 模型在 MathTutorBench 和 TutorMoments 上分别匹敌 Gemini-3.1-Pro 和 Claude Opus 4.8,且思考 token 消耗减少 2.4-6.2 倍。研究开源了训练环境、8671 题近迁移数据集及训练好的模型。

10月6日周二
  1. Google for Education65

    特殊教师使用 Gemini 帮助无法书写的学生表达想法

    特殊教师使用 Gemini 为无法书写的学生生成视觉引导,并通过语音提示词帮助学生生成图像表达想法。作者正与同事合作开发一款整合特殊教育规划与编程的 AI 应用,旨在确保残疾不再决定学生的学习量。

    推荐理由:展示了特殊教师利用 Gemini 视觉引导与语音交互,帮助无法书写的学生表达想法并参与学习的具体路径。

  2. Google for Education62

    高校教师用 Gemini 替代传统编程测试,通过口头面试评估学生 AI 协作能力

    一位高校教师将数据挖掘课程的编程测试替换为关于学生如何使用 AI 解决问题的真实对话。学生使用 Google Colab 中的 Gemini 作为个人导师,需对 AI 建议的代码和替代方案进行判断、质疑并论证最终建模决策。教师通过口头面试让学生辩护其选择、排查问题并识别 AI 建议中的错误,同时利用 Gemini Canvas 和 Gemini Notebook 进行大规模评估。

    推荐理由:展示了如何用 Gemini 替代传统代码测试,通过口头面试评估学生对 AI 建议的判断力,为 AI 时代的编程评估提供了可迁移方法。

  3. Google for Education15

    加州中学教师分享:AI 时代批判性思维优先

    一位加州中学技术教师指出,在 AI 时代应将批判性思维置于首位。该教师利用 Gemini 辅助课程规划与差异化教学,并将备课资料存储在 Google Drive 中。通过展示 AI 应用,教师帮助学生消除对未知的恐惧,强调 AI 仅反映人类设计,真正的力量源于人类的推理、质疑及批判性思维能力。

  4. Google for Education18

    教师如何利用 Google Sites、Gemini Notebook 和 Google Vids 培养学生批判性数字公民意识

    教师利用 Google Sites、Gemini Notebook 和 Google Vids 帮助学生从信息消费者转变为内容创造者。学生通过协作站点强化分析技能,利用自定进度笔记本学习,并制作创意视频展示想法。这一过程旨在赋予学生表达声音的机会,培养其批判性思维与协作能力。

10月5日周一
  1. Google for Education65

    Google 将 AI 教师培训扩展至英国和爱尔兰

    Google 宣布将免费 Google AI Educator Series 扩展至英国和爱尔兰的 65 万名教育工作者。该课程旨在帮助教师负责任地使用 AI 优化教案、简化行政事务并个性化教学,完成模块后可获得微证书。Google 还与 National Governance Association 合作推出 AI Policy Toolkit,协助学校治理者安全制定 AI 政策。

    推荐理由:Google 将免费 AI 教师培训扩展至英国和爱尔兰,并联合发布 AI 政策工具包,为教育管理者提供合规落地参考。

  2. Frontiers in Education42

    教师教育中 AI 与 UDL 的结合:为学习者差异设计包容性学习

    一项针对 45 名摩洛哥英语作为外语(EFL)职前教师的准实验研究显示,接受 UDL 结合 AI 工具培训组的课后教案评分显著高于对照组及仅接受 UDL 培训组。该研究指出,AI 工具有助于教师设计更具包容性的教学,但现有证据无法单独隔离 AI 的贡献,且结果受限于单一机构及评分标准。

10月4日周日
10月2日周五
  1. eTech Magazine · K-1265

    Google 推出专为教育打造的 AI 工具,Gemini 接入 Google Classroom

    Google 在其教育产品生态中推出了一系列专为教育场景设计的 AI 功能,核心是 Google Classroom 与 Gemini 的集成。通过 Gemini 中的 Classroom 连接应用,教师可以安全地访问班级上下文,使 Gemini 基于作业、学生表现或过往成绩等具体信息生成回答,从而加速 AI 驱动的洞察并节省教师时间。

  2. Google for Education42

    Google for Education 举办首届 Badge-a-thon:1400 名教师参与 AI 学习日

    Google AI Educator Series 举办首届 Badge-a-thon,1400 多名教师参与 10 小时直播活动,获得 4000 多个数字徽章。活动帮助教师掌握课堂 AI 工具,并提供将徽章转换为 CEU 和研究生学分的途径。所有 20 个会话现已在 YouTube 上线,并提供“Badge-a-thon in a Box”工具包供本地使用。

10月1日周四
9月29日周二
9月23日周三
9月22日周二
  1. Google for Education75

    Google.org 向 Digital Promise 提供 400 万美元资助以扩展教师免费 AI 培训

    Google.org 宣布向 Digital Promise 提供 400 万美元资助,以支持 Google AI Educator Series 项目,帮助美国 K-12 教师及高校教师获得免费、实用的 AI 技能培训。该计划旨在通过 Digital Promise 与州教育机构和社区学院合作,开发可扩展的 AI 专业发展模型,并分享关于高校教师有效使用 AI 的开放研究成果。

    推荐理由:Google.org 向 Digital Promise 提供 400 万美元资助,旨在通过免费培训帮助美国教师掌握实用 AI 技能。

9月19日周六
  1. Google for Education65

    Google AI Educator Series 新增大学学分与继续教育认证功能

    Google AI Educator Series 新增学分认证功能,允许参与者通过合作机构获取本科、研究生学分及继续教育学时。该功能通过与 College Unbound、ISTE 和 Dominican University 等机构合作实现,旨在帮助教师将 AI 技能转化为正式学术学分或执照更新学时。

    推荐理由:Google 将 AI 教师培训与大学学分及继续教育认证挂钩,为教师提供了技能提升与职业资质更新直接挂钩的新路径。

9月9日周三
  1. GitHub AI 教育开源精选74

    Taiwan Exam 发布 AI 生成台湾学测模拟考工具

    Taiwan Exam 发布了一款利用 AI 生成台湾学测原创模拟考的工具,支持 Claude、ChatGPT 和 Gemini 等平台。该工具能自动完成命题、解题验算及套用大考正式版面,最终交付题目 PDF 和答案详解 PDF。

    推荐理由:提供了基于大模型的台湾学测模拟考生成工作流,包含多模型实测数据与详细部署指南,为教师利用 AI 辅助命题提供了可复用的参考。

9月8日周二
  1. Google for Education68

    Google 与密苏里州合作提供 AI 工具与职业培训

    Google 宣布与密苏里州初等和中等教育局(DESE)及高等教育与劳动力发展局(DHEWD)建立全州合作,为近 10 万名教师和 110 多万 K-12 及高等教育学生提供免费的 Gemini for Education、Gemini Notebook 等 AI 工具及职业证书。

    推荐理由:该合作覆盖近 10 万教师与 110 万学生,提供了免费 AI 工具与职业证书,展示了州级 AI 教育落地的具体路径。

9月4日周五
8月28日周五
  1. Google for Education75

    Google 与 Khan Academy 合作推出 Khanmigo 交互式图表与教师可控练习工具

    Google 与 Khan Academy 合作,基于 Gemini 模型为 Khanmigo 推出交互式图表和重新设计的 Practice My Knowledge 工具。Khanmigo 现能生成可交互的数学和科学图表,学生拖动顶点时系统会实时调整课程;新练习工具允许教师上传资料、审核并编辑 Gemini 生成的题目,确保最终内容由教师决定。

    推荐理由:展示了 AI 如何从文本辅助转向交互式视觉引导,并确立了教师对 AI 生成内容的最终审核权。

8月24日周一
  1. Leon Furze45

    AI 使用评估:是技术的良好应用还是大脑的良好应用?

    Leon Furze 提出评估 AI 使用的两个核心问题:是否为技术的良好应用,以及是否为大脑的良好应用。作者指出 GenAI 能力远超聊天机器人,如代码执行与计算,需结合具体任务判断技术适配性。同时强调需反思自身认知负荷与技能发展需求,区分合理外包与过度依赖,以应对动态变化的个人状态。

8月19日周三
8月11日周二
  1. Leon Furze75

    澳大利亚 AI 监管与评估改革趋势分析:南澳成立皇家委员会与新州暂停无监督评估

    南澳州州长宣布成立澳大利亚首个 AI 皇家委员会,预计 2027 年 7 月 1 日前提交报告,预算约 300 万澳元。与此同时,新南威尔士州副州长致函 NESA,建议暂停高中 12 年级无监督的带回家评估任务,并要求在 2026 年第四学期前提供建议。作者分析指出,这两项举措反映了澳大利亚在 AI 监管上的不同策略:南澳采取先调查后行动,而新州则倾向于立即采取临时措施以保护学生利益。

    推荐理由:文章对比了南澳州成立皇家委员会与新南威尔士州暂停无监督评估的不同路径,揭示了监管节奏与教育评估体系之间的深层张力。