跳到正文
  1. arXiv cs.CY70

    arXiv 论文审计 LLM 生成数学应用题跨语言文化翻译的一致性

    该研究分析了 Claude Opus 4、GPT-4.1 和 Gemini 2.5 Pro 将 60 道英语数学应用题适配为孟加拉语、印地语等 7 种语言的过程。研究标注了 6,489 个实体转换,发现模型在转换类型上的一致率为 62.5%,在具体替换上仅为 33.5%。所有语言-模型组合均出现熵坍缩,导致文化多样性压缩而非扩展,且存在将孟加拉塔卡误用于印度学生等区域误配现象。

    推荐理由:研究通过语料级分析揭示了大模型在数学题文化适配中存在的多样性坍缩与区域误配问题,为评估AI教育内容的文化准确性提供了实证依据。

  1. Coursera Blog68

    Coursera 上线 10 门免费 Anthropic AI 课程

    Coursera 上线 10 门免费 Anthropic AI 课程,面向开发者、小企业主、创作者和教师。课程涵盖 Claude Code 101、AI Fluency for pK-12 Educators 等,旨在帮助学习者提升 AI 技能。

    推荐理由:课程覆盖开发者、教师及小企业主等角色,提供了从基础 AI 素养到具体工具应用的完整学习路径。

  1. EdSurge78

    Learning Commons 发布面向 K-12 教育科技的开放 AI 平台

    Learning Commons 发布了一个面向教育者和开发者的开放平台,旨在解决教育科技产品中整合州学术标准和循证教学方法的难题。该平台包含 Knowledge Graph 和 Evaluators 两个主要组件,前者提供基于开放许可的 K-12 教育数据,后者用于衡量 AI 生成内容的准确性和年级适配性。

    推荐理由:平台整合了全美50个州的课程标准与评估工具,为教育科技开发者提供了对齐州标准的开放基础设施。

  1. GitHub AI 教育开源精选74

    Taiwan Exam 发布 AI 生成台湾学测模拟考工具

    Taiwan Exam 发布了一款利用 AI 生成台湾学测原创模拟考的工具,支持 Claude、ChatGPT 和 Gemini 等平台。该工具能自动完成命题、解题验算及套用大考正式版面,最终交付题目 PDF 和答案详解 PDF。

    推荐理由:提供了基于大模型的台湾学测模拟考生成工作流,包含多模型实测数据与详细部署指南,为教师利用 AI 辅助命题提供了可复用的参考。

  1. Leon Furze75

    澳大利亚 AI 监管与评估改革趋势分析:南澳成立皇家委员会与新州暂停无监督评估

    南澳州州长宣布成立澳大利亚首个 AI 皇家委员会,预计 2027 年 7 月 1 日前提交报告,预算约 300 万澳元。与此同时,新南威尔士州副州长致函 NESA,建议暂停高中 12 年级无监督的带回家评估任务,并要求在 2026 年第四学期前提供建议。作者分析指出,这两项举措反映了澳大利亚在 AI 监管上的不同策略:南澳采取先调查后行动,而新州则倾向于立即采取临时措施以保护学生利益。

    推荐理由:文章对比了南澳州成立皇家委员会与新南威尔士州暂停无监督评估的不同路径,揭示了监管节奏与教育评估体系之间的深层张力。

  1. IJAIED · AI 在教育中的应用65

    LLM 作为协作学习伙伴:一项关于大学生论证写作能力的探索性研究

    该研究在卡内基梅隆大学的一门社会科学入门课程中,让 154 名大学生在学期内五次完成“写作-LLM 批判-修改”的协作任务。结果显示,学生的论证写作、提示词工程及回应反馈能力均显著提升,且对 LLM 协作持积极态度。

    推荐理由:研究展示了 LLM 协作写作对大学生论证能力的提升效果,为课堂设计提供了可参考的实证依据。

已经到底了