跳到正文
今天10月8日周四3 条
  1. GitHub · AI 教育42

    Git-Kaushal/Claude-AI-Learning:面向高校教师与职场人士的 Claude 4 周实战课程

    Git-Kaushal/Claude-AI-Learning 发布了一个 4 周 Claude 实战课程样本版,面向高校教师及职场人士。课程包含 12 个课时,涵盖提示词、Artifacts 及 AI 内容审查等主题,采用 CC BY-NC-ND 4.0 协议。学员需通过 60% 以上测验解锁后续周次,完成 70% 以上评估题可下载结业证书。

  2. arXiv cs.CY70

    arXiv 论文审计 LLM 生成数学应用题跨语言文化翻译的一致性

    该研究分析了 Claude Opus 4、GPT-4.1 和 Gemini 2.5 Pro 将 60 道英语数学应用题适配为孟加拉语、印地语等 7 种语言的过程。研究标注了 6,489 个实体转换,发现模型在转换类型上的一致率为 62.5%,在具体替换上仅为 33.5%。所有语言-模型组合均出现熵坍缩,导致文化多样性压缩而非扩展,且存在将孟加拉塔卡误用于印度学生等区域误配现象。

    推荐理由:研究通过语料级分析揭示了大模型在数学题文化适配中存在的多样性坍缩与区域误配问题,为评估AI教育内容的文化准确性提供了实证依据。

  3. GitHub · AI 辅导38

    Concrete:面向 STEM 学科的本地优先 Markdown 学习工作区

    Concrete 是一款本地优先的 Markdown 工作区,专为 STEM 学科学习设计,支持将笔记转化为主动练习。用户可基于当前笔记生成多选、填空及代码题,并通过 Tutor 模式获取基于材料的解释。该工具支持连接 Codex 或 Claude agent 工作流,并允许在隔离沙箱中执行 Python 代码片段。

10月7日周三
  1. EdSurge · AI42

    编程如何培养深度公民参与

    一位教师将编程教学与公民参与结合,指导学生开发纪念伯明翰黑人先驱的交互式 iOS 应用。学生利用 Swift Playground 构建包含人物传记、趣味事实及数字档案的四屏应用,并借助 Gemini、Claude 和 ChatGPT 辅助历史研究。该项目旨在通过跨学科学习,将技术技能转化为社区叙事与公民行动的工具。

  2. Frontiers in Education52

    基于 AI 分析与专家评估同步的编程知识多因子评估模型研究

    该研究针对生成式 AI 普及带来的编程评估挑战,提出包含功能正确性、解释质量和 AI 使用水平的多因子评估模型。研究涉及哈萨克斯坦三所大学 187 名本科生,对比了 GPT-5.2、Claude Opus 4.5 和 Gemini 3 在基线(仅功能正确性)和多因子条件下的评估结果。

  3. arXiv cs.CL55

    arXiv 论文:通过多轮强化学习解决 LLM 教学中的协助困境

    研究提出 Eduardo 多轮强化学习训练方案,引入掩码近迁移后测以抑制 LLM 导师直接告知答案的行为。Eduardo-27B 模型在 MathTutorBench 和 TutorMoments 上分别匹敌 Gemini-3.1-Pro 和 Claude Opus 4.8,且思考 token 消耗减少 2.4-6.2 倍。研究开源了训练环境、8671 题近迁移数据集及训练好的模型。

  4. GitHub · AI in 教育23

    melanie-ldi/genai-irr-calculator:基于浏览器的 GenAI 证据库 IRR 计算器

    melanie-ldi/genai-irr-calculator 是一个基于浏览器的评分者间信度(IRR)计算器,专为 GenAI 证据库系统文献综述设计。该工具以单文件 HTML 形式运行,无需安装,所有计算均在客户端完成。它支持上传 .csv、.xlsx 等编码表,自动检测版本并计算 Krippendorff's α,结果可导出为 CSV 或 Excel。

10月6日周二
  1. Coursera Blog68

    Coursera 上线 10 门免费 Anthropic AI 课程

    Coursera 上线 10 门免费 Anthropic AI 课程,面向开发者、小企业主、创作者和教师。课程涵盖 Claude Code 101、AI Fluency for pK-12 Educators 等,旨在帮助学习者提升 AI 技能。

    推荐理由:课程覆盖开发者、教师及小企业主等角色,提供了从基础 AI 素养到具体工具应用的完整学习路径。

10月5日周一
  1. GitHub · AI 教育40

    StudioMeyer 开源 mcp-academy:在 AI 客户端中运行离线 AI 操作课程

    StudioMeyer 开源 mcp-academy,将包含 6 个级别、63 节课程及 104 个实战手册的“Memory-First AI Operator”课程打包为 MCP 服务器。该工具支持 Claude、ChatGPT 等客户端离线运行,无需 API 密钥或网络连接,提供德、英、西三语内容。用户也可通过 OAuth 登录托管服务以解锁进度追踪、测验及证书功能。

  2. Frontiers in Education42

    教师教育中 AI 与 UDL 的结合:为学习者差异设计包容性学习

    一项针对 45 名摩洛哥英语作为外语(EFL)职前教师的准实验研究显示,接受 UDL 结合 AI 工具培训组的课后教案评分显著高于对照组及仅接受 UDL 培训组。该研究指出,AI 工具有助于教师设计更具包容性的教学,但现有证据无法单独隔离 AI 的贡献,且结果受限于单一机构及评分标准。

10月4日周日
10月3日周六
9月30日周三
9月22日周二
  1. EdSurge78

    Learning Commons 发布面向 K-12 教育科技的开放 AI 平台

    Learning Commons 发布了一个面向教育者和开发者的开放平台,旨在解决教育科技产品中整合州学术标准和循证教学方法的难题。该平台包含 Knowledge Graph 和 Evaluators 两个主要组件,前者提供基于开放许可的 K-12 教育数据,后者用于衡量 AI 生成内容的准确性和年级适配性。

    推荐理由:平台整合了全美50个州的课程标准与评估工具,为教育科技开发者提供了对齐州标准的开放基础设施。

9月16日周三
9月9日周三
  1. GitHub AI 教育开源精选74

    Taiwan Exam 发布 AI 生成台湾学测模拟考工具

    Taiwan Exam 发布了一款利用 AI 生成台湾学测原创模拟考的工具,支持 Claude、ChatGPT 和 Gemini 等平台。该工具能自动完成命题、解题验算及套用大考正式版面,最终交付题目 PDF 和答案详解 PDF。

    推荐理由:提供了基于大模型的台湾学测模拟考生成工作流,包含多模型实测数据与详细部署指南,为教师利用 AI 辅助命题提供了可复用的参考。

9月6日周日
8月24日周一
  1. Leon Furze45

    AI 使用评估:是技术的良好应用还是大脑的良好应用?

    Leon Furze 提出评估 AI 使用的两个核心问题:是否为技术的良好应用,以及是否为大脑的良好应用。作者指出 GenAI 能力远超聊天机器人,如代码执行与计算,需结合具体任务判断技术适配性。同时强调需反思自身认知负荷与技能发展需求,区分合理外包与过度依赖,以应对动态变化的个人状态。

8月11日周二
  1. Leon Furze75

    澳大利亚 AI 监管与评估改革趋势分析:南澳成立皇家委员会与新州暂停无监督评估

    南澳州州长宣布成立澳大利亚首个 AI 皇家委员会,预计 2027 年 7 月 1 日前提交报告,预算约 300 万澳元。与此同时,新南威尔士州副州长致函 NESA,建议暂停高中 12 年级无监督的带回家评估任务,并要求在 2026 年第四学期前提供建议。作者分析指出,这两项举措反映了澳大利亚在 AI 监管上的不同策略:南澳采取先调查后行动,而新州则倾向于立即采取临时措施以保护学生利益。

    推荐理由:文章对比了南澳州成立皇家委员会与新南威尔士州暂停无监督评估的不同路径,揭示了监管节奏与教育评估体系之间的深层张力。

5月27日周三
11月10日周一
  1. IJAIED · AI 在教育中的应用65

    LLM 作为协作学习伙伴:一项关于大学生论证写作能力的探索性研究

    该研究在卡内基梅隆大学的一门社会科学入门课程中,让 154 名大学生在学期内五次完成“写作-LLM 批判-修改”的协作任务。结果显示,学生的论证写作、提示词工程及回应反馈能力均显著提升,且对 LLM 协作持积极态度。

    推荐理由:研究展示了 LLM 协作写作对大学生论证能力的提升效果,为课堂设计提供了可参考的实证依据。