arXiv論文メモ
新着一覧
cs.CL / cs.AI / cs.CY · 査読状況未確認

教育動画の生成に理解度確認と誤解への対応を組み込む

From Content Generation to Learning Support: Pedagogy-Guided Generative Video Tutors for STEM Learning

Xinchen Ma, Shuimu Wang, Gaole He, Yanbin Zhang, Chunyang Wang, Yunshi Lan, Weining Qian

この論文をやさしく読む

ひとことで言うと

説明動画を作って終わりにせず、教える順序、内容の確認、理解度の評価、誤解への補習までをつなぐ仕組みです。

何に役立つ?

STEM教材を生成する際に、映像の見た目だけでなく、指導の流れや理解を確かめる機能を設計するために役立ちます。

この研究の面白いところ

授業の準備から理解度確認までの流れを生成工程に組み込みます。動画の完成度と学習支援としての質を分けて捉えている点が焦点です。

どこまで分かった?

四分野の実験と専門家評価で、学習に有効だという評価が得られています。学習者の成績向上を直接測定した結果や、長期的な学習効果は要旨に記載されていません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

生成AIは教育動画を大規模に作成できるようにするが、現在のシステムは学習の支援よりも、視覚的に整合した内容の生成に重点を置いている。そのため、生成動画には、明示的な教育上の構造、信頼できる品質管理、学習者の理解を評価したり誤解に対処したりする仕組みが欠けていることが多い。本研究では、学習を中心に据えた指導支援によってSTEM学習を支える、生成動画チュータリングの枠組みPIVOT(Pedagogy-guided Instructional VideO Tutoring)を導入する。 従来の授業の進め方に着想を得て、生成処理全体に教育原理を組み込む。まず指導原理によって絵コンテ生成を導き、次にコードを中心とした生成と教育上の検証基盤によって検証済みのマルチモーダル動画を作り、最後に動画を評価と誤解を考慮した補習へ結び付ける。四つのSTEM分野にわたる実験と専門家評価から、この枠組みは、教育上の目的に沿った内容、明確で興味を引く提示、一貫した指導の流れ、学習に有効だという評価を備えた教育動画を作ることが示された。 これらの結果は、教育コンテンツ生成を人間中心に捉える視点を示唆する。生成システムは、何を作るかだけでなく、教育実践、学習者の理解、修正のためのフィードバックをどのように支えるかという観点からも評価・設計すべきである。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-21(UTC)
最新改訂
2026-09-21 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Generative AI enables scalable production of educational videos, but current systems largely focus on producing visually coherent content rather than supporting learning. As a result, generated videos often lack explicit pedagogical structure, reliable quality control, and mechanisms for assessing learner understanding or addressing misconceptions. In this work, we introduce PIVOT (Pedagogy-guided Instructional VideO Tutoring), a generative video tutoring framework for STEM learning via learning-centered instructional support.1 Inspired by conventional teaching workflows, our framework integrates pedagogy into the full generation pipeline: it first uses instructional principles to guide storyboard generation, then produces verified multimodal videos through code-centric generation and a pedagogical verification harness, and finally connects videos with assessment and misconception-aware remediation. Experiments and expert evaluations across four STEM domains show that our framework produces educational videos with pedagogically aligned content, clear and engaging presentation, coherent instructional flow, and perceived effectiveness for learning. These findings suggest a human-centered perspective on educational content generation: generative systems should be evaluated and designed not only by what they produce, but also by how they support teaching practices, learner understanding, and corrective feedback.

著者のコメント

accepted to EMNLP 2026, code available at GitHub

arXiv ID: 2609.24083 / 要約の誤りについて