arXiv論文メモ
新着一覧
cs.CL · 査読状況未確認

動機づけ面接AIは好評だが、持続的な行動変化の証拠は限定的

Generative Artificial Intelligence Chatbots for Motivational Interviewing: A Scoping Review From System Design to Intervention Outcomes

Runze Hu, Jingqi Kong, Yang Yang, Yihang Yang, Jingyao Liu, Haizhou Tang, Shanghang Zhang, Zheng Liu

この論文をやさしく読む

ひとことで言うと

生成AIによる動機づけ面接の48研究を整理すると、対話への好意的評価はある一方、長く続く行動変化を示す証拠は限られていました。

何に役立つ?

チャットボットの開発・評価で、対話の印象、MIの質、実際の行動成果を分けて検討する資料になります。長期比較や稼働中の安全監視という研究課題も整理しています。

この研究の面白いところ

利用者が共感や使いやすさを感じることと、行動や機能が持続的に変わることを切り分けています。直接利用のない設計研究も含め、証拠の段階を数で示しています。

どこまで分かった?

介入成果を報告したのは18研究で、多くは単回セッション後です。尺度も異なり、安全対策の報告も不均一なため、好意的な利用者評価を長期的な臨床効果の確立とは見なせません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

動機づけ面接(MI)は、健康行動の変化に向けて自律的な動機を引き出す、協働的なアプローチである。生成AI(GenAI)は、対話システムを通じてMIを提供する新しい方法をもたらすが、その設計、評価、介入への展開に関する証拠は断片的である。本スコーピングレビューでは、GenAIを用いたMIチャットボットについて、システム設計、安全性、MIの質、利用者の受け止め方、介入成果にわたる証拠を整理した。 PRISMA-ScRに沿ったスコーピングレビューを実施した。2015年1月1日から2026年6月2日までに出版または一般公開され、MIチャットボットの応答またはカウンセラーの発話の生成にGenAIを用いた研究を対象に、九つのデータセットを検索した。事前に定めた枠組みでデータを抽出し、記述的に統合した。47報、48研究を採用した。20研究(41.7%)は参加者による直接利用を伴わないシステム設計を扱い、28研究(58.3%)は直接の対話を含んだ。大部分はテキスト形式で身体的な実体を持たないシステムであり、23研究(47.9%)は動的な適応を組み込んでいた。安全対策の報告にはばらつきがあった。直接利用のある研究のうち、21/28(75.0%)がインフォームド・コンセントまたは利用者教育を報告した。 30研究(62.5%)がMIの質を評価し、全体としてMIに沿った対話が示唆された。評価尺度は多様だったものの、利用者の受け止め方は好意的で、特に共感、使いやすさ、有用性、利用意向が高く評価された。18研究(37.5%)が介入成果を報告したが、その多くは1回のセッション後の結果だった。肯定的な知見は、持続的な行動変化や機能的変化よりも、短期的な動機づけで一貫していた。 GenAIによるMIチャットボットは、利用者に好意的に受け止められる、MIに沿った対話を提供できるが、持続的な行動や機能の変化を示す証拠は限られている。今後の研究では、稼働中の安全性監視を強化し、MIの質の評価を標準化し、行動と機能の成果を含む長期的な比較研究を行うべきである。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-17(UTC)
最新改訂
2026-09-17 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Motivational interviewing (MI) is a collaborative approach to elicit autonomous motivation for health behavior change. Generative AI (GenAI) offers new ways to deliver MI via conversational systems, but evidence on their design, assessment, and translation into interventions remains fragmented. This scoping review characterized evidence on GenAI-MI chatbots across system design, safety, MI quality, user perceptions, and intervention outcomes. We conducted a PRISMA-ScR scoping review. Nine datasets were searched for studies published or publicly available from January 1, 2015 to June 2, 2026 that used GenAI to generate MI chatbot responses or counselor utterances. Data were extracted using a predefined framework and synthesized descriptively. Forty-seven reports (48 studies) were included. Twenty (41.7%) focused on system design without direct participant use; 28 (58.3%) involved direct interaction. Most systems were text based and disembodied; 23 (47.9%) incorporated dynamic adaptation. Safety measures were unevenly reported. Among studies with direct use, 21/28 (75.0%) reported informed consent or user education. Thirty (62.5%) assessed MI quality, generally suggesting MI-consistent interactions. User perceptions were favorable, especially empathy, usability, helpfulness, and intention to use, though measures were heterogeneous. Eighteen (37.5%) reported intervention outcomes, mostly after a single session. Positive findings were more consistent for short-term motivation than sustained behavioral or functional change. GenAI-MI chatbots can deliver MI-consistent interactions perceived favorably, but evidence for sustained behavioral or functional change is limited. Future research should strengthen runtime safety monitoring, standardize MI quality assessment, and use longer-term comparative designs with behavioral and functional outcomes.

arXiv ID: 2609.20902 / 要約の誤りについて