arXiv論文メモ
新着一覧
cs.HC · 査読状況未確認

自分で取り組んでから生成AIを使える文章作成を検証する

Who Thinks First? Designing Productive Friction with Engage-to-Unlock GenAI

Xiaotian Su, Laura Rimell, Jiazheng Li, Amal Rannen-Triki, Ulrich Paquet, Lisa Anne Hendricks, Rida Qadri, Daphne Ippolito, Piotr Mirowski

この論文をやさしく読む

ひとことで言うと

生成AIをすぐ使えるようにする場合と、自分で課題に取り組んでから使えるようにする場合を、398人の文章作成実験で比べました。

何に役立つ?

文章作成支援ツールでAIを使えるタイミングを設計する際の参考になります。実験では、全体の時間を増やさずに、文章作成と誤り評価への時間配分が変わりました。

この研究の面白いところ

単に待たせる効果と、自分で取り組む効果を区別するため、利用者の取り組みとは無関係に同じ時刻に解放する比較条件を設けています。

どこまで分かった?

結果はこの文章作成・評価課題で得られたものです。要旨では長期的な学習効果や別の作業での効果は示されておらず、時間当たりの評価効率の高さをそのまま能力向上とみなすことはできません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

生成AIは文章作成を支援できるが、手間なく利用できると、利用者が自分の考えを育てる前に認知的な作業を外部に委ねてしまう可能性がある。本研究は、利用者が課題に意味のある形で取り組んだ後に生成機能を解放する、生産的な手間の仕組みEngage-to-Unlockを導入する。 398人を対象とした統制実験で、参加者は、人のみ、標準チャットボット、Engage-to-Unlock、時間を合わせた解放の4条件のいずれかで文章作成課題を行い、その後、文章中の根拠や推論の誤りを評価した。「時間を合わせた解放」では、Engage-to-Unlockの参加者に解放タイミングを合わせる一方、その利用者自身の取り組み方とは独立に機能を解放した。 結果は、Engage-to-Unlockが課題間の労力配分を変えることを示した。参加者は文章作成により多くの時間をかけ、評価にはより少ない時間をかけたが、課題全体の所要時間は増えなかった。また、ほかのAI支援条件より多くのプロンプトを送信し、時間当たりの正確さで測った評価効率は全条件で最も高かった。これらの結果は、人が早い段階で取り組むことを促すように生成AIへのアクセスを設計すれば、積極的なAI利用と効率的な後段の評価を保ちつつ、生産的な手間を与えられる可能性を示す。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-10-01(UTC)
最新改訂
2026-10-01 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Generative AI can support writing, but frictionless access may cause cognitive offloading before users develop their own ideas. We introduce Engage-to-Unlock, a productive-friction mechanism that unlocks generative capabilities after users meaningfully engage with the task. In a controlled experiment (N = 398), participants completed a writing task under one of four conditions: Human-Only, Standard Chatbot, Engage-to-Unlock, or Time-Matched Unlock, which matched unlock timing to Engage-to-Unlock participants but independent of users' engagement, then evaluated passages for evidence and inferential errors. Results show that Engage-to-Unlock redistributed effort across tasks: participants spent more time writing and less time evaluating, without increasing overall task duration. They also submitted more prompts than in other AI-assisted conditions and showed the highest accuracy-per-time evaluation efficiency across conditions. These findings suggest that designing GenAI access to encourage early human engagement may provide a productive form of friction, while retaining active AI use and efficient downstream evaluation.

著者のコメント

31 pages, 7 figures, 3 tables

arXiv ID: 2610.01518 / 要約の誤りについて