文化に対応する言語処理の研究375本超を整理する
CultureMINE: Datasets and Methods for Improving the Cultural Capabilities of NLP Systems
この論文をやさしく読む
ひとことで言うと
言語モデルなどが文化の違いを扱うための研究を、能力・データ・改善方法の三つの観点から整理した文献調査です。
何に役立つ?
関連研究を探したり、どの文化的能力やデータ作成方法を扱うか検討したりする際の資料になります。
この研究の面白いところ
論文を一覧化するだけでなく、目指す能力と使うデータ、改善手法を対応付けて整理し、追加投稿も可能な閲覧用サイトを公開しています。
どこまで分かった?
要旨には、特定した研究上の空白の具体例や、文献の選定基準の詳細はありません。新しい言語モデルの性能改善を実験で示したという報告ではありません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
近年、文化を扱う自然言語処理(Cultural NLP)への関心が急速に高まり、世界各地の人々を包摂する自然言語処理システムの構築に大きな努力が注がれている。この分野の文献が急増しているため、手法やデータ資源の動向を追うことが難しくなっている。 これに対処するため、375本を超える論文を分析し、相互に補い合う三つの問いに答える。(1)自然言語処理システムでは、どのような文化的能力(CC)が対象とされているか。(2)文化に関するデータ資源は、どのように作られているか。(3)システムの文化的能力を改善するために、どのような手法が使われているか。三つの問いを通じて見られる傾向を論じ、関連する研究上の空白を特定する。 この分野の研究をさらに促すため、分析した論文の全一覧を、対話的なウェブインターフェースの形で公開する。研究者が自身の研究を追加できる機能も備える。これが将来の研究を促進し、Cultural NLPの研究コミュニティにとって有用な資源になることを期待する。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-18(UTC)
- 最新改訂
- 2026-09-18 · v1
- 査読・掲載
- 掲載先の記載あり
著者による掲載先の記載:Proceedings of the Seventh Workshop on Natural Language Processing and Computational Social Science (2026), pp. 198-248。出版社での独立確認は未実施です。
更新履歴
- v1 2026-09-18 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
In recent years, there has been a surge of interest in Cultural NLP, with substantial efforts to create globally inclusive NLP systems. The rapid growth of literature in this field makes it difficult to track trends in methods and data resources. To address this, we analyze over 375 papers to answer three complementary questions: (1) What Cultural Capabilities (CCs) are being targeted in NLP systems? (2) How are cultural data resources being created? and (3) What methods are being used to improve the CCs of those systems? We discuss trends observed across the three questions, and identify relevant research gaps. To facilitate further research in this field, we release our full list of analyzed papers in the form of an interactive web interface, which includes a feature to allow researchers to add their work; we hope this facilitates future research and proves to be a valuable resource for the Cultural NLP community.
著者のコメント
Accepted to NLP+CSS 2026
arXiv ID: 2609.22494 / 要約の誤りについて