商品検索で購入意図に合う商品を構造化注釈から学ぶ
Beyond Relevance: Structured Semantic Supervision for Product Search with LLM-Augmented Annotations
この論文をやさしく読む
ひとことで言うと
商品が検索語と関連するだけでなく、買いたいものの条件を満たすかを、属性や説明の注釈から学ぶ研究です。
何に役立つ?
商品検索のランキング学習で、どの種類の注釈が役立つかを検討する材料になります。特に通常は性能が低い難しいクエリでの改善に着目できます。
この研究の面白いところ
中心性の点数そのものより、人が編集した説明やコメントが性能向上に寄与した点です。
どこまで分かった?
評価はESCIの注釈拡充した部分集合です。人の特徴を直接使えるオラクル条件と、人を使わない条件は区別が必要です。nDCG@10は順位の評価であり、購入率や売上の実証値ではありません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
電子商取引の検索では、クエリに単に関連する商品と、利用者の買い物の意図を直接満たす商品とを区別する必要がある。本研究では、クエリと商品の組に対し、大規模言語モデル(LLM)が生成した構造化されたクエリ属性・商品属性と、人が検証した関連性、説明、中心性の判断を追加し、単純な二重エンコーダー検索器と多層パーセプトロン(MLP)再ランキング器でこれらの情報を評価する。 注釈を拡充したESCIの部分集合では、人による特徴を利用できるオラクル条件のnDCG@10は0.9382に達し、人の情報を使わずに学習したQ+P構成は0.9258に達する。人による情報を合成的に近似した場合、全体では0.9150だが、難しく性能の低いクエリには大きな改善をもたらす。要素を取り除く実験では、オラクル条件の改善の大部分は、中心性を表す単一の数値特徴ではなく、事後編集された説明と注釈者のコメントに由来することが分かった。この結果は、LLMが最も有用なのは、人の判断を直接置き換えることよりも、構造化された意味上の教師情報を明示し、それを近似することであると示唆する。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-20(UTC)
- 最新改訂
- 2026-09-20 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-20 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
E-commerce search requires distinguishing products that are merely related to a query from those that directly satisfy the user's shopping intent. We augment query-product pairs with structured LLM-generated query and product attributes and human-validated relevance, explanations, and centrality judgments, and evaluate these signals using a simple dual-encoder retriever and MLP re-ranker. On an augmented subset of ESCI, a human-feature oracle reaches $0.9382$ nDCG@10, while a human-free trained $Q+P$ configuration reaches $0.9258$. Synthetic approximations of the human signals reach $0.9150$ overall but provide substantial gains for difficult, low-performing queries. Ablations show that most of the oracle improvement comes from post-edited explanations and annotator comments rather than the scalar centrality feature, suggesting that LLMs are most useful for exposing and approximating structured semantic supervision rather than replacing human judgment directly.
著者のコメント
16 pages, 2 figures
arXiv ID: 2609.23646 / 要約の誤りについて