欧州人権裁判所の非財産的損害賠償額を予測する評価集
How Much is a Human Right Worth? ECtHR-NPD: A Benchmark for Predicting Non-Pecuniary Damage Awards
この論文をやさしく読む
ひとことで言うと
人権侵害に対する非財産的損害賠償の金額を、事件情報から予測できるかを比較するデータセットです。
何に役立つ?
法律文書から連続的な金額を予測するモデルの評価や、予測が苦手な事例の分析に役立ちます。
この研究の面白いところ
14,575件を時系列で分け、単純な特徴量モデルからエージェントまで同じ課題で比較しています。高度なモデルが常に優れるわけではありません。
どこまで分かった?
0円相当の賠償や高額の予測がすべてのモデル群で難しいと報告しています。実際の法的判断や適切な賠償額を決定する手法として有効性を示したものではありません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
既存の法律ベンチマークは多様な課題を扱うが、連続値である金銭的救済は比較的検討が少ない。欧州人権裁判所(ECtHR)において、法定の計算式や明示的な算定規則によって金額が決まらない非財産的損害(NPD)の賠償額を、事件情報から予測するベンチマークECtHR-NPDを導入する。著者らの知る限り、この種の最初のベンチマークである。ECtHR-NPDは、事件単位の名目ユーロ建ての賠償額を持つ14,575件を収録し、時系列に沿った分割と、目的変数の構築をモデル入力から分離する評価手順を備える。定数予測器、勾配ブースティング木、検索手法、微調整したエンコーダー言語モデル、プロンプトによるデコーダー言語モデル、知識を追加したエージェントなど、一連の手法を評価する。より高度な言語モデルやエージェント型手法が、最も強い特徴量ベースの比較手法を一貫して上回るわけではないことが結果から分かる。すべてのモデル群は、賠償額0の事例の識別と、高額な予測の較正に苦戦し、難しい事例を扱うChallengingテスト区分ではさらに悪化する。このためECtHR-NPDは、現代の最先端の公開重みモデルと独自の非公開言語モデルにとって難しい試験の場となる。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-16(UTC)
- 最新改訂
- 2026-09-16 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-16 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Existing legal benchmarks cover diverse tasks, while continuous monetary remedies remain comparatively underexplored. We introduce ECtHR-NPD, to the best of our knowledge, the first benchmark for predicting non-pecuniary damage (NPD) awards at the European Court of Human Rights (ECtHR) from case information when no statutory formula or explicit calculation rule determines the amount. ECtHR-NPD contains 14,575 cases with case-level awards in nominal euros, chronological splits, and a protocol separating target construction from model input. We evaluate a battery of methods, including constant predictors, gradient-boosted trees, retrieval methods, fine-tuned encoder language models (LMs), prompted decoder LMs, and knowledge-augmented agents. Our results show that more sophisticated LM and agentic approaches do not consistently outperform the strongest feature-based baseline. All model families struggle to identify zero awards and to calibrate high-award predictions, with further degradation on the Challenging test view, making ECtHR-NPD a challenging testbed for current state-of-the-art open-weight and proprietary LMs.
著者のコメント
EMNLP 2026 main conference paper. 28 pages, 5 figures
arXiv ID: 2609.18908 / 要約の誤りについて