arXiv論文メモ
新着一覧
cs.CL · 査読状況未確認

バングラデシュ法令をスマートフォンで検索・回答する

Efficient LLM Distillation for Bangladesh Legal Context: A Smartphone-Compatible Retrieval-Augmented Generation Model

MD. Nafis Kamal, Mahadi Hasan Fahim, Talha Ridwan, Nadifa Zaman, Fariha Roushon Florin, Farig Yousuf Sadeque, Saadat Rafid Ahmed

この論文をやさしく読む

ひとことで言うと

バングラデシュの法令を根拠に、通信がないスマートフォンでも質問に答える小型モデルを作りました。

何に役立つ?

法令へのアクセス支援が想定用途です。端末上での動作と回答評価は報告されていますが、個別案件への法的判断を実証したものではありません。

この研究の面白いところ

教師モデルの蒸留と法令検索を組み合わせ、ベンガル語の質問から英語の法令を検索する評価も行っています。

どこまで分かった?

対象は制定法の解釈で、判例推論は対象外です。英語・ベンガル語の評価は各50問、法律家による評価は1名の予備試験で、文章類似度の改善は法的正確性の保証とは異なります。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

バングラデシュでは、法的情報に大多数の市民がアクセスできない。法令は英語のみで、訓練を受けた法律家は都市部に集中しており、クラウドに依存するAIはモバイル通信が不安定な場所で機能しない。このような状況では、誤って生成された法的文章が直接的な害をもたらす。本システムは法令の解釈だけを対象とし、司法上の先例や判例に基づく推論を要する質問は対象外とする。 法令へのアクセスの隔たりを埋めるため、2段階の漸進的な知識蒸留で、90億パラメータのGemma-2教師モデルを20億パラメータの生徒モデルへ圧縮する。第1段階では、品質基準を通過した9,429組の法的な質問と回答で教師あり追加学習を行う。これは生成した14,514件の質問の65%に当たる。第2段階では、温度τ = 4.0で教師モデルの各トークン上位50件のロジットに対する疎なカルバック・ライブラー発散を最小化し、QLoRA(4ビットNF4、ランク32のLoRAアダプター)で実装する。従来の法分野の言語モデルが一般的な法律英語を対象とするのに対し、本システムはバングラデシュの制定法に特化する。すべての回答は、バングラデシュ憲法と国内法の36,029の法令文章に対し、密な意味検索60%とBM25 40%を組み合わせたハイブリッド検索で根拠付ける。 英語50問のベンチマークでは、蒸留モデルはROUGE-L 0.4715、BERTScore F1 0.5679を達成した。検索拡張を行う未蒸留の基準モデルのROUGE-L 0.2323、BERTScore 0.2340に対し、それぞれ103%、143%の向上である。アダプターはGGUF Q4_K_M形式で1.6 GBに量子化され、ネットワークに接続せずPixel 6上で毎秒4〜8トークンの速度で動作する。ベンガル語50問による言語横断評価では、ROUGE-L 0.4083、BERTScore 0.8133を得て、ベンガル語の入力から英語のみのコーパスを有効に検索できることを示した。評価者1名の予備評価では、実務に就く法律家が50件の回答に重み付き平均4.16/5を付け、90%が4または5の評価だった。これは、文章の重なりを測る指標を超えた有用性を支持する。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-21(UTC)
最新改訂
2026-09-21 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Legal information in Bangladesh is inaccessible to most citizens. Statutory text is English-only, trained lawyers are concentrated in urban centres, and cloud-dependent AI fails where mobile connectivity is unreliable, a setting in which hallucinated legal text causes direct harm. The system addresses statutory interpretation only; queries that require judicial precedent or case-law reasoning fall outside its scope. We target the statutory access gap by compressing a 9-billion-parameter Gemma-2 teacher into a 2-billion-parameter student through two-phase progressive knowledge distillation. Phase 1 performs supervised fine-tuning on 9,429 quality-gated legal question-answer pairs (65% acceptance from 14,514 generated queries); Phase 2 minimises sparse Kullback-Leibler divergence against the teacher's top-50 per-token logits at temperature tau = 4.0, implemented via QLoRA (4-bit NF4, rank-32 LoRA adapters). Prior legal language models target general legal English; this system specialises in Bangladeshi statutory law. Every response is grounded through hybrid retrieval combining dense semantic search (60%) and BM25 (40%) across 36,029 statutory passages from the Bangladesh Constitution and national legislation. On a 50-query English benchmark, the distilled model reaches ROUGE-L 0.4715 and BERTScore F1 0.5679, a 103% ROUGE-L and 143% BERTScore gain over the retrieval-augmented undistilled baseline (ROUGE-L 0.2323, BERTScore 0.2340). The adapter quantises to 1.6 GB (GGUF Q4_K_M) and runs at 4-8 tokens per second on a Pixel 6 with no network access. Cross-lingual evaluation on 50 Bangla queries yields ROUGE-L 0.4083 and BERTScore 0.8133, showing effective retrieval from Bangla input against an English-only corpus. In a single-evaluator pilot, a practising lawyer rated 50 responses at a weighted mean of 4.16/5 (90% rated 4 or 5), supporting utility beyond text-overlap metrics.

著者のコメント

10 pages, 6 figures, 8 tables

arXiv ID: 2609.24177 / 要約の誤りについて