arXiv論文メモ
新着一覧
cs.NI / cs.AI · 査読状況未確認

分散エージェントの機能を少ない検索で見つける索引

SemDHT: Certified Semantic Discovery for Peer-to-Peer Agent Networks over Exact-Key DHTs

Taotao Wang, Chonghe Zhao, Shengli Zhang, Soung Chang Liew

この論文をやさしく読む

ひとことで言うと

分散したエージェントやAPIから必要な機能を探すため、意味に基づく検索と、登録先のキーを検証する仕組みを組み合わせた索引です。検索範囲を広げすぎず、取りこぼしも抑えることを目指します。

何に役立つ?

考えられる用途は、中央の一覧に依存せずに外部ツールやエージェントを探すサービスです。要旨では検索の再現率・回数と200ピア環境での完了時間を評価しています。

この研究の面白いところ

検索の効率だけでなく、提供者が多くのキーへ無制限に登録して目立とうとする問題も扱います。意味の粗い分類と細かい残差表現を使い、検索予算に応じて精度重視から範囲重視へ進めます。

どこまで分かった?

再現率の数値には埋め込み近傍とToolBenchラベルという別々の正解基準があります。7.7倍の検索回数差は密度を制御したコーパス、時間差は299検索・200ピア・空の証明書キャッシュという条件での結果です。API自体の品質や安全性の認証を示すものではありません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

エージェントは、外部エージェントの接続先やサービスAPIを通じて提供される機能を必要とする場合がある。要求側が特定の提供者にあらかじめ結び付いていない場合、タスクとインターフェースの要件に合う、公開された機能を発見しなければならない。完全一致キー型の分散ハッシュテーブル(DHT)では、広く検索すると大きな候補一覧が転送される一方、選択的に検索すると適切な提供者を見落としたり、複製や検索回数を増やしたりする必要がある。また、公開の範囲を強制できなければ、自由な登録によって提供者が自らの露出を過大に増やせる。 完全一致キー型DHT上で、エージェントから利用可能な機能を発見するための、認証付き意味索引SemDHTを提案する。2層の意味スケッチは、粗いセルで近い記述子をまとめ、残差コードで候補選択を絞り込む。提供者は導出された有限範囲のキー集合に登録し、要求側は検索回数の予算内で、より広い再現率重視のキーより先に精度重視のキーを探索する。アンカー委員会が各記述子の登録キー集合を認証し、ストレージサービスと要求側が記述子とキーの整合性を強制できるようにする。 実際のAPI記述子とタスク検索文では、厳密な埋め込み空間の近傍を基準とするrecall@10が0.955、ToolBenchの関連性ラベルを基準とする値が0.947となった。密度を制御して増強したコーパスでは、再現率0.95で、DHT上の調整済み局所性鋭敏型ハッシュ(LSH)と同等の候補露出を7.7分の1の検索回数で達成し、登録の分散先数を16から10へ減らした。Go/libp2pによる試作を、同一リージョン内および複数リージョンにまたがる200ピアのクラウド・オーバーレイへ展開し、299件のインターネット検索要求を再実行した。並列探索と証明書キャッシュが空の条件で、SemDHTの平均完了時間はLSHに対して、それぞれ3.64倍、4.11倍の高速化を達成した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-20(UTC)
最新改訂
2026-09-20 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Agents may need capabilities exposed through external agent endpoints or service APIs. When a requester is not already bound to a provider, it must discover advertised capabilities matching its task and interface requirements. Over exact-key distributed hash tables (DHTs), broad retrieval transfers large candidate lists, whereas selective retrieval may miss relevant providers or require more replication and lookups. Open publication also lets providers inflate their exposure unless publication bounds are enforceable. We present SemDHT, a certified semantic index for discovering agent-accessible capabilities over exact-key DHTs. A two-layer semantic sketch uses coarse cells to group nearby descriptors and residual codes to narrow candidate selection. Providers publish at a bounded set of derived keys, while requesters probe precision keys before broader recall keys within a lookup budget. Anchor committees certify each descriptor's publication-key set, enabling storage services and requesters to enforce descriptor-to-key consistency. On real API descriptors and task queries, SemDHT achieves recall@10 of 0.955 against exact embedding-space neighbors and 0.947 against ToolBench relevance labels. On a corpus with controlled density augmentation, it matches the candidate exposure of tuned locality-sensitive hashing (LSH) over a DHT at recall 0.95 with 7.7x fewer lookups and reduces publication fan-out from 16 to 10. A Go/libp2p prototype deployed on same-region and cross-region 200-peer cloud overlays replays 299 Internet queries. With parallel probes and cold certificate caches, SemDHT achieves mean completion-time speedups of 3.64x and 4.11x over LSH, respectively.

著者のコメント

29 pages, 10 figures, 13 tables

arXiv ID: 2609.23539 / 要約の誤りについて