arXiv論文メモ
新着一覧
cs.CV / cs.AI · 査読状況未確認

少数の見本から農作物の数と位置を推定

AgriCountDINO: Parameter-Efficient Exemplar-Guided Counting and Localization in Agriculture

Shengjie Guo, Xin Li, Borjana Arsova, Hanno Scharr, Silvio Salvi

この論文をやさしく読む

ひとことで言うと

少数の見本画像から農作物の個数と一つずつの位置を推定する方法。

何に役立つ?

植物やその器官の数を、種類ごとの再学習を抑えながら評価する手法の参考になる。

この研究の面白いところ

固定したDINOv3特徴を活用し、840万の学習パラメーターで数と位置を同時に扱う。

どこまで分かった?

数値はTPC-268とFSC-147での評価結果。実際の圃場のあらゆる撮影条件での性能は示していない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

植物やその器官の正確な数え上げと位置特定は、形質評価や収量推定に役立つが、対象の見た目、大きさ、密度は種や撮影条件によって大きく変わる。見本を囲む箱で対象を指定すれば、種類ごとの再学習なしで扱え、点での予測なら数に含めた個体の位置も示せる。著者らは、見本を手掛かりに数と位置を同時に推定する、学習パラメーターの少ないAgriCountDINOを提案する。固定した複数尺度のDINOv3特徴に、見本の見た目と大きさを条件として加え、段階的に対象の点へ復号する。見落とした対象の回復処理は最初の対応付けで見逃した対象まで教師信号を広げ、見本に適応した点の非最大値抑制は見本の尺度に応じて重複予測を除く。学習するパラメーターは840万で、TasselNetV4の約10分の1である。TPC-268ベンチマークでは、見本3つを使う平均絶対誤差が11.92で、数え上げ誤差を9.7%減らし、各対象の位置も示した。TPC-268だけで学習したモデルは、未見の一般物体カテゴリを含むFSC-147で追加学習なしの平均絶対誤差14.25を達成し、比較した最良のゼロショット手法より6.0%改善した。対象領域の学習や微調整は行っていない。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-24(UTC)
最新改訂
2026-09-24 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Accurate counting and localization of plants and their organs support phenotyping and yield estimation, yet target appearance, scale, and density vary widely across species and imaging conditions. Exemplar boxes specify the target without category-specific retraining, and point predictions identify the individual instances contributing to the count. We introduce AgriCountDINO, a parameter-efficient exemplar-guided framework for joint counting and localization. It conditions frozen multiscale DINOv3 features on exemplar appearance and size, then progressively decodes them into target points. Missed-object recovery extends supervision to targets overlooked by initial matching, and exemplar-adaptive point NMS filters duplicate predictions according to exemplar scale. With 8.4M trainable parameters, approximately one-tenth of TasselNetV4's, AgriCountDINO achieves a three-shot MAE of 11.92 on the TPC-268 benchmark, reducing counting error by 9.7\% while providing individual target locations. Trained only on TPC-268, it achieves a zero-shot MAE of 14.25 on unseen generic object categories in FSC-147, improving upon the best compared zero-shot method by 6.0\% without target-domain training or fine-tuning.

arXiv ID: 2609.29460 / 要約の誤りについて