場面に応じた教師信号で自動運転の軌道を安定化
Stabilizing Trajectory Outputs in End-to-End Autonomous Driving via SC-IMM Based Teacher Signals
この論文をやさしく読む
ひとことで言うと
自動運転の学習に、場面に応じた進み方と速度の教師信号を追加する研究です。推論時の構造を維持しながら軌道を安定させます。
何に役立つ?
既存の経由点予測型モデルの学習改善に役立ちます。シミュレーターでは衝突頻度と動きの滑らかさに関する指標が改善しました。
この研究の面白いところ
場面ごとに複数の運動モデルの確率を更新し、その情報を補助学習へ使います。実行時の制御器を変更せずに改善する点が特徴です。
どこまで分かった?
結果はCARLA Town12の短い100経路の閉ループ評価です。実車や公道での安全性を実証した結果ではなく、その検証は要旨に記載されていません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
エンドツーエンド自動運転モデルは一般に、センサー入力から将来の経由点を予測し、後段の制御器で車両の制御指令へ変換する。しかし、従来の経由点に基づく模倣学習は主に座標単位の誤差を最小化するため、場面に応じた経路・速度の変化や、経由点出力にまたがる時間的な不安定性を捉えることが難しい。本論文では、この問題を緩和するため、場面条件付き相互作用多重モデル(SC-IMM)に基づく、軌道出力の安定化のためのオフライン教師信号生成・学習法を提案する。提案法は熟練者の軌道を経路・速度の状態に変換し、場面の手掛かりを条件としたIMM更新を行うことで、経路・速度の教師ラベルとモードの事後確率を生成する。生成信号は学習時に補助的な教師情報として元の軌道損失へ追加する一方、推論構造と経由点制御器は変更しない。CARLA Town12の短い100経路での閉ループ評価では、ベースラインより運転スコアが28.0%向上し、1km当たりの衝突数が62.3%減少するとともに、ジャークと軌道変動の指標も改善した。この結果は、場面に応じた運動モデルの手掛かりを組み込むオフライン教師信号が、軌道出力型の運転モデルを、より安定した閉ループ挙動へ導けることを示す。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-18(UTC)
- 最新改訂
- 2026-09-18 · v1
- 査読・掲載
- 掲載先の記載あり
著者による掲載先の記載:Journal of Institute of Control, Robotics and Systems, vol. 32, no. 9, pp. 1277-1284, Sep. 2026。出版社での独立確認は未実施です。
更新履歴
- v1 2026-09-18 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
End-to-End autonomous driving models commonly predict future waypoints from sensor inputs and convert them into vehicle control commands through a downstream controller. However, conventional waypoint-based imitation learning mainly minimizes coordinate-level errors, making it difficult to capture scene-dependent path-speed changes and temporal instability across waypoint outputs. In this paper, we propose an offline teacher-signal generation and learning method for trajectory-output stabilization based on a Scene-Conditioned Interacting Multiple Model (SC-IMM) to mitigate this issue. The proposed method converts expert trajectories into path-speed states and performs IMM updates conditioned on scene cues to generate path-speed teacher labels and mode posterior probabilities. The generated signals are added to the original trajectory loss as auxiliary supervision during training, while the inference structure and waypoint controller remain unchanged. In closed-loop evaluation on 100 short routes in CARLA Town12, the proposed method improved the driving score by 28.0% and reduced Collision/km by 62.3% compared with the baseline, while also improving jerk and trajectory-variation metrics. These results demonstrate that offline teacher signals embedding scene-conditioned motion-model cues can guide trajectory-output driving models toward more stable closed-loop behavior.
著者のコメント
9 pages, 5 figures, 4 tables
arXiv ID: 2609.21404 / 要約の誤りについて