本文にスキップ
AI News HubLIVE
サイト内リライト2 分で読了

PAANI:河川ロボットシミュレーションのためのオンデバイス視覚証拠融合と説明可能なガイダンス

記事の要約

PAANI は、河川監視ロボット向けのオンデバイス知覚からガイダンスまでのアーキテクチャであり、Arduino UNO Q 上で YOLO11n 検出器と MobileNetV3 Small セマンティックセグメンターを組み合わせ、タイムスタンプ整合された証拠融合と明示的なコリドーポリシーによって検査可能なガイダンスを提供する。高い精度を示す一方で、モデル性能と検証済みの水上衝突回避を区別している。

ソースarXiv AI著者: Savio Cardoz, Santhiya Rajan
PAANI:河川ロボットシミュレーションのためのオンデバイス視覚証拠融合と説明可能なガイダンス
誤りを報告

訂正窓口はまだ利用できません。記事情報をコピーして保存できます。

訂正案内
本文へ

河川監視ロボットは、地理的なウェイポイントだけでは説明できない障害物や水際を解釈する必要がある。リソース制約のあるプラットフォームでは、不完全な視覚予測をタイムリーで検査可能なガイダンスに変換することが独自の課題となる。物体ラベルや操舵コマンドだけでは、どの証拠が意思決定を支えているのか、またその証拠がいつ信頼できないのかを説明できない。そこで研究チームは、デバイス上の知覚からガイダンスまでのアーキテクチャである PAANI を提案した。

PAANI は、プロジェクトで訓練された YOLO11n 検出器とカスタムの MobileNetV3 Small セマンティックセグメンターを Arduino UNO Q 上で組み合わせ、タイムスタンプで整合された証拠融合を行う。有界トラッキングが物体の持続性を提供し、明示的なコリドーポリシーが水面ラベル、受理された検出、緊急度、マスク不確実性を統合する。各最終アドバイザリは、寄与した証拠とポリシー理由を開示する。ROS 2 インターフェースがローカル AI パイプラインを、別個の Gazebo 船舶、位置推定、制御テストベッドに接続する。

訓練には、4 クラス検出用に 10,000 枚の WaterScenes 画像を、セグメンテーション用に 1,127 枚の MaSTr1325 画像(198 枚のセグメンテーション検証画像を含む)を使用した。選択された FP32 ONNX モデルは 14.817 MB を占める。検出器チェックポイントの 0.5 IoU でのテスト mAP は 0.7388 であり、別途評価された矩形 ONNX エクスポートは 0.5 IoU での検証 mAP が 0.7367 である。セグメンテーション ONNX の検証 mIoU は 0.9750 である。5 分間の UNO Q 記録では、0.5 Hz の設定ケイデンスで、パイプライン遅延の中央値と 95 パーセンタイルがそれぞれ 467.8 ms と 580.3 ms であった。

評価ではまた、黒色入力の誤分類と、サンプリングレートの不一致により診断用の見かけの動き推定器が十分な証拠を収集できない問題が特定された。これらの結果は、検査可能で再利用可能なエッジロボティクスの基盤を支持しつつ、モデル精度とオンボード実行を、検証済みの水上衝突回避とは明確に区別している。論文は 20 ページ、8 図、11 表で、システムと AI アーキテクチャ図、モデル訓練結果、定性的評価、Arduino UNO Q 展開測定を含む。プロジェクトコード、訓練済みモデル、ONNX アーティファクト、ログ、再現性ドキュメントは、論文で示されたリンクで入手可能である。本論文は cs.AI に分類され、arXiv:2609.22353 として、Santhiya Rajan により 2026 年 9 月 17 日に提出された。

要点と分析を開く

記事インテリジェンス

投資家上級

要点

  • PAANI は Arduino UNO Q 上で YOLO11n 検出と MobileNetV3 Small セグメンテーションの視覚証拠を融合する。
  • タイムスタンプ整合融合と明示的コリドーポリシーにより、各アドバイザリが証拠とポリシー理由を開示する。
  • モデルは 14.817 MB で、検出器 [email protected] は 0.7388、セグメンテーション mIoU は 0.9750。
  • 0.5 Hz で中央値遅延 467.8 ms、黒色入力の誤分類とサンプリングレート不一致の問題を特定。

要点と分析は自動生成され、誤りを含む場合があります。原典をご確認ください。