跳到主要內容
AI News HubLIVE
站內改寫2 分鐘閱讀

AdaptVPR:面向魯棒視覺地點識別的路徑感知困難正樣本生成

文章摘要

視覺地點識別(VPR)常受光照、天氣、季節和動態遮擋等域偏移影響,同一地點在訓練數據中的外觀多樣性不足是主要原因之一。論文提出AdaptVPR,利用視覺語言模型分析場景屬性與編輯可行性,由規則調度器選擇全局外觀、局部遮擋或雙路徑三種生成路線,構造同地困難正樣本,並通過幾何一致性與外觀多樣性驗證降低結構漂移。所構建的AdaptCities包含16萬個驗證過的合成同地困難正樣本,多個VPR基準與視覺基礎骨幹實驗顯示最高可提升R@1達9.2%。

來源arXiv Computer Vision作者: Shunpeng Chen, Jingyi Zhang, Changwei Wang, Shengpeng Xu, Yukun Song, Xingtian Pei, Jinzhou Lin, Li Guo, Shibiao Xu
AdaptVPR:面向魯棒視覺地點識別的路徑感知困難正樣本生成
報告錯誤

更正渠道尚未開通,可先複製下方文章資訊留存。

查看更正說明
直接讀正文

《AdaptVPR: Route-Aware Hard Positive Generation for Robust Visual Place Recognition》由Shunpeng Chen與另外8位作者共同撰寫,於2026年9月3日以arXiv:2609.04369v1形式提交至計算機視覺與模式識別(cs.CV)方向。論文全長18頁,含9幅圖、9張表,並附有實驗性HTML版本與TeX源代碼。

視覺地點識別(Visual Place Recognition, VPR)通過檢索同一地點或鄰近地點的數據庫圖像來定位查詢圖像,是自動駕駛、機器人和增強現實等系統的重要基礎能力。然而真實場景中的光照、天氣、季節和動態遮擋會造成域偏移,使同一地點在不同時刻的影像外觀差異很大,模型容易出現檢索錯誤。論文指出,現有訓練數據對“同一地點的外觀多樣性”覆蓋不足,是導致VPR模型魯棒性下降的重要因素。

針對這一問題,AdaptVPR提出一種路徑感知的生成式增強框架。它先用視覺語言模型解析場景中的對象、語義和可編輯區域,對圖像適合進行何種編輯做出評估;隨後,規則式調度器依據可編輯性評分與風險約束,決定走哪條生成路線。具體生成被拆解為三條互補路徑:全局外觀路線負責改變天氣、光照與時間段等整體條件;局部遮擋路線在符合場景語境的位置插入汽車、行人等動態遮擋物;雙路徑路線同時施加全局與局部擾動,以得到更有挑戰性的外觀偏移。

為了不讓生成過程破壞地點識別所依賴的幾何結構,每個候選樣本都要經過面向VPR的驗證。驗證方案同時考察幾何一致性(避免結構漂移)和外觀多樣性(確保新增樣本有訓練價值)。其中,全局外觀候選只生成一次,驗證失敗即被丟棄;局部遮擋與雙路徑候選可在驗證反饋指導下進行有限的提示調整與重新生成。基於這套流程,研究團隊構建了包含16萬個經驗證的合成同地困難正樣本的數據集AdaptCities。

實驗部分使用了多種VPR基線模型和視覺基礎模型骨幹。結果表明,AdaptVPR在標準基準上均取得穩定增益,在域偏移明顯的挑戰性場景中尤為突出,Recall@1最高提升了9.2%。目前論文的源代碼與數據資源已在https://github.com/chenshunpeng/AdaptVPR公開,便於後續復現與應用。

展開要點與分析

文章情報

工程師進階

要點

  • AdaptVPR通過視覺語言模型與規則調度器生成同地困難正樣本,彌補VPR訓練數據外觀多樣性不足。
  • 全局外觀、局部遮擋和雙路徑三條互補路線分別模擬天氣光照變化、動態遮擋物以及兩者組合。
  • 候選樣本經幾何一致性與外觀多樣性雙重驗證,全局路線失敗即丟棄,局部與雙路徑路線可做有限提示重生成。
  • AdaptCities提供16萬個驗證合成樣本,在困難域偏移下R@1最高提升9.2%。

要點與分析由自動化流程生成,可能有誤,請結合原始來源核實。