AI News HubLIVE
站內改寫2 分鐘閱讀

AINTMA:面向自主測試管理的智慧體AI架構,融合生成式智慧、安全雲通訊與自適應質量分析

本文提出AINTMA(智慧體智慧測試管理架構),這是一個多智慧體AI系統,旨在將傳統測試管理轉變為自主質量智慧生態系統。該系統部署了六個專門的人工智慧代理(測試發現、風險評估、強化學習優先順序排序、執行編排、生成式質量智慧和雲安全監控),透過安全的雲原生微服務基礎設施進行協調。評估表明,在12個異構軟體專案上,測試優先順序排序準確率達88.4%,測試周期時間減少43%,缺陷逃逸率從8.3%降至2.1%,9個月投資回報率達340%。

來源arXiv AI作者: Vinil Pasupuleti, Shyalendar Reddy Allala, Siva Rama Krishna Varma Bayyavarapu, Shrey Tyagi, Srinivasateja Songa

現代軟體質量保證面臨分散式雲環境帶來的複雜性挑戰,傳統測試管理方法已難以滿足自適應決策的需求。針對這一問題,研究人員提出了AINTMA(Agentic Intelligent Test Management Architecture,智慧體智慧測試管理架構),這是一種創新的多智慧體AI系統,旨在將傳統的測試管理流程轉變為一個完全自主的質量智慧生態系統。

AINTMA的核心是六個專門化的人工智慧代理,它們透過安全的雲原生微服務基礎設施協同工作。具體來說,這六個代理包括:測試發現代理(自動識別和分類測試用例)、風險評估代理(評估缺陷的可能性和潛在影響)、基於強化學習的優先順序排序代理(將測試選擇建模為馬爾可夫決策過程,利用47個特徵和36個月滾動視窗的歷史資料學習上下文策略)、執行編排代理(協調測試執行流程)、生成式質量智慧代理(利用大語言模型生成通俗易懂的質量說明、缺陷風險摘要和資料增強的測試建議)以及雲安全監控代理(透過零信任API閘道器、OAuth2/JWT認證、加密代理間通訊和多租戶隔離確保整個系統的安全性)。這些代理的協作使得測試管理從人工驅動轉變為完全自動化。

研究團隊在18個月的時間跨度內,對12個異構軟體專案進行了全面的評估。結果顯示,AINTMA在測試優先順序排序方面的平均精確度(APFD)達到了88.4%,而隨機排序僅為51.2%,最佳商業基線為82.1%。測試周期時間減少了43%,缺陷逃逸率從8.3%大幅下降至2.1%。該架構的可擴充套件性表現優異,能夠支援超過50,000個測試用例,且響應時間低於400毫秒。生成式質量智慧模組在開發者有用性評分中獲得了4.3/5.0的高分。經濟分析表明,該系統在9個月內即可實現340%的投資回報率。

AINTMA的成功展示了智慧體AI在軟體質量管理領域的巨大潛力。透過將自主多智慧體協調、生成式智慧和安全智慧連線相結合,該系統為雲規模企業環境中的軟體質量保證提供了全新的解決方案。相關研究論文已提交至AICCONS會議,全文共11頁,包含2張圖表和4個表格,為業界提供了詳盡的技術細節和實驗資料。