AI News HubLIVE

AI 新聞即時情報

即時監測

今天 AI 世界最重要的變化

來自 105 個可信來源,最近更新 2026-05-22 12:00 UTC+8。

即時監測

即時更新

即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。

即時更新

重設
$ECUAS_n$:一種用於原則性評估不確定性增強系統的度量族

在高風險自動化決策中,預測不確定性對使用者接受或拒絕預測至關重要。當前不確定性增強(UA)系統的評估方法存在不足,本文提出ECUAS_n度量族,將其表述為適當評分規則,引數n控制錯誤預測成本與不完美不確定性之間的權衡。實驗證明其優勢。

arXiv AI研究 / 創業融資站內正文
用於Horn邏輯推理的高質量嵌入

本文介紹了幾種生成高質量嵌入的方法,以提升神經網路在Horn邏輯推理中對選擇進行排序的效率。透過三元組損失訓練,並引入三種新思路:生成更可能包含重複項的錨點、平衡正負例的難易程度、以及在訓練中週期性強調最難樣例。實驗表明這些方法能提高下游推理任務的效能。

arXiv AI模型 / 研究站內正文
AgentCo-op:基於檢索的可互操作多智慧體工作流合成框架

AgentCo-op是一種新型檢索驅動合成框架,透過型別化工件傳遞組合可複用技能、工具和外部智慧體,並在執行失敗時進行區域性修復。在空間轉錄組學和單細胞多組學等開放世界基因組學案例中,它無需重新設計即可協調獨立開發的智慧體和工具庫,在六個基準測試中四個取得最優結果,並持續降低任務成本。

arXiv AIAgent / 研究 / 創業融資站內正文
用於閉環最佳化、模擬與建模編排的工具增強型代理

提出COSMO-Agent框架,透過工具增強的強化學習教授LLM完成閉環CAD-CAE過程,解決工業設計模擬中的語義鴻溝問題。實驗證明小規模開源模型在可行性、效率和穩定性上超越大模型。

arXiv AI模型 / Agent / 研究站內正文
SOLAR:面向終身學習與持續適應的自我最佳化開放式自主智慧體

大型語言模型在動態真實環境中面臨概念漂移和高成本梯度適配的瓶頸。本文提出SOLAR,一種自我最佳化的終身自主推理器,透過引數級元學習和多級強化學習實現持續適應,無需人工標註。SOLAR維護演化知識庫平衡可塑性與穩定性,在常識、數學、醫療、程式設計、社會和邏輯推理任務上超越強基線,標誌著邁向終身自適應智慧體的重要一步。

arXiv AI模型 / Agent / 研究站內正文
EvoScene-VLA:在動作解碼器內部演化場景信念以支援分塊機器人控制

EvoScene-VLA是一種新的視覺-語言-動作(VLA)策略,它在動作解碼器內部維護一個持續更新的場景信念,以解決分塊機器人控制中因動作導致的場景變化問題。在31個RoboTwin任務和Galaxea R1-Lite真實機器人上,該方法顯著提升了任務成功率。

arXiv Robotics模型 / 政策 / 研究站內正文
軟體線性氣動執行器的解析與實驗力分析

本文對一種新型線性軟套管執行器(LSSA)進行了解析和實驗力分析。建立了準靜態模型,透過實驗驗證了在125 kPa壓力下出力隨伸長從約112 N降至零,且靜態載荷會延遲並減小出力。結果表明LSSA的力生成受壓力、幾何形狀、位移、載荷和軸向剛度的耦合影響。

arXiv Robotics研究 / 機器人站內正文
異質多團隊系統中的利他協作學習

本研究提出一種基於漢密爾頓規則的異質多團隊協作資源分配框架,透過動態機器人分配實現團隊間利他協作。該問題被證明是NP難的,為此開發了圖神經網路策略進行近似最佳化,在消防場景的模擬和實驗中驗證了其接近最優的效能和可擴充套件性。

arXiv RoboticsAgent / 政策站內正文
PGDG: 基於物理的資料生成用於從單次演示中實現魯棒雙臂策略學習

PGDG是一種新穎的資料生成框架,能夠從單次演示中擴充套件出物理上合理、多樣化的恢復行為資料集,無需額外人工標註。它透過物理取樣子和資料策展器迭代最佳化,在雙臂操作任務中顯著優於傳統空間增強方法,並支援GR00T等基礎模型的微調。

arXiv Robotics模型 / 政策 / 研究站內正文
微重力下基於抓取的動態運動設計

該論文研究了微重力環境中多肢機器人的抓取動態運動,提出了引數化運動規劃框架,並透過模擬評估了步態模式、步長、速度和姿態等設計引數的影響。結果表明,擴大接觸反力空間和抑制脈衝式全身動力學可提升運動效能。

arXiv Robotics政策 / 研究 / 創業融資站內正文
可變形微纖維形狀控制的閉環模擬到現實強化學習

研究人員提出了一種閉環模擬到現實強化學習方法,用於控制微纖維在表面上的形狀。該方法在簡化的無摩擦模擬器中訓練策略,並在實際部署中利用即時視覺反饋校正未建模的表面相互作用。使用絲質微纖維進行測試,在24種不同初始配置下實現了平均270微米的形狀誤差,並在多種纖維直徑和長度下保持亞毫米精度,無需重新訓練或調整。

arXiv Robotics政策 / 研究站內正文
分散式多覆蓋:面向機器人蜂群的魯棒覆蓋演算法

本文提出一種用於無人機蜂群的分散式多覆蓋演算法,無需全域性協調,僅依靠區域性感知和通訊即可確保每個關鍵資產被多臺機器人冗餘覆蓋,且能應對機器人故障。該工作被ANTS 2026會議錄用。

arXiv Robotics研究 / 機器人站內正文
AVI-HT:自適應視覺-IMU融合三維手部追蹤

AVI-HT是一種自適應視覺-IMU融合方法,透過聯合建模第一人稱視角影像和手套上的6自由度IMU訊號實現3D手部姿態追蹤。在嚴重視覺遮擋的手-物互動場景中,AVI-HT顯著提升了精度和可用性。其核心在於同步多模態訓練資料和跨感測器深度注意力機制。在DexGloveHOI資料集上的實驗表明,AVI-HT將平均關鍵點誤差降低了16.1%,手腕對齊變體降低了24.2%。

arXiv Computer Vision研究 / 機器人站內正文
MRecover:一種利用AI生成對比度恢復運動偽影MR影像的條件生成模型

MRecover是一種條件生成模型,透過將常規採集的T1w影像合成為TSE影像,並採用自迴歸切片條件化確保體積一致性,從而恢復運動偽影損壞的MR影像。該模型在7T MRI資料上訓練(n=577),在域內測試中表現高保真度(SSIM=0.84,FSIM=0.94),並良好泛化至3T資料。在ADNI3資料集中,經質量控制後,可分析受試者增加了31.8%(593 vs 450),並提高了海馬亞區萎縮診斷組間差異的效應量。

arXiv Computer Vision模型 / 研究 / 創業融資站內正文
先聚焦再診斷:透過主動縮放實現置信度感知的超聲VQA

現有視覺語言模型在超聲影像問答中表現欠佳,因為它們無法模擬超聲技師主動聚焦病灶的認知過程,且忽略了標註的主觀性。本文提出一種框架,引入“縮放-診斷”正規化和基於不確定性的獎勵機制,在GRPO框架下鼓勵模型對清晰病例增強準確預測,對模糊病例保持謹慎。在肝臟、乳腺和甲狀腺資料集上,病灶定位準確率提升39.3%。

arXiv Computer Vision模型 / Agent / 政策站內正文
消融驗證:視覺語言模型真的在使用連續思維標記嗎?

本文提出“消融驗證”診斷原則及其具體實現——標記替換測試(TRT),用於檢驗視覺語言模型(VLM)是否真正利用連續潛在標記進行推理。實驗表明,即使標記內容被破壞或替換,VLM仍保留大部分效能提升,準確率提升並不能證明模型使用了這些標記進行推理。

arXiv Computer Vision模型 / 研究站內正文
UniVL:用於空間接地上下文影像生成的統一視覺語言嵌入

UniVL提出一種統一視覺語言嵌入方法,透過將文本指令渲染到空間掩碼上,消除對獨立文本編碼器的需求,實現高效、可控的影像生成。在UniVL-ImgGen基準上,FID從14降至11,PSNR從16升至20,推理TFLOPs減少52%,執行時間減少44%。

arXiv Computer Vision模型 / 研究 / 創業融資站內正文
GenEvolve:透過工具編排的視覺經驗蒸餾實現自我進化的影像生成智慧體

GenEvolve是一種自我進化的影像生成框架,透過工具編排的視覺經驗蒸餾,將生成嘗試建模為工具編排軌跡,並比較多次軌跡以提取結構化視覺經驗,提供密集的令牌級監督,幫助智慧體更好地進行搜尋、知識啟用、參考選擇和提示構建。實驗表明,該方法在公共基準和GenEvolve-Bench上達到了最先進效能。

arXiv Computer VisionAgent / 政策站內正文
PhysX-Omni:統一面向模擬的物理3D生成,支援剛體、可變形體和鉸接物體

PhysX-Omni是一個統一的框架,用於生成面向模擬的物理3D資產,涵蓋剛體、可變形體和鉸接物體。它提出了一種新穎的幾何表示方法,可直接編碼高解析度3D結構,無需壓縮,從而顯著提升生成效能。此外,該框架還引入了首個通用模擬就緒3D資料集PhysXVerse,以及全面評估生成和理解能力的基準PhysX-Bench。實驗表明,PhysX-Omni在生成和理解方面均表現優異,在模擬場景生成和機器人策略學習等應用中展現出巨大潛力,有望推動具身智慧和物理模擬領域的發展。

arXiv Computer Vision模型 / 政策 / 研究站內正文
JAMtime.ai:用自然語言描述音色,AI生成真實DSP圖譜

JAMtime.ai 是一款創新工具,讓音樂人用自然語言描述想要的音色,AI自動生成可編輯的DSP圖譜,並支援在瀏覽器、DAW(免費VST/AU外掛)及未來物理效果器上即時執行。它由資深開發者Jeff Ward打造,完全可編輯、可分享、可派生。

Product Hunt AIAgent站內正文
頂流裡最快!智譜,你是在「噴」程式碼吧

智譜AI釋出GLM-5.1-highspeed高速API,速度達400 tokens/s,成為頂流模型中最快。實測顯示其程式碼生成如噴射,可即時互動調參、改變遊戲世界、快速處理萬字內容。背後是推理引擎、排程系統和基礎設施的系統工程最佳化,推動AI Agent進入快時代。

量子位Agent / 晶片站內正文
Nugget AI:將客戶訪談轉化為產品路線圖的AI工具

Nugget AI 是一款利用AI從客戶訪談中提取痛點、功能請求和情緒,自動合成主題並生成PRD的工具。它新增的MCP伺服器讓Claude、ChatGPT等AI代理可以直接查詢訪談內容,基於真實使用者反饋而非幻覺來生成規範。價格僅為Dovetail的一半,並提供首年66折優惠。

Product Hunt AIAgent / 研究站內正文
聯想集團Q4營收利潤雙創新高,兌現歷史最佳財年

聯想集團公佈截至2026年3月31日的2025/26財年第四季度及全年業績。第四財季營收近1500億元,同比增長27.1%,創近20個季度最高增速;調整後淨利潤同比翻番。全年營收首次突破5000億元,同比增長20.3%,調整後淨利潤同比增長42.1%。三大業務集團均實現雙位數增長,AI相關業務營收全年同比增長105%。

量子位Agent / 晶片站內正文