Gate 是一個用 Rust 編寫的確定性 PII 編輯工具,專為 AI 代理設計。它透過正規表示式、列啟發式和 Luhn 檢查來識別和替換敏感資訊,而不依賴 LLM。支援多種 AI 代理框架,如 Claude Code、OpenCode、Cursor 等。提供掃描、即時編輯和聚合報告功能,確保資料不會離開本地機器。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
中國人工智慧初創公司DeepSeek在6月份登上美國企業支出指數榜首,越來越多的公司放棄OpenAI和Anthropic等昂貴的美式選擇,轉而採用更實惠的替代方案。
asd是一款面向現代終端的智慧通用檔案檢視器,透過自動檢測檔案型別並提供美觀的渲染效果,替代傳統的cat命令。它支援程式碼高亮、結構化資料格式化、表格展示、Markdown渲染、歸檔檔案瀏覽、辦公文件與PDF解析、媒體後設資料檢視、安全證書解析、Git整合、日誌尾隨、側邊對比等功能,並可透過智慧管道輸入自動識別內容型別。
Hscli 是一個開源、可指令碼化的 Help Scout 命令列工具,專為終端、CI 流水線和 AI 代理設計。它輸出 JSON,支援多種輸出格式,預設安全。
斯坦福大學和Lambda Labs釋出了OpenJarvis,一個開源框架,可在裝置上完全執行推理、智慧體、記憶和學習。該框架將個人AI系統分解為五個可組合的原語,在基準測試中平均僅落後最佳雲模型3.2個百分點,而邊際API成本降低約800倍,延遲降低約4倍。
Phylax是一個Windows安全層,透過核心級別的ACL控制,防止AI編碼代理訪問你的私密檔案。它100%本地執行,無需賬戶、雲服務或遙測,支援多代理檢測和反繞過保護。
微軟推出的 Windows Terminal 實驗性分支“智慧終端”原生整合了AI代理支援,包括代理狀態列、上下文感知代理窗格、自動錯誤檢測和會話管理功能。
優步將裁減其人事團隊(包括人力資源和招聘)23%的職位,CEO達拉·科斯羅薩西表示這些變革是必要的。此舉旨在簡化運營,新總裁吉爾·哈澤貝克主導重組。裁減人數不到全體員工34,000人的1%,且並非由人工智慧驅動。優步還對員工使用的代理型AI工具設定了月度支出上限。
惡意包透過binding.gyp和index.js在npm install時執行,下載Bun執行時,竊取憑證並注入GitHub Actions工作流。受影響包:ai-sdk-ollama版本0.13.1、1.1.1、2.2.1、3.8.5。
本文探討了在AI技術日益普及的背景下,不使用AI的開源軟體是否會被淘汰。文章分析了AI對開源生態的影響,並指出即使沒有AI,許多開源專案仍有其獨特價值。
英格蘭資格及考試監督辦公室(Ofqual)負責人伊恩·鮑克姆警告,新一代可穿戴裝置如智慧眼鏡和隱形耳機可能加劇考試作弊,同時GCSE和A-level課程作業中的人工智慧使用也受到審查。
科技記者喬安娜·斯特恩在2025年進行了一項實驗:讓人工智慧接管她生活的方方面面,包括寫書、編輯、家務、駕駛甚至戀愛。她將這段經歷寫成了新書《我不是機器人:我用AI做(幾乎)所有事情的一年》,引發了關於AI能力邊界和人類未來的深刻思考。
本文提出一種新方法,利用稀疏感測和力學模型估算假肢接受腔中的法向和剪下壓力。透過全域性力和區域性載荷的驗證,準靜態彈簧-質量接觸模型結合最小二乘引數識別,有效減少了測量偏移,為改進假肢適配提供了客觀指標。
該論文介紹了DLO-Lab,一個專門為變形線性物件(如繩索、電纜和橡皮筋)操作設計的可微分模擬器。它能夠模擬廣泛材料屬性,並提供了一套基準任務和專用智慧體,以解決拓撲復雜性和抓取敏感性問題。實驗評估了多種策略學習演算法,並展示了模擬到現實的遷移潛力。
本文提出了一種風險感知模型預測控制(RA-MPC)框架,利用預測集在不依賴不確定性分佈假設的情況下保證風險低於使用者指定閾值。透過將共形風險控制擴充套件到一般譜風險度量,實現了分佈自由的風險量化。在模擬車輛避障場景中,該框架相比基線RA-MPC提高了安全性並減少了求解時間。
本文提出Affordance2Action(A2A),一個以基準為中心的學習框架,用於場景級、任務條件的部件可互動性定位。其核心是A2A-Bench,一個面向操作的基準,涵蓋日常場景中的單區域和多區域指令對應關係。透過A2A-AffordGen註釋管線構建,實驗表明A2A揭示了通用分割、VLM定位和可互動性蒸餾基線的顯著差距,並改善了任務級定位,為下游操作提供了空間先驗。
本文提出了一種分散式、風險感知的多智慧體下一最佳視角(NBV)框架,每個機器人維護私有區域性3D高斯潑濺地圖,並利用共識ADMM演算法,在通訊圖中僅交換候選視角、軌跡描述符和標量期望資訊增益,從而在保證對映質量和軌跡安全的同時,將通訊量降低數個數量級。
該研究對比了三種觸覺引導模型(彈簧-阻尼、勢場和引導管)在遙操作中的效能,發現沒有普遍最優的模型:彈簧-阻尼在雜亂環境中表現最佳,勢場在自由空間中效果出色但靠近障礙物時有風險,引導管則提供平衡的折中方案。研究提出了新的客觀評估指標,並表明引導力大小與舒適度和信任度相關。
CLAW是一個完全端到端的自監督框架,透過對抗性潛在正則化和擴散影片生成,直接從無動作影片中學習連續潛在動作表示和世界模型,無需動作標籤。它支援從觀察中模仿學習和目標導向規劃,在多種任務中表現出色。
AgenticDiffusion是一種多視角無人機導航框架,結合語言引導推理、開放詞彙目標定位、基於視覺的擴散規劃和非線性模型預測控制,在40次真實世界試驗中實現了80%的任務成功率,軌跡生成成功率達100%。
研究提出空間偽影相干性(SAC)指標,用於衡量在影片壓縮條件下,基於補丁的rPPG方法相比全域性投影方法的優勢。實驗表明,SAC解釋了93.8%的PCA優勢方差,非MPEG-4編解碼器(SAC 0.10-0.18)的PCA勝率高達84-90%,而MPEG-4(SAC 0.48-0.59)勝率僅為61%,且改進幅度減少5.8倍。P-Hybrid被確定為最魯棒的演算法,當SAC<0.30且運動量低至中等時,補丁PCA方法具有優勢。該研究為臨床遠端監測中的編解碼感知rPPG演算法選擇提供了物理基礎。
研究者提出GroupToM-Bench,這是首個針對群體級心理理論的多模態基準測試。現有模型在個體心理理論上表現不錯,但在理解群體行為非線性湧現方面存在顯著不足。該基準涵蓋從微觀信念-慾望-意圖狀態到群體張力和結構約束,再到宏觀結果預測的因果鏈條,並設計了七級認知審計框架。實驗顯示,當前模型與人類基線之間仍有較大差距。
本文介紹了一種名為Orli(有序迴歸線條)的端到端模型,將文本行檢測和閱讀順序排序統一為影像到序列的問題。Orli在196,691頁混合語料庫上訓練,涵蓋十種書寫系統,在不使用資料集特定訓練的情況下,在cBAD線條檢測上略超先前最先進水平,在多個閱讀順序基準上零樣本達到近乎完美的覆蓋和排序,並能透過少量微調適應專業領域佈局。程式碼和模型權重已開源。
Pinpoint是一種新的影像地理定位方法,透過結合網際網路照片和街景影像,利用檢索-重排序架構實現高精度定位。它訓練對比學習嵌入器統一來自Flickr和街景的影像-GPS空間,再用注意力機制重排序候選位置。無需多模態大模型,在多個基準上達到最先進水平。
本文提出一種專門針對單影像反射分離任務微調的擴散模型,透過聯合生成透射層和反射層,並引入跨層自注意力機制和不相交取樣策略,在強光或弱反射等極端條件下顯著優於現有方法。
本文介紹了一個名為EVID-Bench的新基準,用於檢測基於搜尋的影片虛假資訊。該基準包含222個影片,涵蓋9種操縱型別,分為三大類:AI生成、單源編輯和多源編輯。研究發現,即使最好的多模態模型在點級準確率上也僅達61.43%,影片級準確率為43.24%,其中AI生成的操縱最具挑戰性。
本文提出一種新的最優傳輸流匹配方法,透過將先驗視為設計選擇而非固定輸入,避免了高維最優傳輸耦合的計算難題。作者發現自然影像的低頻投影可作為先驗,與資料形成最優傳輸恆等耦合,從而將流匹配任務簡化為合成高頻細節。該方法無需修改流模型本身,即可與潛在空間模型、無分類器引導和單步生成框架自然整合。在多個基準測試中,軌跡曲率降低超過2倍,少步生成質量顯著提升。
本文提出一種名為IN2R的新框架,透過從離散選擇轉向合成連續軟原型來糾正跨模態檢索中的噪聲對應問題,利用模態內資料的幾何穩定性進行圖推理,在多個資料集上達到最優效能。
本文提出SASA方法,一種漂移魯棒的弱監督增量學習語義分割方法。透過可學習令牌的語義錨點保持長期語義身份,結合彈性殘差適應實現例項級微調,並開發空間標籤仲裁機制直接過濾不可靠訊號,強制執行“一個物件,一個類別”約束。實驗表明,SASA在多個標準基準上優於現有方法,尤其在多步增量設定中表現突出。
機器人和導航等具身視覺語言決策任務中,視覺語言模型(VLM)和視覺語言動作模型(VLA)分別擅長長期規劃和反應控制,但都受限於視覺幻覺問題。本文提出SceneDiver,一種從粗到細的焦點計劃生成方法,透過構建場景圖並逐步分解任務,有效減少幻覺。同時設計輕量級介面卡將焦點能力蒸餾至VLA,在保持計算效率的同時顯著提升效能。論文已被ICML 2026接收。