AI News HubLIVE

AI 新聞即時情報

即時監測

今天 AI 世界最重要的變化

來自 105 個可信來源,最近更新 2026-05-28 12:00 UTC+8。

即時監測

即時更新

即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。

即時更新

重設
面向異構模擬環境的聯邦強化學習個性化觀測歸一化方法

本文提出個性化觀測歸一化(PON)方法,用於解決聯邦強化學習在異構環境中因狀態轉移動態不同導致的輸入分佈差異和引數更新不平衡問題。每個智慧體使用持續更新的執行均值和方差對原始狀態輸入進行本地歸一化,確保特徵縮放一致且不相互掩蓋。實驗證明,共享歸一化引數無效,PON在異構MuJoCo任務中加速訓練並取得更優效能。該論文已被IJCNN 2025接收。

arXiv Machine LearningAgent / 政策 / 研究站內正文
你掌控自己的狀態:為什麼人類結果可以透過因果狀態干預來控制

該論文提出,人類行為結果的持續變異性源於個體的動態潛在狀態,而非僅由可觀測輸入決定。透過干預決策形成時刻的狀態權重,可以精確控制結果。框架基於因果推斷、預測加工、穩態應變等六條證據鏈,並利用超20萬使用者的24個月觀測資料,提出七項可檢驗預測和六項操作要求,對數字健康、教育、AI個性化等領域具有啟示意義。

arXiv AI研究站內正文
即時分析中的發現智慧體:邁向主動洞察系統

本文提出了一種基於多智慧體架構的自主洞察發現系統,用於即時資料流。該系統透過持續發現迴圈,利用Apache Kafka、Flink和大語言模型實現假設生成、驗證及視覺化,旨在從被動查詢驅動轉向主動發現驅動分析。

arXiv AI模型 / Agent / 政策站內正文
LaneRoPE:用於協作並行推理與生成的位置編碼

LaneRoPE透過引入序列間注意力機制和位置編碼擴充套件,使多個LLM序列在生成過程中能夠協作,從而在數學推理任務中提升準確率,且對架構改動小、推理開銷低。

arXiv AI模型 / 研究站內正文
RULER:機器學習遺忘的表示級驗證

現有機器學習遺忘驗證僅關注輸出級指標,但模型內部表示可能仍保留遺忘資料。RULER提出表示級驗證指標M2和M4,實驗表明多種近似遺忘方法雖透過輸出級評估,但在表示級檢測中表現出顯著殘留。

arXiv AI研究 / 創業融資站內正文
為什麼LLM在因果發現中失敗以及干預智慧體如何突破

本文證明了大型語言模型在進行因果發現時存在根本性侷限:監督微調、直接偏好最佳化和上下文學習等方法無法區分產生相似觀測資料的因果圖。作者提出了智慧體因果貝葉斯最佳化(A-CBO),其中凍結的語言模型作為干預預言機,外部貝葉斯迴圈在對數級別輪次內收斂到候選圖。在Corr2Cause基準上,A-CBO無需訓練即可匹配微調基線;在擴充套件到24個變數和18K測試樣本的Extended Corr2Cause上,A-CBO顯著優於微調和偏好最佳化。

arXiv AI模型 / Agent / 研究站內正文
DynaSchedBench:校準的動態排程基準與基於LLM的排程代理中的可觀察性悖論

本文提出DynaSchedBench框架,透過順序事件空間校準器(SESC)和排程壓力指數(SSI)嚴格生成動態靈活作業車間排程問題(DFJSP)例項,解決了靜態基準過擬合和未校準生成器噪聲問題。研究發現LLM排程代理存在“可觀察性悖論”:提供完整結構資訊反而會降低效能,且工具增強和細化策略無法可靠提升效果。

arXiv AI模型 / Agent / 政策站內正文
利用隱寫術繼承的合成資訊起源

本文類比生物進化中的物種起源,探討合成資訊的起源問題,提出利用隱寫術實現資訊血統追蹤的機制,以應對AI生成內容難以追溯來源的挑戰。

arXiv AI研究 / 創業融資站內正文
Soro:專為塔吉克語打造的輕量級基礎模型與聊天機器人

Soro是一系列專為塔吉克語最佳化的對話大語言模型,基於Gemma 3檢查點,透過19億標記的塔吉克語持續預訓練和4萬示例的指令微調,顯著提升了塔吉克語任務表現,同時保持英語效能。模型支援FP8和INT4量化,適用於邊緣部署,已在塔吉克教育領域試點。

arXiv AI模型 / 研究 / 創業融資站內正文
兩大支柱:AI後軟體工作的概念框架

一篇論文認為,隨著生成式AI消除了人類編寫正確程式碼的能力這一約束,軟體工作圍繞兩大支柱重組:混音模式(人類像音響工程師一樣連續操作多個判斷軸)和元軟體(觀察、驗證、上下文化和治理其他軟體的軟體)。這兩個支柱不可分割,借鑑了從手工藝到統計控制的批次生產的歷史轉型。

Hacker News AIAgent / 政策 / 研究站內正文
你未來的工作將是讓AI保持專注

諾亞·史密斯認為,隨著AI能力增強,人類將從技術工作轉向確保AI對齊——使AI專注於人類目標。他將其與《上班一條蟲》類比,並警告AI生成內容“汙泥”正在泛濫。

Hacker News AIAgent / 研究站內正文
Safescript – 面向人工智慧時代的程式語言

Safescript 是一種為 AI 代理設計的程式語言,透過靜態分析在執行前證明所有安全屬性,無需沙箱或虛擬機器,徹底消除供應鏈攻擊。它編譯成有向無環圖(DAG),可追蹤資料流和宿主機呼叫,效能開銷為零,啟動時間為零。

Hacker News AIAgent / 政策站內正文
AIPass – 具有身份、記憶和電子郵件的持久化智慧體工作空間

AIPass 是一個基於命令列的開源框架,為 AI 智慧體提供永續性記憶、身份標識和協作能力。智慧體共享檔案系統,透過 JSON 檔案儲存記憶,無需雲服務或額外 API 金鑰。專案包含 13 個核心智慧體,支援多智慧體協作、任務排程、質量審計和即時監控。

Hacker News AIAgent / 政策站內正文
伊利諾伊州議員透過了美國最強人工智慧安全法案

伊利諾伊州參議院第315號法案(SB 315)要求人工智慧實驗室聘請獨立審計師驗證其安全承諾,該法案現已提交州長JB·普利茲克簽署。普利茲克表示計劃簽署,稱需要讓大型科技公司負責。此舉在聯邦層面缺乏AI監管的背景下,凸顯了州級立法的重要性。

Hacker News AI政策 / 研究站內正文
AI作弊 [PDF]

這是一份關於AI作弊的PDF報告,但無法直接解析內容。

Hacker News AI工具站內正文
Sakana AI 提出 DiffusionBlocks:一種將殘差網路轉換為可獨立訓練去噪模組的塊狀訓練框架

來自Sakana AI和東京大學的研究人員提出了DiffusionBlocks,這是一種塊狀訓練框架,可將Transformer網路劃分為獨立訓練的塊,從而將訓練記憶體減少B倍(B為塊數),同時在不同架構上保持效能。該方法透過將殘差連線解釋為擴散模型中的尤拉步驟,利用分數匹配目標實現塊級獨立訓練。

MarkTechPost模型 / 晶片 / 研究站內正文
授權悖論:誰掌控著你的AI鑰匙?[影片]

本文探討了AI系統中的授權悖論問題,即誰真正擁有對AI系統的控制權。文章以影片形式呈現,討論了相關的安全和隱私問題。

Hacker News AI政策站內正文
OpenJarvis v1.0 釋出:支援 Ollama 的本地優先個人 AI 框架

OpenJarvis 是一個開源框架,用於構建執行在本地硬體上的個人 AI 代理。由斯坦福大學 Hazy Research 和 Scaling Intelligence 實驗室開發,v1.0 版本現已整合 Ollama,實現本地優先、雲端可選,並跟蹤能耗、成本和延遲。

Ollama Blog模型 / Agent / 研究站內正文
蘋果在CVPR 2026展示最新研究成果

蘋果將在2026年6月3日至7日于丹佛舉行的CVPR大會上贊助並展示多項研究,包括影片生成、多模態理解、影像壓縮等領域,並在展位進行海報演示。

Apple Machine Learning ResearchAgent / 研究站內正文
OpenAI的前沿治理框架

探索OpenAI的前沿治理框架,瞭解我們的人工智慧安全、安保和風險實踐如何與新興的歐盟和加利福尼亞法規保持一致。

OpenAI News政策站內正文
Show HN: Liiists —— 一款基於Markdown、支援iOS和命令列的列表應用

Liiists 是一款基於Markdown的列表應用,可在終端、iOS裝置和AI代理上透過MCP伺服器使用,所有操作都基於相同的純文本.md檔案。它提供了命令列工具、原生iOS應用(支援分享擴充套件和Siri)以及用於AI整合的MCP伺服器。無需賬戶、無鎖定,支援iCloud同步或指向任何資料夾(包括Obsidian vault)。

Hacker News AIAgent站內正文
SQLite 的 AGENTS.md

SQLite 新增了 AGENTS.md 檔案,明確了其對 AI 生成貢獻的政策:不接受未經事先同意的拉取請求,不接受代理生成的程式碼,但歡迎附帶可重現測試用例的 bug 報告。由於 AI 生成的 bug 報告氾濫,論壇現已拆分出專門的 bug 論壇。

Simon Willison's Weblog模型 / Agent / 政策站內正文
構建無障礙技術的未來:走進 Uvilox AI

Uvilox AI 透過下一代視覺 AI 技術,提供即時手語翻譯、緊急響應和無障礙通話,延遲低於 80 毫秒,準確率高達 97.4%,支援 200 多種手語變體,並具備軍事級安全保護和 HIPAA/GDPR 合規架構。目前正開放 Beta 測試,早期會員可免費永久使用。

Hacker News AI政策站內正文
NeuralAgent 2.5:個人AI助手,語音控制與並行代理驚豔登場

NeuralAgent 2.5 帶來了語音模式、觀察學習與並行代理三大功能,讓AI助手能聽、能看、能同時處理多項任務。使用者可透過自然語言指揮它操作整個電腦,無需鍵盤滑鼠。新版還最佳化了工作流、@提及和記憶系統。

Product Hunt AIAgent / 研究站內正文