AI News HubLIVE

AI 新聞即時情報

即時監測

今天 AI 世界最重要的變化

來自 105 個可信來源,最近更新 2026-05-20 22:56 UTC+8。

即時監測

即時更新

即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。

即時更新

重設
datasette-agent-charts 0.1a1

datasette-agent-charts 0.1a1 版本釋出,為 Datasette Agent 帶來了 Observable Plot 圖表支援,包括改進的配色方案、許可權檢查、互動式工具提示和錯誤修復。

Simon Willison's WeblogAgent / 研究站內正文
Ubuntu Core 26:一個可信的不可變Linux,支援至2041年

Canonical釋出了Ubuntu Core 26,一個面向物聯網和邊緣裝置的極簡、不可變Linux發行版,提供15年支援。其增強的安全特性旨在滿足歐盟《網路彈性法案》(CRA)的要求,包括經過簽名的snap元件、改進的全盤加密和Chisel構建系統。新版本還最佳化了OTA更新,尺寸縮小50%-90%,並增加了ARM64的Livepatch支援。

ZDNet AI晶片 / 政策 / 機器人站內正文
51%的專業人士稱AI“低質產出”降低生產力——兩步即可阻止

研究表明,近半數美國專業人士認為AI生成的“低質產出”(workslop)使他們更加謹慎。低質量AI輸出導致信任度下降(57%)、生產力降低(51%)和聲譽受損(46%)。應對策略包括重新思考AI生產力:採取“AI優先,人類第二”的工作模式,以及堅持使用AI工具,透過持續努力和學習實現價值。

ZDNet AIAgent / 研究站內正文
AI標註系統面臨成敗關鍵時刻

我們即將檢驗SynthID和C2PA等系統能否有效打擊深度偽造。谷歌將SynthID驗證擴充套件到Chrome和搜尋,同時檢查C2PA後設資料。OpenAI為其影像新增SynthID。Meta將在Instagram上使用C2PA標記相機拍攝的照片。但挑戰依然存在:後設資料易被剝離、開源模型不採用、谷歌身兼AI創作者與解決方案提供者的雙重角色。

The Verge AI模型 / 政策站內正文
智象未來超兩千億引數影像大模型HiDream-O1-Image-Pro釋出,融資持續提速

智象未來在首屆開放日釋出超2000億引數的原生全模態影像大模型HiDream-O1-Image-Pro,基於Unified Transformer架構,重新整理多項SOTA。同時完成新一輪億級融資,深創投等機構參與。公司推出“模型+智慧體”戰略,三大智慧體產品落地,並與多家企業達成合作,向世界模型邁進。

量子位模型 / Agent / 晶片站內正文
如果谷歌都無法讓AI代理變得有用,也許沒人能做到

多年來,科技公司承諾AI將帶來能幹的個人助理,但實際更像無知的實習生。近六個月,開源AI代理平臺OpenClaw的流行改變了這一狀況。在I/O 2026大會上,谷歌推出了新的AI代理,用於資訊收集、活動策劃、收件箱和日曆總結等。這些代理可在後臺持續執行,並深度整合谷歌生態。同時,谷歌擴充套件了開發者工具,並藉助Gemini Spark等產品,試圖在AI代理領域取得大規模成功。

The Verge AIAgent / 政策站內正文
使用Unity Catalog大規模治理AI代理

本文探討了如何透過Unity Catalog和Unity AI Gateway實現AI代理的治理。文章提出AI治理本質上是資料治理,並介紹了四大支柱:委託訪問、以資料為中心的AI治理、成本智慧以及開放互操作性。這些方法幫助企業平衡創新與風險,確保安全合規。

Databricks BlogAgent / 政策站內正文
AutoSubtitles 2.0:新一代AI字幕生成器,支援動畫字幕與快速編輯

AutoSubtitles 2.0 是一款基於瀏覽器的AI字幕生成器,可生成20多種語言的準確字幕,提供時間線編輯、畫布編輯、病毒式字幕預設以及AI增強功能(如自動錶情符號)。所有處理均在客戶端完成,無需上傳影片或使用複雜軟體,專為創作者、播客、線上課程和社交媒體影片設計。

Product Hunt AIAgent站內正文
OpenAI 進軍新加坡

OpenAI 宣佈啟動“OpenAI for Singapore”專案,這是一項多年期人工智慧合作計劃,旨在擴大AI部署、培養本地人才,並利用AI支援企業和公共服務。

OpenAI News工具站內正文
智慧體堆疊的賭注

當前生產環境中的智慧體缺乏身份、上下文永續性和平臺支援,導致治理和可靠性問題。文章提出了四個關鍵架構方向:智慧體需要獨立身份、通用上下文、持久化執行和平臺化基礎設施。

O'Reilly AI & ML RadarAgent / 政策站內正文
NVIDIA釋出Nemotron-Labs-Diffusion:三模式語言模型,前向令牌數達Qwen3-8B的6倍

NVIDIA推出Nemotron-Labs-Diffusion模型家族,在單一架構中統一自迴歸解碼、擴散並行解碼和自推測解碼。支援3B、8B和14B引數規模,包含基礎、指令和視覺語言變體。自推測模式透過擴散生成候選令牌,再由自迴歸驗證,無需輔助模型。在8B規模下,線性自推測較Qwen3-8B實現6倍前向令牌數,準確率63.61%,優於Qwen3-8B的62.75%。佈署靈活,適用於不同併發場景。

MarkTechPost模型 / 晶片 / 研究站內正文
Databricks Genie如何提升零售個性化體驗

Databricks Genie是一款資料代理工具,透過自然語言查詢使CX領導者能夠即時獲取客戶洞察,無需等待分析師處理,從而加速零售個性化決策。

Databricks BlogAgent / 政策站內正文
Databricks for Good與美德基金會合作:連線醫療志願者與72個國家的關鍵醫療服務

美德基金會與Databricks for Good合作,利用AI提升全球醫療成果。雙方共同構建了一個生產級平臺,透過大語言模型從72個低收入和中低收入國家提取醫療設施資料,並利用實體解析技術整合資訊,最終透過VF Agent實現自然語言查詢,幫助醫療專業人員快速找到匹配的志願機會。

Databricks BlogAgent / 研究站內正文
阿里巴巴Qwen團隊推出Qwen3.5-LiveTranslate-Flash:支援60種語言、延遲僅2.8秒的即時多模態翻譯模型

阿里巴巴Qwen團隊釋出了Qwen3.5-LiveTranslate-Flash,這是一款即時多模態翻譯模型,可同時處理音訊和影片。該模型支援60種輸入語言,並以2.8秒的延遲輸出29種語言的語音。相比上一版本,新增了即時說話人聲音克隆、透過唇形和螢幕文本增強視覺理解,以及動態關鍵詞配置以處理領域特定術語。在FLEURS和CoVoST2基準測試中,該模型表現優於主要商業替代品。該模型透過阿里雲百鍊平臺以API形式提供,使用WebSocket協議。

MarkTechPost模型 / 晶片 / 研究站內正文
Gemini 3.5 Flash:前沿智慧與速度的結合

Google釋出了Gemini 3.5 Flash模型,它結合了前沿智慧與高速效能,支援代理工作流、程式設計和多模態推理,同時保持低延遲。本文透過原型設計、複雜問題處理和視覺生成等實際測試,展示了其出色的響應速度和實用能力。

Analytics Vidhya模型 / Agent / 研究站內正文
LWiAI播客第245期 - TML互動、法律界Claude、Sam Altman出庭

本期播客總結了上週AI領域的重要新聞,包括OpenAI釋出新的語音智慧API功能、Thinking Machines推出高響應即時互動模型、Anthropic進軍法律科技領域推出Claude for Legal、以及Sam Altman在庭審中的表現等話題。

Last Week in AIAgent / 晶片站內正文
構建服務AI堆疊:從解析基礎到預測性維護

服務組織在複雜裝置行業因解析知識結構混亂而損失資金。本文探討了如何建立資料基礎以支援預測性維護,強調了構建解析基礎、AI就緒資料、因果對映和參考驗證解決方案的關鍵步驟。

Emerj AI ResearchAgent / 政策站內正文
谷歌釋出Gemini Omni:從任何輸入生成影片的多模態模型

谷歌推出Gemini Omni系列,首個模型Gemini Omni Flash能夠從影像、音訊、影片和文本組合輸入生成高質量影片,支援透過自然語言對話編輯影片,並具備物理理解和世界知識。該模型已整合到Gemini應用、Google Flow和YouTube Shorts中。

Hacker News AIAgent / 研究站內正文