AI News HubLIVE

AI 新聞即時情報

即時監測

今天 AI 世界最重要的變化

來自 105 個可信來源,最近更新 2026-05-28 08:00 UTC+8。

即時監測

即時更新

即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。

即時更新

重設
OpenJarvis v1.0 釋出:支援 Ollama 的本地優先個人 AI 框架

OpenJarvis 是一個開源框架,用於構建執行在本地硬體上的個人 AI 代理。由斯坦福大學 Hazy Research 和 Scaling Intelligence 實驗室開發,v1.0 版本現已整合 Ollama,實現本地優先、雲端可選,並跟蹤能耗、成本和延遲。

Ollama Blog模型 / Agent / 研究站內正文
蘋果在CVPR 2026展示最新研究成果

蘋果將在2026年6月3日至7日于丹佛舉行的CVPR大會上贊助並展示多項研究,包括影片生成、多模態理解、影像壓縮等領域,並在展位進行海報演示。

Apple Machine Learning ResearchAgent / 研究站內正文
OpenAI的前沿治理框架

探索OpenAI的前沿治理框架,瞭解我們的人工智慧安全、安保和風險實踐如何與新興的歐盟和加利福尼亞法規保持一致。

OpenAI News政策站內正文
Show HN: Liiists —— 一款基於Markdown、支援iOS和命令列的列表應用

Liiists 是一款基於Markdown的列表應用,可在終端、iOS裝置和AI代理上透過MCP伺服器使用,所有操作都基於相同的純文本.md檔案。它提供了命令列工具、原生iOS應用(支援分享擴充套件和Siri)以及用於AI整合的MCP伺服器。無需賬戶、無鎖定,支援iCloud同步或指向任何資料夾(包括Obsidian vault)。

Hacker News AIAgent站內正文
SQLite 的 AGENTS.md

SQLite 新增了 AGENTS.md 檔案,明確了其對 AI 生成貢獻的政策:不接受未經事先同意的拉取請求,不接受代理生成的程式碼,但歡迎附帶可重現測試用例的 bug 報告。由於 AI 生成的 bug 報告氾濫,論壇現已拆分出專門的 bug 論壇。

Simon Willison's Weblog模型 / Agent / 政策站內正文
構建無障礙技術的未來:走進 Uvilox AI

Uvilox AI 透過下一代視覺 AI 技術,提供即時手語翻譯、緊急響應和無障礙通話,延遲低於 80 毫秒,準確率高達 97.4%,支援 200 多種手語變體,並具備軍事級安全保護和 HIPAA/GDPR 合規架構。目前正開放 Beta 測試,早期會員可免費永久使用。

Hacker News AI政策站內正文
NeuralAgent 2.5:個人AI助手,語音控制與並行代理驚豔登場

NeuralAgent 2.5 帶來了語音模式、觀察學習與並行代理三大功能,讓AI助手能聽、能看、能同時處理多項任務。使用者可透過自然語言指揮它操作整個電腦,無需鍵盤滑鼠。新版還最佳化了工作流、@提及和記憶系統。

Product Hunt AIAgent / 研究站內正文
Ava 2.0:自主執行對外銷售的AI BDR

Ava 2.0 是一款完全自主的AI業務拓展代表,能夠自動搜尋超過3億專業人士、執行多渠道外聯並預訂合格會議,無需人工干預。

Product Hunt AI創業融資 / 機器人站內正文
2026年4月:LangChain新聞通訊

LangChain在4月釋出了多項產品更新,包括LangSmith的30多個評估器模板、成本警報功能,以及與Arcade.dev的整合。Deep Agents推出單命令部署工具,支援生產級擴充套件。Interrupt 2026大會將於5月13-14日在舊金山舉行,議程已公佈。此外,還有多場使用者故事和即將舉辦的活動。

LangChain BlogAgent / 政策站內正文
Hyper:讓你的AI代理出色工作的公司大腦

Hyper 是一個公司大腦,它能學習企業中的所有知識(文件、Slack、郵件、日曆等),並將其連線到AI代理和自動化流程中,使它們從健忘的實習生變成經驗豐富的員工,高效完成任務。

Product Hunt AIAgent / 機器人站內正文
大規模可靠LLM推理

Databricks構建了獨特的推理平臺,為眾多前沿模型提供推理服務,每月處理超過120萬億個令牌。透過引入“模型單元”抽象,實現了成本感知的負載均衡和自動縮放,相比靜態配置節省了80%以上的GPU成本。執行時可靠性機制包括黑盒健康檢查,可自動檢測和恢復靜默故障。此外,透過分析多模態瓶頸,吞吐量提升了3倍。

Databricks Blog模型 / Agent / 晶片站內正文
BI接入要點:最佳化效能與總擁有成本

您的BI儀表盤速度緩慢,調優消耗大量時間和金錢。本文從物理佈局到治理語義層,逐步介紹Databricks的BI接入棧,提供改善查詢效能和降低總擁有成本的實用指導。

Databricks BlogAgent / 政策站內正文
Snowflake承諾向AWS投入60億美元,深入AI領域

Snowflake與AWS簽署五年60億美元合作協議,使用AWS Graviton和GPU例項進行AI訓練和推理,並擴充套件至10個新區域。此舉表明Snowflake在AI時代的雄心,同時透過Cortex AI產品套件推動企業AI應用。

The New Stack AIAgent / 晶片站內正文
使用Amazon Bedrock AgentCore構建企業支援AI代理

AWS生成式AI創新中心與Works Human Intelligence合作,利用Amazon Bedrock AgentCore構建了兩個AI代理,分別用於通勤津貼審批和瀏覽器操作,實現了高達97%的成本降低並提升了運營效率。

AWS Machine Learning BlogAgent / 研究站內正文
從資料過載到可操作洞察:Verizon Connect如何將智慧代理AI擴充套件至10萬使用者

Verizon Connect利用AWS構建智慧代理AI解決方案,每天將超過5000萬資料點轉化為10萬使用者的可操作洞察。本文詳細介紹了其架構決策、實施挑戰和可衡量的成果,包括使用無伺服器統計模型進行異常檢測、採用Strands Agents實現動態推理、以及透過Amazon Nova Lite將輸入令牌成本降低70%。

AWS Machine Learning BlogAgent / 政策站內正文
AWS SMGS如何利用基於Amazon Bedrock AgentCore的AI對話助手轉變業務管理

AWS SMGS使用NarrateAI(基於Amazon Bedrock AgentCore構建的智慧對話解決方案)實現大規模商業智慧。該方案採用雙層架構:批次敘事生成和即時互動,透過專用AI代理進行路由和驗證,支援自然語言查詢、行級安全及個性化角色體驗,顯著提升決策效率。

AWS Machine Learning BlogAgent / 政策站內正文
微軟MAI-Image-2.5在基準測試中與谷歌Nano Banana 2持平

微軟的MAI-Image-2.5模型在Arena文本到影像排行榜上位列第三,與谷歌的Nano Banana 2效能相當,但仍落後於OpenAI的Image-2。該模型在影像內文本渲染和商業視覺內容方面有明顯改進。

The Decoder研究站內正文
利用 Amazon Bedrock AgentCore 賦能代理型 AI 銷售策略

AWS 銷售團隊使用 Amazon Bedrock AgentCore 構建了 Field Advisor,以編排超過 20 個領域特定代理,減輕銷售代表認知負擔並提高效率。該解決方案每週為每位代表節省最多 2 小時,並將延遲降低 41%。

AWS Machine Learning BlogAgent / 研究站內正文
🔬ESMFold2:蛋白質領域的苦澀教訓——Alex Rives,BioHub

Alex Rives 在 BioHub 上釋出了 ESMFold2,這是一個基於大規模無監督訓練蛋白質語言模型的開源科學引擎,在蛋白質相互作用(尤其是抗體)預測上取得了最先進效能,併發布了68億蛋白質圖譜和11億預測結構。文章討論了世界模型在蛋白質生物學中的應用,以及如何透過稀疏自編碼器提取語義特徵實現可程式設計生物學。

Latent SpaceAgent / 晶片站內正文
Robinhood 允許 AI 代理為客戶交易股票和使用信用卡購買

Robinhood 透過 MCP 讓客戶連線 Anthropic 的 Claude 等 AI 代理,這些代理可以自主交易股票。美國券商監管機構 FINRA 已將其視為新的風險領域,警告不可控的決策。Robinhood 也承認該產品並非適合所有人。

The DecoderAgent / 創業融資站內正文
ITBench-AA:前沿模型在企業IT智慧體任務基準測試中得分低於50%——由Artificial Analysis與IBM聯合釋出

Artificial Analysis與IBM聯合推出ITBench-AA,這是首個針對企業IT智慧體任務的基準測試,專注於站點可靠性工程(SRE)。前沿模型得分均低於50%,其中Claude Opus 4.7以47%領先。該基準測試評估模型在Kubernetes事件響應中的表現,要求從日誌和追蹤中診斷故障。

Hugging Face Blog模型 / Agent / 政策站內正文
NVIDIA釋出Polar:用於跨Codex、Claude Code和Qwen Code進行GRPO訓練的忠實令牌回滾框架

NVIDIA研究人員推出Polar框架,透過在智慧體工具鏈和推理伺服器之間放置模型API代理,實現無需修改智慧體工具鏈即可進行強化學習訓練。基於Qwen3.5-4B模型使用GRPO訓練,Polar在Codex、Claude Code和Pi工具鏈上分別將SWE-Bench Verified pass@1提升了22.6、4.8和6.2個百分點。框架以NeMo Gym環境註冊,並在ProRL Agent Server倉庫開源。

MarkTechPost模型 / Agent / 晶片站內正文
YouTube將從本月開始嘗試自動標記AI影片

YouTube正在加強AI標籤規則。從本月起,逼真或經過大量AI修改的內容的標籤將顯示在更顯眼的位置——長影片顯示在播放器下方,短影片則作為疊加層顯示。從2026年5月開始,即使創作者未披露,自動檢測系統也會標記AI生成的內容。推薦和變現不受影響。

The Decoder工具站內正文
讓你的AI投資獲得良好回報

O'Reilly的Infrastructure & Ops超級流會探討了AI工作負載的基礎設施需求、成本和安全挑戰。DORA報告顯示,AI使程式碼交付量提升約10%,但穩定性下降,驗證成本增加。專家強調平臺工程、治理和認知債務的重要性,建議投資內部平臺以保障AI應用的生產就緒。

O'Reilly AI & ML RadarAgent / 政策站內正文