AI News HubLIVE

AI 新聞即時情報

即時監測

今天 AI 世界最重要的變化

來自 105 個可信來源,最近更新 2026-05-29 07:41 UTC+8。

即時監測

即時更新

即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。

即時更新

重設
Liquid AI 釋出 LFM2.5-8B-A1B:面向裝置的 MoE 模型,總引數量 8.3B,啟用引數量 1.5B

Liquid AI 推出了 LFM2.5-8B-A1B,這是一款面向裝置的混合專家(MoE)模型,專為工具呼叫設計。該模型總引數量為 8.3B,但每個 token 僅啟用 1.5B 引數,從而能夠在消費級硬體上執行。它支援 128K 上下文視窗、推理能力,並覆蓋九種語言。相比前代 LFM2-8B-A1B,該模型在非幻覺率、指令遵循、數學推理等基準測試中均有顯著提升。

MarkTechPostAgent / 晶片站內正文
Open House 可觀測性公告:MCP 伺服器、AI Notebooks 和 ClickStack Cloud

在 Open House 活動中,ClickHouse 社群釋出了三項可觀測性重大更新:ClickStack Cloud(完全託管的無伺服器可觀測性平臺)進入私有預覽,Managed ClickStack 正式可用,AI Notebooks 進入 Beta 階段,以及 ClickStack MCP 伺服器開放原始碼。AI Notebooks 是一種持久化的調查工作空間,支援分支探索;MCP 伺服器則允許外部代理使用可觀測性原語,提升調查效率。

Hacker News AIAgent / 研究站內正文
AI編碼已達L3自主,但基礎設施仍卡在L1

AI驅動的編碼工具已實現高度自主,讓任何人都能開發軟體,但底層基礎設施卻依然陳舊,導致效率低下。我們需要一個全新的AI原生作業系統。

Hacker News AIAgent / 晶片站內正文
即便明確警告為假,大型語言模型仍會相信虛假陳述

新研究發現,大型語言模型在訓練過程中會吸收明確標記為假的陳述,即使它們被明確警告為假。這種現象被稱為“否定忽視”,可能導致模型產生幻覺。實驗表明,在合成文件微調後,模型對虛假宣告的“信念率”從2.5%飆升至92.4%。

Hacker News AI模型 / 研究站內正文
如何擊敗超人類AI(圍棋)[影片]

本影片探討了在圍棋領域對抗超人類AI的策略和方法,包括利用AI的弱點、創新戰術以及理解AI的決策模式。

Hacker News AI政策站內正文
蘋果正努力將Gemini整合到iPhone中

儘管蘋果一直強調本地AI的隱私優勢,但最新報告顯示,蘋果計劃藉助谷歌和輝達的雲端算力為Siri注入Gemini能力。這種混合架構或能解決本地AI模型在效能上的不足,但也意味著對使用者隱私的權衡。

Hacker News AI晶片站內正文
在Amazon SageMaker AI上訓練亞塞拜然語語言模型

亞塞拜然電信公司Azercell與AWS生成式AI創新中心合作,在Amazon SageMaker AI上構建了針對亞塞拜然語的大語言模型,透過自定義分詞器、分散式訓練和Liger Kernel最佳化,實現了23%的訓練吞吐量提升、58%的GPU記憶體峰值降低和2倍的分詞效率提升。

AWS Machine Learning Blog模型 / 晶片 / 研究站內正文
反對將AI作為思想夥伴的論點

本文探討了將AI聊天機器人作為“思想夥伴”的風險,指出模型固有的奉承傾向、認知偏差放大以及缺乏真正對抗性互動可能導致使用者過度自信、認知下降甚至危害決策。作者呼籲使用者警惕,並敦促AI實驗室和監管機構承擔保護認知完整性的責任。

Hacker News AIAgent / 政策站內正文
科技界令人憤怒的40個問題

本文以教皇利奧十四世關於人工智慧的通諭為引子,幽默而尖銳地列舉了科技界40個最令人沮喪的問題,從收不到的一次性密碼到無用的客服聊天機器人,批評科技公司忽視人性化設計。

Hacker News AI工具站內正文
AI改變軟體工程崗位的速度太快,面試流程跟不上

隨著AI工具在程式設計中的普及,軟體工程的面試流程變得過時。傳統的編碼測試無法評估開發者使用AI的能力,導致招聘雙方都面臨挑戰。一些公司開始嘗試允許使用AI的測試或現場工作,但問題仍未解決。

Hacker News AIAgent / 研究站內正文
Pubflow:用於更快構建AI應用的後端信任層

Pubflow推出一個統一系統,整合了身份驗證、後端邏輯和基礎設施,消除了構建AI應用時拼接程式碼的需求。它支援多種資料庫和程式語言,並提供生產就緒的啟動套件。

Hacker News AI工具站內正文
AI模型釋出追蹤:Opus 4.8的失調率與Claude Mythos預覽版相似

並非每個新模型都像宣傳的那樣出色。我們的追蹤器將每個版本與同類模型進行對比,幫助您瞭解哪些模型值得關注。本文總結了2026年至今的重大模型釋出,包括Claude Opus 4.8、GPT-5.5 Instant、Nemotron 3 Nano Omni、GPT-5.5、ChatGPT Images 2、Claude Opus 4.7、Claude Mythos(預覽版)、GPT-5.4、Claude Opus 4.6和GPT-5.3-Codex,並闡述了它們的特點與意義。

ZDNet AI模型 / Agent / 晶片站內正文
Sulsaly

Sulsaly 是中東和北非地區排名第一的基於代理AI的銷售線索和外聯平臺。

Product Hunt AIAgent站內正文
Perplexity 推出 Bumblebee:其新型只讀開發掃描器與 Chainguard 有何不同

Perplexity 釋出了一款名為 Bumblebee 的開源開發安全工具,用於掃描程式設計師筆記型電腦上的風險軟體包、擴充套件和 AI 工具配置。該工具只讀,不會執行安裝指令碼或包管理器,專注於四個攻擊面:語言包管理器、AI 代理配置、編輯器擴充套件和瀏覽器擴充套件。與側重於容器和管道的 Chainguard 不同,Bumblebee 專注於開發者的本地環境。

ZDNet AIAgent / 政策站內正文
創新新時代:Google Research在I/O 2026的展示

在2026年Google I/O大會上,Google Research展示了一系列前沿技術,涵蓋科學發現、健康、邊緣計算和天氣預測等領域。推出了Gemini for Science套件(包括ERA和Co-Scientist),加速科學研究;健康方面有Google Health應用、Symptom AI和AMIE系統;Coral NPU推動邊緣AI發展;還有極端天氣預測模型。這些創新展示了AI如何放大人類的智慧。

Google Research BlogAgent / 晶片站內正文
構建帶有嵌入式Amazon SageMaker AI MLflow應用的自定義門戶

本文介紹瞭如何構建一個嵌入Amazon SageMaker AI MLflow應用UI的自定義門戶,使用React前端和Flask反向代理實現AWS SigV4認證,並透過AWS CDK部署。該方案提供持久書籤URL,簡化訪問管理,並支援SSO整合。

AWS Machine Learning BlogAgent站內正文
使用REST API代理簡化對Amazon SageMaker MLflow的外部訪問

本文演示如何構建一個基於Flask的安全MLflow代理服務,透過HTTPS端點訪問Amazon SageMaker MLflow,而無需直接使用MLflow SDK。該解決方案適用於正在經歷雲轉型、希望保留現有ML工作流同時採用雲原生服務的組織。

AWS Machine Learning BlogAgent站內正文
使用 AWS 上的 LangSmith 評估深度智慧體

本文結合 LangChain 評估深度智慧體的經驗和 Anthropic 的 AI 智慧體評估指南,提供了實用指南。您將學習如何應用五種評估模式、使用 pytest 和 LangSmith 構建離線評估,以及配置生產環境的線上監控。文中以文本到 SQL 的深度智慧體為例,使用 Amazon Bedrock 覆蓋從開發到生產的完整生命週期。

AWS Machine Learning BlogAgent / 研究站內正文
雲服務提供商CoreWeave加強軟體堆疊

透過推出新的自主AI功能,這家初創公司利用軟體收購來開發用於智慧體訓練與推理的AI硬體-軟體堆疊。

AI BusinessAgent / 創業融資站內正文
AI識別出失職聯邦法官

聯邦法官埃莉諾·羅斯被曝在 chambers 內與高階執法官員發生婚外情,司法部門試圖匿名處理,但 AI 透過公開檔案細節迅速識破其身份。此事凸顯法院對 AI 能力的無知,以及法律專業人士需提升技術素養,重新思考保密策略。

Hacker News AIAgent / 政策站內正文
markdown-svg-renderer

markdown-svg-renderer 是一款自定義 Markdown 渲染工具,專門針對圍欄程式碼 SVG 塊進行特殊處理:既能渲染影像,又能提供切換到程式碼檢視的選項卡。使用者可直接貼上 Markdown 內容,或透過 URL 載入支援 CORS 的 Markdown 檔案或 Gist。

Simon Willison's Weblog模型站內正文