AI News HubLIVE

AI 新聞即時情報

即時監測

今日 AI 世界最重要的變化

來自 105 個可信來源,最近更新 2026-06-11 23:49 UTC+8。

即時監測

即時更新

即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。

即時更新

重設
使用 Agent-EvalKit 系統化評估 AI 代理

Agent-EvalKit 是一個開源工具包 (Apache 2.0),通過集成 AI 編碼助手(包括 Claude Code、Kiro CLI 和 Kilo Code)來提供評估基礎設施。本文介紹了 Agent-EvalKit 的六個評估階段,並以使用 Strands Agents SDK 和 Amazon Bedrock 構建的旅行研究代理為例進行説明。

AWS Machine Learning BlogAgent / 研究站內正文
datasette 1.0a33 發佈:JSON 擴展功能增強 API

Datasette 1.0a33 發佈,這是邁向穩定版 1.0 的重要一步。該版本將 ?_extra= 模式從表擴展到查詢和行,並新增了文檔。還演示了使用 AI 構建的 API 瀏覽器。

Simon Willison's Weblog模型 / 研究站內正文
在 Amazon Bedrock Data Automation 中優化藍圖提取準確性

Amazon Bedrock Data Automation 的新功能藍圖指令優化,通過提供3-10個示例文檔和真實值,可在幾分鐘內自動改進提取指令,無需模型微調,顯著提高文檔處理準確性。

AWS Machine Learning Blog模型 / Agent / 研究站內正文
使用 Databricks Marketplace 上即用型 MCP 賦能醫療智能代理

Databricks Marketplace 現提供來自 Climb、Atropos Health、Kythera Labs 和 Redox 等合作伙伴的預構建 MCP 服務器,涵蓋生物醫學、臨牀證據、醫療語義和互操作性等領域,幫助開發者快速構建安全的醫療 AI 代理。所有 MCP 服務器集中在 MCP Catalog 中,由 Unity AI Gateway 統一治理,並支持低代碼和編碼兩種開發方式。

Databricks BlogAgent / 政策站內正文
6月23日DC地區歡樂時光活動!

瞭解AI團隊將於6月23日在The Crown & Crow舉辦歡樂時光活動,歡迎DC地區讀者參加,與團隊和特邀嘉賓交流。

Understanding AI政策站內正文
Oxlo.ai:跨AI模型擴展,不增加賬單負擔

Oxlo.ai提供單一API訪問35+前沿AI模型,採用固定月費訂閲模式,幫助AI團隊在擴展時控制成本。平台支持模型比較、響應校準,且不訓練用户數據,旨在解決AI基礎設施成本不可預測的問題。

Product Hunt AIAgent / 芯片站內正文
從零構建特徵存儲:最小可用實現

本文從零開始用Python、DuckDB、Parquet、Redis和FastAPI構建最小特徵存儲,涵蓋註冊表、離線存儲、在線存儲、物化管道和檢索API五個組件,並探討AI時代特徵存儲的設計變化。

KDnuggetsAgent / 研究站內正文
AI財富潮推動舊金山房價飆升:“太荒謬了”

隨着OpenAI、Anthropic等AI公司即將IPO,員工們獲得鉅額財富,導致本就昂貴的舊金山灣區房價進一步飛漲。專家預測,這股熱潮可能持續,加劇住房市場緊張。

The Guardian AI創業融資站內正文
AI代理需要基礎設施:為什麼歐洲的雲區域戰略至關重要

隨着生成式AI向代理型AI演進,歐洲企業面臨數據主權、成本控制和技術基礎設施的新挑戰。文章探討了為何區域性雲服務(如Vultr)比傳統超大規模雲提供商更適合代理型AI的部署,強調了本地化數據管理和避免供應商鎖定的重要性。

The New Stack AIAgent / 芯片站內正文
DiffusionGemma:谷歌基於擴散的開源模型,實現更快的文本生成

谷歌DeepMind的DiffusionGemma是一款實驗性的開源模型,採用擴散方式並行生成文本塊,相比傳統的自迴歸模型,在本地推理時速度更快。它基於Gemma 4 26B A4B MoE架構,犧牲部分質量換取速度,特別適用於交互式編輯等任務。本文解釋了其架構、文本擴散的工作原理、基準測試結果,並提供了使用llama.cpp在本地運行的分步指南。

Analytics Vidhya模型 / Agent / 芯片站內正文
Dario Amodei的新論文:AI時代的冷戰劇本

Anthropic發佈了一篇全面的論文和兩個政策框架,呼籲對前沿模型進行具有約束力的審計,並將AI描繪為國家間戰略武器。CEO Dario Amodei以《指環王》的樹人比喻政治系統反應緩慢,警告AI能力呈指數級增長,可能在1-2年內出現“強大AI”。公司提出強制性第三方測試、披露要求和阻止風險模型權力,並制定了應對失業的層級計劃。

The Decoder模型 / 芯片 / 政策站內正文
大幅優惠,暢玩無限:GeForce NOW夏季促銷帶來超值會員折扣

NVIDIA GeForce NOW夏季促銷現已開啓,12個月Ultimate會員直降70美元,Performance會員優惠35美元。雲遊戲服務消除了硬件障礙,提供即時訪問高性能RTX遊戲的體驗,並支持多設備暢玩。此外,宣佈《激戰3》即將登陸平台,現有《激戰2》和《激戰:重製版》的獨家獎勵。

NVIDIA Blog芯片站內正文
使用Scikit-LLM進行多標籤文本分類

本文介紹如何利用Scikit-LLM和大型語言模型,無需標註數據即可實現多標籤文本分類。通過整合Groq提供的免費開源LLM,採用零樣本推理方式,並基於真實數據集go_emotions演示情感多標籤分類。步驟包括庫安裝、API配置、分類器初始化、數據集加載及預測執行,展示一條文本可同時獲得多個情感標籤。

Machine Learning Mastery模型 / Agent / 研究站內正文
谷歌DeepMind分拆公司如何追蹤隱藏的藥物靶點

谷歌DeepMind的分拆公司Isomorphic Labs利用其新型AI系統IsoDDE發現蛋白質上隱藏的藥物結合口袋,超越了AlphaFold。該系統成功預測了cereblon上的隱秘口袋,驗證了其發現新藥物靶點的能力。

IEEE Spectrum AIAgent / 研究站內正文
Anthropic為Claude Fable隱形護欄道歉

Anthropic為其新AI模型Claude Fable 5內藏的隱形限制措施道歉,這些措施悄然削弱了研究人員和競爭對手使用該模型開發系統的能力。公司表示將撤銷此做法,並對何時啓動限制更加透明,即使這意味着Fable會拒絕更多查詢。

The Verge AI模型 / 政策 / 研究站內正文
為Microsoft Teams打造的AI員工——Viktor

Viktor是一款自主AI員工,集成於Slack和Microsoft Teams,可連接3200+工具並自主執行任務,如管理廣告活動、構建應用、交付報告、編寫代碼。現已推出Teams版本,提供100美元免費額度。

Product Hunt AIAgent / 機械人站內正文
Visa與ChatGPT集成實現AI代理零售購買

Visa將支付基礎設施與ChatGPT連接,使AI代理能夠推薦零售產品並執行金融交易。該部署消除了零售漏斗最後階段的人工干預。自主代理現在可以處理用户提示、評估商家目錄,並通過Visa支付網絡在任何支持的商家完成結賬。

Artificial Intelligence NewsAgent / 政策站內正文
認識Warren 3.0:你的AI財務規劃夥伴

Warren是一款免費的AI財務規劃助手,通過與用户進行語音對話,在10分鐘內生成個性化財務計劃。新版本3.0具有更準確、透明的財務模型,支持用户編輯假設並查看兩種未來情景。已幫助3000多名英國用户規劃財務,解決財務規劃門檻高的問題。

Product Hunt AIAgent站內正文
當上下文崩潰:教會智能體檢測和恢復丟失的記憶

本文是智能體工程系列文章的第八篇,探討AI智能體在複雜多步驟任務中面臨的上下文丟失問題。作者提出了外部化-識別-再水合(ERR)模式,通過將狀態保存到磁盤文件、檢測上下文退化、從文件恢復,幫助智能體自主應對上下文丟失。文章以歷史比喻(640K內存限制)和實際案例(Copilot會話崩潰)説明問題,並詳細介紹了執行連續性和任務連續性兩層狀態的外部化方法。

O'Reilly AI & ML RadarAgent站內正文
Xebia:為什麼AI代理在沒有正確數據基礎的情況下會失敗

Xebia全球CTO Niels Zeilemaker強調,AI代理的成功依賴於堅實的數據基礎,包括數據目錄的正確性。Xebia的Agentic Data Foundation(ADF)和ACE框架幫助企業加速AI採用,同時保持治理和質量。

Artificial Intelligence NewsAgent / 政策站內正文
AI絕對主義正在摧毀我們的思維。我們被兜售的末日未來並非不可避免

我們聽到的關於人工智能的一切都相互矛盾,且無法迴避。AI既可怕又美妙,既可能摧毀世界也能變革未來。有人呼籲必須擁抱它,也有人認為不使用它是一種道德義務。文章指出,AI絕對主義——無論是極端樂觀還是極端悲觀——都在扭曲我們的思考,而真正的未來並非如此單一。

The Guardian AI工具站內正文
Nous Research 推出 Hermes Agent 個人資料構建器:在一個儀表板流程中集成身份、模型、技能和 MCP 服務器

Nous Research 為其開源自改進代理 Hermes Agent 推出了個人資料構建器,該構建器集成在本地 Web 儀表板中,將原先需要多個 CLI 步驟的代理設置流程簡化為一個引導式界面,支持定義身份、選擇模型和提供商、啓用技能、安裝中心技能以及附加 MCP 服務器,並生成隔離的個人資料目錄。

MarkTechPostAgent / 芯片站內正文