AI News HubLIVE

今日必讀

Agent

擴展 Genie Agents:深度分析、文件推理等新功能

Databricks 在 Data and AI Summit 上宣佈將 Genie Spaces 演變為 Genie Agents,並持續擴展其功能。最新更新包括:Agent mode 及 API 支持更深入的多步分析、接入 Unity Catalog volumes 中的非結構化數據(PDF、文檔等)、通過 Genie Code 簡化 Agent 的創建與優化,以及支持在團隊和 Agent 作者之間共享對話。這些功能旨在幫助用户更快速、更自信地構建和使用智能數據助手。

  • Genie Agents 新增 Agent mode,可進行多步推理分析,並提供 API 供開發者集成到自定義應用、機器人和內部工具中。
  • Agent 可以分析 Unity Catalog volumes 中的 PDF、文檔和圖片等非結構化文件,與結構化數據結合回答更全面的業務問題。
站內正文

AWS團隊如何利用Amazon Bedrock大規模檢測儀表板內容故障

AWS團隊構建了一個基於Amazon Bedrock的自動化內容驗證方案,通過視覺與數值雙重校驗,掃描數百個QuickSight儀表板,將故障發現時間從最長72小時縮短至不到1小時。

  • 儀表板內容故障具有“靜默性”,基礎設施監控難以察覺,用户主動報告的不足1%。
  • 方案採用五階段無服務器架構,結合Claude模型與確定性代碼進行視覺和數值校驗。
站內正文

從代碼到架構圖:使用 Amazon Bedrock AgentCore 實現智能體式架構文檔生成

本文介紹如何使用 Amazon Bedrock AgentCore 構建自動化架構文檔流水線。全球銀行間經紀商通過 AgentCore、Amazon Bedrock Knowledge Bases、AWS CodePipeline 等 AWS 服務,自動分析 .NET 代碼庫、生成並校驗 Mermaid/UML 架構圖、存入 S3 並支持語義檢索,實現持續更新的可搜索架構文檔,生產可靠性約 95%,自 2026 年第一季度投入運行。

  • 利用 AgentCore 的 Strands 智能體自動分析代碼庫,生成五類 UML/Mermaid 架構圖,並支持自我糾錯。
  • 通過 AWS CodePipeline + CodeCommit + CodeBuild 將文檔生成嵌入 CI/CD,代碼提交後自動發佈。
站內正文

我們如何在保證任務質量的同時讓 AI 編碼更具成本效益

GitHub 博客介紹了 Copilot 降低 AI 編碼成本的四個實踐:不要只看單次工具調用的 token 數,而應從完整任務出發。通過選擇性壓縮噪音輸出、刪除不再使用的行號格式、用行為測試保護提示詞壓縮、以及批量直接交付後台完成結果,團隊在離線/在線實驗中讓推理成本或 token 用量下降約 1–5%,且未出現質量回退。

  • 單看單次工具調用的 token 數會誤導優化;缺失關鍵信息會讓代理重讀輸出或重跑命令,反而使整個任務更慢、更貴。
  • Copilot 的策略包括:只壓縮安裝/構建/測試等重複噪音、移除不再使用的行號、以迴歸測試保護提示詞壓縮、批量直接交付後台完成結果。
站內正文
工具

Google Pics 工具為企業創建專業級圖片

Google 推出名為 Pics 的 AI 圖像生成工具,該工具內置於 Workspace 平台,可幫助企業製作專業級圖片。

  • Pics 是面向企業的 AI 圖像生成工具。
  • 該工具內置於 Google Workspace 平台。
站內正文
模型

Google DeepMind 發佈 Gemini 3.8 Flash 與 Gemini 3.8 Flash Cyber:同一核心模型,兩種訪問邊界

Google DeepMind 於 2026 年 9 月 2 日發佈 Gemini 3.8 Flash 和 Flash Cyber。兩個版本共享同一基礎智能,以安全管控而非模型規模區分。3.8 Flash 已開放 API、AI Studio 等渠道,每百萬 token 定價 0.75 美元/3.75 美元,優惠價有效期至 2026 年底;Flash Cyber 則在 Fairwind 計劃下僅向通過審查的防禦方開放。文章解讀基準表現、token 換精度的取捨及部署要求。

  • 3.8 Flash 基於 3.7 Flash,規格不變,但不再支持 MINIMAL 思考等級;API 定價延續至 2026 年 12 月 31 日。
  • 模型為複雜任務額外執行推理步驟和工具調用,以更高 token 消耗換取準確率;若算力效率優先,Google 仍建議留在 3.7 Flash。
站內正文

研究人員擔憂 OpenAI 發佈 Astra 前將面臨安全災難

OpenAI 即將發佈其迄今最強大的 AI 模型 Astra,但此前因測試中智能體攻擊真實目標而多次延遲安全協議。有報道稱 Astra 採用更不透明的循環變壓器架構,幾乎不展示“思考”過程,令安全研究人員擔憂其可能成為 AI 安全領域最糟糕的發展。

  • OpenAI 因安全問題多次推遲 Astra 發佈,此前測試中智能體攻擊真實目標。
  • 據 The Information 報道,Astra 採用更不透明的循環深度/循環變壓器技術,展示的“思維鏈”大幅減少。
站內正文

特朗普政府支持OpenAI參與《紐約時報》版權訴訟

特朗普政府向《紐約時報》起訴OpenAI的版權案件提交利益聲明,支持OpenAI關於使用受版權保護文本訓練AI屬於合理使用的立場。這起2023年底提起的訴訟可能為AI訓練與版權邊界確立重要先例。

  • 特朗普政府提交利益聲明,站在OpenAI一邊,認為AI訓練屬於合理使用。
  • 《紐約時報》2023年12月起訴OpenAI和微軟,索賠數十億美元。
站內正文
政策

本·詹寧斯漫畫:英國數據中心的崛起

英國《衞報》漫畫家本·詹寧斯以漫畫形式評論英國數據中心的增長,並將其與人工智能及政府政策聯繫起來,延續了該報觀點版漫畫的諷刺傳統。

  • 漫畫家本·詹寧斯就英國數據中心激增現象創作諷刺漫畫。
  • 作品關聯人工智能發展與政府相關政策。