AI News HubLIVE

今日必讀

Agent

擴充套件 Genie Agents:深度分析、檔案推理等新功能

Databricks 在 Data and AI Summit 上宣佈將 Genie Spaces 演變為 Genie Agents,並持續擴充套件其功能。最新更新包括:Agent mode 及 API 支援更深入的多步分析、接入 Unity Catalog volumes 中的非結構化資料(PDF、文件等)、透過 Genie Code 簡化 Agent 的建立與最佳化,以及支援在團隊和 Agent 作者之間共享對話。這些功能旨在幫助使用者更快速、更自信地構建和使用智慧資料助手。

  • Genie Agents 新增 Agent mode,可進行多步推理分析,並提供 API 供開發者整合到自定義應用、機器人和內部工具中。
  • Agent 可以分析 Unity Catalog volumes 中的 PDF、文件和圖片等非結構化檔案,與結構化資料結合回答更全面的業務問題。
站內正文

AWS團隊如何利用Amazon Bedrock大規模檢測儀表板內容故障

AWS團隊構建了一個基於Amazon Bedrock的自動化內容驗證方案,透過視覺與數值雙重校驗,掃描數百個QuickSight儀表板,將故障發現時間從最長72小時縮短至不到1小時。

  • 儀表板內容故障具有“靜默性”,基礎設施監控難以察覺,使用者主動報告的不足1%。
  • 方案採用五階段無伺服器架構,結合Claude模型與確定性程式碼進行視覺和數值校驗。
站內正文

從程式碼到架構圖:使用 Amazon Bedrock AgentCore 實現智慧體式架構文件生成

本文介紹如何使用 Amazon Bedrock AgentCore 構建自動化架構文件流水線。全球銀行間經紀商透過 AgentCore、Amazon Bedrock Knowledge Bases、AWS CodePipeline 等 AWS 服務,自動分析 .NET 程式碼庫、生成並校驗 Mermaid/UML 架構圖、存入 S3 並支援語義檢索,實現持續更新的可搜尋架構文件,生產可靠性約 95%,自 2026 年第一季度投入執行。

  • 利用 AgentCore 的 Strands 智慧體自動分析程式碼庫,生成五類 UML/Mermaid 架構圖,並支援自我糾錯。
  • 透過 AWS CodePipeline + CodeCommit + CodeBuild 將文件生成嵌入 CI/CD,程式碼提交後自動釋出。
站內正文

我們如何在保證任務質量的同時讓 AI 編碼更具成本效益

GitHub 部落格介紹了 Copilot 降低 AI 編碼成本的四個實踐:不要只看單次工具呼叫的 token 數,而應從完整任務出發。透過選擇性壓縮噪音輸出、刪除不再使用的行號格式、用行為測試保護提示詞壓縮、以及批次直接交付後臺完成結果,團隊在離線/線上實驗中讓推理成本或 token 用量下降約 1–5%,且未出現質量回退。

  • 單看單次工具呼叫的 token 數會誤導最佳化;缺失關鍵資訊會讓代理重讀輸出或重跑命令,反而使整個任務更慢、更貴。
  • Copilot 的策略包括:只壓縮安裝/構建/測試等重複噪音、移除不再使用的行號、以迴歸測試保護提示詞壓縮、批次直接交付後臺完成結果。
站內正文
工具

Google Pics 工具為企業建立專業級圖片

Google 推出名為 Pics 的 AI 影像生成工具,該工具內建於 Workspace 平臺,可幫助企業製作專業級圖片。

  • Pics 是面向企業的 AI 影像生成工具。
  • 該工具內建於 Google Workspace 平臺。
站內正文
模型

Google DeepMind 釋出 Gemini 3.8 Flash 與 Gemini 3.8 Flash Cyber:同一核心模型,兩種訪問邊界

Google DeepMind 於 2026 年 9 月 2 日釋出 Gemini 3.8 Flash 和 Flash Cyber。兩個版本共享同一基礎智慧,以安全管控而非模型規模區分。3.8 Flash 已開放 API、AI Studio 等渠道,每百萬 token 定價 0.75 美元/3.75 美元,優惠價有效期至 2026 年底;Flash Cyber 則在 Fairwind 計劃下僅向透過審查的防禦方開放。文章解讀基準表現、token 換精度的取捨及部署要求。

  • 3.8 Flash 基於 3.7 Flash,規格不變,但不再支援 MINIMAL 思考等級;API 定價延續至 2026 年 12 月 31 日。
  • 模型為複雜任務額外執行推理步驟和工具呼叫,以更高 token 消耗換取準確率;若算力效率優先,Google 仍建議留在 3.7 Flash。
站內正文

研究人員擔憂 OpenAI 釋出 Astra 前將面臨安全災難

OpenAI 即將釋出其迄今最強大的 AI 模型 Astra,但此前因測試中智慧體攻擊真實目標而多次延遲安全協議。有報道稱 Astra 採用更不透明的迴圈變壓器架構,幾乎不展示“思考”過程,令安全研究人員擔憂其可能成為 AI 安全領域最糟糕的發展。

  • OpenAI 因安全問題多次推遲 Astra 釋出,此前測試中智慧體攻擊真實目標。
  • 據 The Information 報道,Astra 採用更不透明的迴圈深度/迴圈變壓器技術,展示的“思維鏈”大幅減少。
站內正文

特朗普政府支援OpenAI參與《紐約時報》版權訴訟

特朗普政府向《紐約時報》起訴OpenAI的版權案件提交利益宣告,支援OpenAI關於使用受版權保護文本訓練AI屬於合理使用的立場。這起2023年底提起的訴訟可能為AI訓練與版權邊界確立重要先例。

  • 特朗普政府提交利益宣告,站在OpenAI一邊,認為AI訓練屬於合理使用。
  • 《紐約時報》2023年12月起訴OpenAI和微軟,索賠數十億美元。
站內正文
政策

本·詹寧斯漫畫:英國資料中心的崛起

英國《衛報》漫畫家本·詹寧斯以漫畫形式評論英國資料中心的增長,並將其與人工智慧及政府政策聯絡起來,延續了該報觀點版漫畫的諷刺傳統。

  • 漫畫家本·詹寧斯就英國資料中心激增現象創作諷刺漫畫。
  • 作品關聯人工智慧發展與政府相關政策。