深度代理現在支持解釋器:小型嵌入式運行時,代理可在其中編寫代碼以協調工具、保持工作狀態,並決定哪些內容進入模型上下文。解釋器提供了一種介於串行工具調用和完整沙盒之間的中間地帶,使代理能夠表達多步驟工作、將中間狀態保留在模型上下文之外,並以更可預測的方式執行代碼和操作。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
本教程將引導您使用kg-gen從純文本、對話和多個源文檔生成知識圖譜。內容包括依賴安裝、實體關係提取、分塊與聚類、多源聚合、NetworkX圖分析(中心性、PageRank、社區檢測)、PyVis交互可視化以及導出為JSON和GraphML。
Strands Evals 推出了四種新的多模態大語言模型(MLLM)評估器,用於圖像到文本任務的整體質量、正確性、忠實度和指令遵循。這些評估器直接將圖像發送給多模態裁判模型,返回基於圖像的分值和推理字符串,可用於持續集成以捕獲視覺幻覺、事實錯誤和指令違規。本文還介紹瞭如何設置這些評估器、使用參考和免參考模式、自定義評估標準以及選擇裁判模型。
Mike Veerman開發了一個HTML應用,可模擬LLM token輸出速度(5-800/秒),幫助直觀理解模型廣告中的速度參數。
Visa最新研究稱,AI加速的騙局是“增長最快的消費者傷害來源”。騙局正從憑證盜竊轉向社會工程學手段。本文介紹消費者和企業如何應對。
隨着AI編碼工具越來越易用,非開發者也能創造滿足小眾需求的應用程序。Google I/O 2026展示了通過AI Studio創建原生Android應用、用提示詞生成Widget等功能,預示着移動端將成為氛圍編程的新前沿。蘋果也在探索基於提示詞的快捷指令創建。
IBM宣佈與Anthropic合作加入Project Glasswing,這是一項旨在保護關鍵軟件基礎設施的行業倡議。IBM利用其在AI安全領域的深厚經驗,推出新一代防禦措施,包括IBM Concert和IBM Autonomous Security等工具,幫助企業應對AI驅動的攻擊。
Tribal 完成 1000 萬美元種子輪融資,由 Team8 領投,致力於通過其元數據原生 AI 代理平台,解決企業系統中 AI 實驗難以轉化為實際生產力的問題。該平台可快速映射企業系統的元數據層,提供可治理、可投產的解決方案,已在 Salesforce、ServiceNow 等平台上應用。
阿里巴巴推出新AI芯片和模型,旨在減少對Nvidia芯片的依賴,實現全棧AI戰略。
本文介紹如何結合 Amazon SageMaker AI 的雙向流推理功能和 vLLM 的實時 API,部署實時語音轉文本服務。通過 Voxtral-Mini-4B 模型,實現音頻流輸入與轉錄文本實時輸出,適用於語音助手、實時字幕、聯絡中心分析等場景。
一封來信指出,埃塞俄比亞總理阿比·艾哈邁德在獲得諾貝爾和平獎後,其領導下多名活動人士因抗議人權侵犯被監禁,諷刺了諾貝爾獎得主羣體的雙重標準。另一封信關注AI導致的失業問題,指出大學畢業生因缺乏入門級工作而被迫返鄉,引發社會不安。
MartinLoop 是 AI 編程代理的控制室,提供支出限制、證明檢查、安全規則、回滾和運行收據,讓自主代理變得可問責。
谷歌宣佈YouTube Shorts新增Remix功能,用户可利用Gemini Omni重新混搭視頻風格,甚至將自己插入他人的視頻中。創作者可控制是否允許混搭,混搭視頻將帶有數字水印並鏈接回原視頻。
2026年,人工智能已進入實際部署階段,全球AI會議成為了解技術趨勢、企業應用和職業發展的重要平台。本文盤點了9大必參加的AI會議,涵蓋全球峯會、企業論壇和政策導向活動,包括Data+AI峯會、倫敦AI峯會、DataHack峯會、SuperAI、世界AI峯會、Ai4、AI for Good全球峯會、AI基礎設施峯會和AI大會,每個活動都提供獨特的見解和網絡機會。
Virtualitics與OpenAI簽署諒解備忘錄,將整合OpenAI的前沿模型到Virtualitics Iris平台,為政府及受監管行業提供可信、透明、可擴展的決策智能解決方案。
本文介紹如何使用Python的Mimesis庫對敏感的生產數據進行匿名化處理,通過一個可操作的示例逐步演示,確保數據隱私合規的同時保持數據集結構完整。
谷歌將AI能力擴展到廣告領域,使用Gemini模型生成產品推薦和解釋,並推出內置聊天機器人的廣告,同時在AI模式中測試新的廣告格式。
谷歌在I/O大會上推出Universal Cart,利用Gemini AI代理整合多零售商購物車,自動完成購買、預測消費行為。
Simon Willison 分析了 Google I/O 2026 發佈的 Gemini Spark 個人 AI 代理,該代理原生集成 Google 應用,但 FAQ 中提到的 Antigravity 平台引發困惑。文章詳細討論了 Spark 的安全措施(隔離 VM、DLP)以及作者對 prompt injection 風險的擔憂,並提及開源 Gemini CLI 將被閉源 Antigravity CLI 取代。
喬納森·弗蘭克爾因其彩票假説獲得2023年AAAI/ACM博士論文獎。在訪談中,他討論了經驗主義與理論證明的對比、計算機科學研究方法的變化、年輕研究者對影響力的追求,以及當前AI研究的關鍵問題:如何判斷AI是否有效。
智囊團Demos的調查發現,AI服務在蘇格蘭選舉期間對34%的問題提供了錯誤信息,包括編造醜聞、虛構候選人和提供錯誤日期。選舉委員會呼籲對AI聊天機器人實施新的法律控制。
datasette-agent-charts 0.1a1 版本發佈,為 Datasette Agent 帶來了 Observable Plot 圖表支持,包括改進的配色方案、權限檢查、交互式工具提示和錯誤修復。
Canonical發佈了Ubuntu Core 26,一個面向物聯網和邊緣設備的極簡、不可變Linux發行版,提供15年支持。其增強的安全特性旨在滿足歐盟《網絡彈性法案》(CRA)的要求,包括經過簽名的snap組件、改進的全盤加密和Chisel構建系統。新版本還優化了OTA更新,尺寸縮小50%-90%,並增加了ARM64的Livepatch支持。
谷歌DeepMind同意與英國工會進行正式談判,此前員工簽署請願書,抗議其AI技術被美國和以色列政府用於國防和情報領域。這標誌着科技巨頭首次可能成立工會。
研究表明,近半數美國專業人士認為AI生成的“低質產出”(workslop)使他們更加謹慎。低質量AI輸出導致信任度下降(57%)、生產力降低(51%)和聲譽受損(46%)。應對策略包括重新思考AI生產力:採取“AI優先,人類第二”的工作模式,以及堅持使用AI工具,通過持續努力和學習實現價值。
我們即將檢驗SynthID和C2PA等系統能否有效打擊深度偽造。谷歌將SynthID驗證擴展到Chrome和搜索,同時檢查C2PA元數據。OpenAI為其圖像添加SynthID。Meta將在Instagram上使用C2PA標記相機拍攝的照片。但挑戰依然存在:元數據易被剝離、開源模型不採用、谷歌身兼AI創作者與解決方案提供者的雙重角色。
智象未來在首屆開放日發佈超2000億參數的原生全模態圖像大模型HiDream-O1-Image-Pro,基於Unified Transformer架構,刷新多項SOTA。同時完成新一輪億級融資,深創投等機構參與。公司推出“模型+智能體”戰略,三大智能體產品落地,並與多家企業達成合作,向世界模型邁進。
這些交易涉及生成式人工智能領域一些最著名的品牌,再次證明了該市場的火爆程度。
作者再次體驗谷歌Android XR眼鏡和Project Aura,展示了Gemini驅動的多模態AI能力,包括日曆添加、圖像編輯和跨應用集成,認為環境AI是智能穿戴的未來。
多年來,科技公司承諾AI將帶來能幹的個人助理,但實際更像無知的實習生。近六個月,開源AI代理平台OpenClaw的流行改變了這一狀況。在I/O 2026大會上,谷歌推出了新的AI代理,用於信息收集、活動策劃、收件箱和日曆總結等。這些代理可在後台持續運行,並深度整合谷歌生態。同時,谷歌擴展了開發者工具,並藉助Gemini Spark等產品,試圖在AI代理領域取得大規模成功。