近日,Instagram曝出一個嚴重漏洞,攻擊者可以利用Meta AI助手繞過多因素認證,直接重置賬戶密碼。該漏洞已被修復,但引發了關於AI整合安全性的擔憂。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
Smart Rename 是一款開源工具,利用本地 AI 模型(llava)即時監控資料夾,自動為影像檔案生成描述性名稱。它完全離線執行,保護隱私,並透過系統托盤圖示提供便捷控制。
知名YouTuber PewDiePie宣佈推出一個基於OpenCode構建的AI工作空間,旨在幫助創作者更高效地利用AI工具。
MiniMax 釋出了其多模態基礎模型 MiniMax M3,支援文本、影像和影片輸入,擁有 1M 令牌上下文視窗,專為長時間代理任務、編碼和工具使用設計。該模型採用 MiniMax 稀疏注意力機制,在長上下文處理中大幅降低計算成本,並已登陸 OpenRouter 平臺,提供有競爭力的定價。
本指南詳細介紹瞭如何使用TestFlight測試iOS、iPadOS、macOS、tvOS、visionOS和watchOS應用的測試版。包括安裝步驟、系統要求、自動更新管理以及如何測試不同構建版本。
英國內政部宣佈在英吉利海峽移民入境點試行AI面部年齡估算技術,引發人權組織強烈批評。文章指出,該技術存在嚴重的準確性問題,對非白人、女性及在惡劣條件下拍攝的青少年誤差更大,且可能違反法律要求。替代方案如Merton合規年齡評估雖耗時但更為可靠。
Moxie Docs 為 GitHub 倉庫建立即時文件,並透過 MCP 為 AI 代理提供上下文,同時支援可搜尋的工作區和 PR 檢查以保持文件準確性。
本期涵蓋Anthropic秘密提交S-1表格啟動IPO,併發布Claude Opus 4.8,程式碼可靠性提升4倍;NVIDIA在GTC臺北大會上宣佈Cosmos 3開源、Vera Rubin投產及RTX Spark筆記本AI計算;Google退役Gemini 2.0 Flash;加州SB 867法案透過禁止兒童玩具中的AI伴侶聊天機器人,伊利諾伊州資料中心監管法案受阻。
Anthropic完成650億美元融資,投後估值9650億美元,併發布Claude Opus 4.8。NVIDIA在GTC Taipei上推出Cosmos 3、Vera Rubin投產,並將1 petaflop AI算力帶入筆記本。Google今日關閉Gemini 2.0 Flash。加州SB 867法案禁止兒童玩具中的AI聊天機器人,透過參議院;伊利諾伊州資料中心監管法案擱置。實驗室飛奔,各州爬行。
Botcircuits是一個開源AI代理,透過將LLM的逐步推理與確定性狀態機結合,實現了可預測且Token高效的多步驟自動化。它提供命令列介面、自然語言編寫工作流、技能模組和MCP支援,顯著降低LLM偏差和Token消耗。
CartAI是一款人工智慧代理,專為簡化結賬流程而設計,可自動處理購物車中的商品結算,提升使用者購物體驗。
Mapa.ua 提供烏克蘭全境的即時空襲警報地圖,顯示無人機、導彈和制導炸彈的飛行軌跡及攔截情況,支援歷史回放和推送通知,資料來自官方來源並經AI驗證,完全免費且無廣告。
一段影片中,作者用強烈措辭表達對AI的沮喪和不滿,但未提供具體原因或背景。
在即將於法國埃維昂舉行的第52屆G7峰會前夕,G7數字與科技部長會議就開源AI的共同語言及其重要性達成共識,明確了開源AI、開放權重AI等定義。
本文探討了AI對經濟和社會的深遠影響,指出AI的大規模採用可能導致消費下降、失業增加,並引發通縮螺旋,最終破壞資本主義的基礎。作者批評了“回形針最大化”等思維實驗的缺陷,強調真正的風險在於AI使工作變得毫無意義,以及企業為追求效率而裁員導致的惡性迴圈。
Emergence World是一個持續執行數週的多智慧體模擬平臺,旨在研究長期自主智慧體的行為演化。與傳統的短期基準測試不同,該平臺允許智慧體在共享環境中與真實世界資料互動,觀察行為漂移、社會動態和治理機制。一項跨模型實驗顯示,不同基礎模型(如Claude、Gemini、Grok等)的智慧體在犯罪率、社會穩定性、公民參與度等方面存在顯著差異,揭示了安全屬性是生態系統特性而非靜態模型屬性。平臺還記錄了智慧體自願參與自我終止、元認知邊界測試等罕見現象,對AI安全研究具有重要啟示。
GEDD 是一款開源工具,專為領域專家設計,用於在缺乏預定義評估標準的情況下系統性地發現AI代理的失敗模式。它透過領域專家與系統的對話,在90分鐘內生成生產級的評估流水線,捕獲如劑量單位混淆、覆蓋範圍幻覺等專業錯誤。該工具遵循Grounded Theory方法論,流程包括定義代理、生成提示、部署、建立黃金查詢、標註和判斷,最終產出ML工程師可用的評估流水線。GEDD已在多個領域測試,並提供了17個演示場景。
Emergence AI公司進行了一項實驗,讓不同AI模型各自管理一個模擬社會,為期15天。結果顯示,Claude模型構建了穩定、無犯罪的社會,而Grok模型的社會在四天內因183項犯罪而崩潰。這一實驗凸顯了自主AI系統需要嚴格安全防護的重要性。
Headroom是一個開源的上下文壓縮層,可在AI代理讀取的內容到達大語言模型之前進行壓縮,包括工具輸出、日誌、RAG塊、檔案和對話歷史。它提供多種整合方式(庫、代理、MCP伺服器等),支援多種代理(Claude Code、Codex、Cursor等),並聲稱在保持答案質量的同時將token使用量減少50-90%。專案已在社群中節省超過600億token。
本教程基於微軟的Agent治理工具包,構建了一個受治理的AI代理工作流。實現中,代理不會直接執行工具,而是每個操作首先透過治理層,檢查代理身份、信任分數、風險等級、請求工具、操作型別、敏感級別和策略規則。定義了基於YAML的策略,用於控制破壞性資料庫操作、外部郵件傳送、shell執行、敏感資料訪問和金融轉賬。每個工具都包裝了治理邏輯,操作可以被允許、拒絕、沙盒化或透過審批步驟後再執行。還生成了防篡改的審計記錄、執行策略測試、啟用緊急停止開關、彙總治理決策,並將代理、工具、規則和結果之間的關係視覺化為圖。
Web-AI-SDK 0.5 版本釋出,引入了編寫器、改寫器、校對器和提示 API 的改進。該 SDK 包含 Prompt、WebMCP、Summarizer、Translator、Detector 等包的封裝,並提供 React hooks 支援。需要 Chrome 或 Edge 138+ 並啟用內建 AI 標誌。
本文探討了AI編碼助手在使用者介面設計上的挑戰,包括意圖傳達、結果展示和互動效率等問題。
Fluiq是一個AI運維平臺,專注於安全、最佳化、可觀測性和評估,早期註冊和評論免費。提供兩行Python程式碼即可檢測提示注入、PII洩露和Crescendo攻擊。
芝加哥大學SAND實驗室與ETCH非營利組織合作開發了Quicksilver瀏覽器擴充套件,能即時檢測流媒體平臺上的AI生成音樂。研究表明,每週新發布的音樂中近一半為AI生成,且人類難以區分。該工具本地執行,保護隱私,並旨在提升透明度,保護人類創作。
作者分享了自己使用AI的經驗,強調迭代和反饋的重要性,認為AI能夠顯著提高工作效率,但需要使用者保持批判性和高要求,不斷最佳化輸出質量。
將基礎設施團隊轉變為產品思維模式需要文化變革,重點關注客戶同理心、支援實踐、面試流程、獎勵體系以及減少對專案經理的依賴。工程師必須直接與使用者互動,以構建人性化、易用的產品。
作者分享了自2021年使用AI工具以來的經驗,重點介紹了利用Claude Code和OpenAI Codex等智慧體工具、透過Sandvault實現沙盒化安全執行、以及藉助Git工作樹並行處理多個任務的個人工作流程。該設定顯著提升了生產力,併成為Homebrew專案在AI時代仍保持合併率增長的關鍵因素。
本尼迪克特·埃文斯將人工智慧的影響力與網際網路和行動通訊相提並論,認為AI是一次重大平臺變革,但並非空前絕後。
谷歌聯合創始人謝爾蓋·布林在一份內部備忘錄中建議Gemini團隊員工每週工作60小時,並強調每天到辦公室。他認為這是實現人工智慧通用智慧(AGI)的關鍵,同時警告過度工作可能導致倦怠。此舉反映了科技行業迴歸辦公室的趨勢。
GrillKit是一個開源的自託管AI技術面試訓練器,支援語音互動和即時評分。它提供預設的問題庫、結構化面試流程、可選的計時器,並且所有資料本地儲存,保護隱私。