本文介紹了兩種新穎的自主AI代理框架——DeepTS/DeepCollector和DeepScribe,它們利用混合本地-遠端架構自動化科學工作流程,包括時間序列資料整理和講座報告轉換,並討論了向知識圖譜和高能物理的擴充套件。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
一項名為AgingBench的新基準測試揭示,已部署的AI智慧體會透過四種老化機制隨著時間的推移而退化,需要生命週期評估和針對性修復,而不僅僅是更強的初始模型。
約束獲取(CA)及相關研究因缺乏適當基準而進展受限。現有基準多為求解器設計,忽視領域知識工件。本文提出MPMMine基準套件,以一致性、標準化、完整性、可擴充套件性、開放性和版本控制為指導,採用MiniZinc、CommonMark和JSON開放格式,提供多模型、多例項及大量解與非解,並附有自然語言描述,以支援文本到模型方法。
arXiv新論文提出GEM(治理演化記憶)框架,將長期AI智慧體記憶視為新的資料管理工作負載,透過狀態級操作替代記錄級資料庫操作,解決當前記憶系統的四大缺陷。
一項新研究質疑大型語言模型是否具有真正的內省能力,認為現有證據可能僅僅是基於表面線索的模式匹配,而非真正的元認知監控。
BrickAnything是一種幾何條件自迴歸框架,能從多種3D表示生成可構建的磚塊結構。它使用點雲作為統一幾何介面,預測磚塊序列以重建目標形狀,並引入結構感知樹標記化來建模依賴關係,配合偏好對齊、有效性約束解碼和自適應回滾,顯著提升了穩定性和幾何保真度。
AI基礎設施初創公司Fireworks、Baseten和OpenRouter正在籌集鉅額資金,標誌著推理基礎設施成為關鍵的AI平臺層。同時,智慧體工程、新基準測試和模型更新主導了AI新聞週期。
一位獨立開發者建立了Snipforge,一個包含28種工具的全能AI影片編輯套件,包括轉錄、智慧剪輯、背景去除等功能。定價從免費到團隊版每月15美元。
ACM CAIS 2026註冊已滿,但可加入候補名單。會議將於2026年5月26日至29日在聖何塞舉行,設有主題演講、63篇研究論文和46個系統演示,並已與AI工程師世界博覽會合作。
ClearCompli 提供AI治理與合規洞察,幫助企業應對AI監管挑戰。
DeepSeek研究員陳德里使用自研的DeliAutoResearch技能,與DeepSeek-V4-Pro和GPT-Image2合作,在6天內完成了一篇46頁的論文。論文提出了L1-L5自主研究智慧體分類體系,分析了四種架構模式和17個主流系統,並指出了六大開放問題。陳德里表示,人類僅需投入不到2小時的“CPU時間”,其餘工作由AI Agent完成。
Hyper是一款AI驅動的個人知識管理工具,能從Notion、Obsidian等應用中整合上下文,提供智慧輔助。創始人此前在Matic從事機器人研發,曾在2020年嘗試改進GPT-2未果,如今推出自助版本。
分析顯示,教皇利奧十四世關於人工智慧的通諭《人間偉大》中部分段落可能由AI生成。AI檢測工具Pangram指出,某些段落AI寫作比例高達40%至100%,並存在AI生成文本的典型特徵,如“genuinely”一詞使用頻率增加。然而,檢測並非絕對可靠,其他部分被認定為人類寫作。
谷歌最新無螢幕健康追蹤器Fitbit Air售價僅100美元,是Whoop的強力競爭對手。經過一週的跑步、力量訓練、瑜伽等測試,我們發現這款裝置輕便舒適,電池續航約一週,配合AI健康教練提供全面的追蹤體驗。雖然無螢幕設計減少了干擾,但在運動中檢視資料需要開啟手機應用。訂閱Google Health Premium可解鎖AI教練的高階功能。
theta 是一個用 Rust 編寫的 CLI 工具,用於管理代理配置。它讀取 theta.toml 檔案,解析、鎖定、物化並轉換代理配置到任何支援的 harness(如 Claude Code、Codex CLI、GitHub Copilot、Cursor),透過解決 .theta/ 資料夾中的資源來實現。它就像一個代理 harness 資源的包管理器。安裝簡單,支援新增規則、工具、技能和子代理,並提供驗證和轉換命令。專案深受 uv 啟發,是 theta-spec 的標準實現。
一名東灣母親接到詐騙電話,騙子使用AI和深度偽造技術模仿其女兒的聲音,聲稱她被墨西哥販毒集團綁架。這是利用AI技術進行詐騙的新趨勢,當局提醒公眾警惕。
教皇利奧十四世在其首道通諭《偉大的人性》中呼籲各國政府放緩人工智慧系統開發,強調AI在戰爭中的使用必須受到最嚴格的道德約束,並譴責“正義戰爭”理論已過時。
本文探討了防止AI被惡意使用的三大挑戰:管轄權漏洞使不法分子可在無法律約束的地區活動;開源模型難以監控和限制;網際網路匿名性阻礙了身份識別和追溯。作者呼籲在隱私與安全、開源與管控之間做出艱難權衡,並指出當前預設狀態不可持續。
本文探討了AI工具對工程師判斷力的影響,指出被動使用會導致技能退化,而對抗性使用則能鍛鍊判斷力。真正的技能不在於提示詞,而在於提出質疑的能力。
Modal 為 Teams 和 Enterprise 使用者推出了基於角色的訪問控制(RBAC),圍繞環境(Environments)構建,支援精細許可權管理,確保智慧體和人類的安全協作。
本週AI新聞要點:Anthropic公開了此前僅限國防承包商使用的頂級模型Mythos,使五角大樓級AI能力向開發者開放;DeepMind CEO哈薩比斯將AGI時間線提前至2029年;Starlette框架爆出嚴重認證繞過漏洞,影響數百萬AI代理;CrowdStrike等聯合摧毀Glassworm殭屍網路;法國巴黎銀行與Mistral達成主權AI安全合作;中國限制阿里和深度求索頂尖AI工程師出境;Uber AI預算超支、ClickUp裁員並引入數千AI代理,同時MIT技術評論資料顯示AI暴露崗位失業率更低,奧特曼撤回白領失業預言。
本文詳細介紹瞭如何為Reachy Mini機器人部署完全本地的語音對話管道,無需雲端或API金鑰。採用級聯方式,結合VAD、STT、LLM和TTS,推薦使用llama.cpp與Gemma 4、Silero VAD、Parakeet-TDT 0.6B v3 STT和Qwen3-TTS。提供了多種LLM執行選項,包括本地MLX、Transformers、vLLM或遠端Responses API。
全球選舉前夕,我們致力於幫助人們獲取資訊、支援網路安全防禦者並提升AI透明度。
Warp 利用 GPT-5.5 和 OpenAI 模型,協調跨本地、雲端和開源開發工作流的編碼代理。
Daniel Stenberg近日透露,curl團隊正承受前所未有的壓力,因為AI輔助提交的可信安全報告數量激增,平均每天超過一份,是2024年的4到5倍。儘管報告質量極高,但curl程式碼穩固,發現的漏洞多為低或中等嚴重性,最後一個高危漏洞在2023年10月。
本教程詳細介紹瞭如何使用zeroentropy/zerank-2-reranker(一個基於Qwen3的4B引數交叉編碼器重排序器)來提升檢索質量。內容涵蓋環境搭建、模型載入、查詢-文件對評分、使用model.rank進行排序、構建兩階段檢索-重排序管道、NDCG@10評估以及跨領域(金融、法律、程式碼)效能測試,最後還進行了批處理吞吐量測試。
Stability AI釋出了Stable Audio 3,這是一個潛在擴散模型系列,用於生成和編輯44.1 kHz立體聲音訊。該系列提供小型、中型和大型三種規模,其中小型和中型開源。關鍵技術包括高度壓縮的SAME自編碼器、可變長度生成以及結合流匹配、蒸餾和對抗性後訓練的三階段訓練流程。該模型在音樂和音效基準測試中取得了最先進的結果,並支援基於修補的音訊編輯。
隨著AI向智慧體方向演進,對CPU提出了新要求:快速核心、海量記憶體頻寬以及全核高負載下的持續效能。Phoronix今日釋出的基準測試結果顯示,NVIDIA Vera CPU滿足這些需求。Vera採用88個定製Olympus核心,1.2TB/s記憶體頻寬,在功率效率內提供強勁效能。測試中,Vera在單插槽系統中展現了卓越的程式碼編譯、檔案壓縮、影片轉碼等能力,並在STREAM TRIAD測試中實現了90%峰值頻寬,遠超傳統x86 CPU。與上一代Grace相比,Vera效能提升1.6倍,在多項測試中領先於Intel和AMD的最新處理器。NVIDIA已向主要AI公司和雲提供商交付首批Vera CPU,預計下半年透過合作伙伴上市。
儘管97%的電信高管正在評估或採用AI,但許多專案因“資料債務”——即分散、無治理且語義不清晰的資料——而停滯在規模化之前。NVIDIA的2025年報告指出,瓶頸並非模型質量,而是資料可用性。Databricks Unity Catalog透過統一的語義層和治理機制,實現跨系統資料聯邦、細粒度訪問控制和豐富的語義上下文,從而將AI從演示推向可信賴的生產系統。
Zero.xyz是一個免費工具,能讓AI代理透過統一API訪問超過4000種工具和服務,無需配置API金鑰。它相容Claude Code、Codex、Gemini等多種CLI代理,並提供5美元免費額度。