約束獲取(CA)及相關研究因缺乏適當基準而進展受限。現有基準多為求解器設計,忽視領域知識工件。本文提出MPMMine基準套件,以一致性、標準化、完整性、可擴展性、開放性和版本控制為指導,採用MiniZinc、CommonMark和JSON開放格式,提供多模型、多實例及大量解與非解,並附有自然語言描述,以支持文本到模型方法。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
arXiv新論文提出GEM(治理演化記憶)框架,將長期AI智能體記憶視為新的數據管理工作負載,通過狀態級操作替代記錄級數據庫操作,解決當前記憶系統的四大缺陷。
一項新研究質疑大型語言模型是否具有真正的內省能力,認為現有證據可能僅僅是基於表面線索的模式匹配,而非真正的元認知監控。
BrickAnything是一種幾何條件自迴歸框架,能從多種3D表示生成可構建的磚塊結構。它使用點雲作為統一幾何接口,預測磚塊序列以重建目標形狀,並引入結構感知樹標記化來建模依賴關係,配合偏好對齊、有效性約束解碼和自適應回滾,顯著提升了穩定性和幾何保真度。
AI基礎設施初創公司Fireworks、Baseten和OpenRouter正在籌集鉅額資金,標誌着推理基礎設施成為關鍵的AI平台層。同時,智能體工程、新基準測試和模型更新主導了AI新聞週期。
一位獨立開發者創建了Snipforge,一個包含28種工具的全能AI視頻編輯套件,包括轉錄、智能剪輯、背景去除等功能。定價從免費到團隊版每月15美元。
ACM CAIS 2026註冊已滿,但可加入候補名單。會議將於2026年5月26日至29日在聖何塞舉行,設有主題演講、63篇研究論文和46個系統演示,並已與AI工程師世界博覽會合作。
ClearCompli 提供AI治理與合規洞察,幫助企業應對AI監管挑戰。
DeepSeek研究員陳德里使用自研的DeliAutoResearch技能,與DeepSeek-V4-Pro和GPT-Image2合作,在6天內完成了一篇46頁的論文。論文提出了L1-L5自主研究智能體分類體系,分析了四種架構模式和17個主流系統,並指出了六大開放問題。陳德里表示,人類僅需投入不到2小時的“CPU時間”,其餘工作由AI Agent完成。
Hyper是一款AI驅動的個人知識管理工具,能從Notion、Obsidian等應用中整合上下文,提供智能輔助。創始人此前在Matic從事機器人研發,曾在2020年嘗試改進GPT-2未果,如今推出自助版本。
分析顯示,教皇利奧十四世關於人工智能的通諭《人間偉大》中部分段落可能由AI生成。AI檢測工具Pangram指出,某些段落AI寫作比例高達40%至100%,並存在AI生成文本的典型特徵,如“genuinely”一詞使用頻率增加。然而,檢測並非絕對可靠,其他部分被認定為人類寫作。
谷歌最新無屏幕健康追蹤器Fitbit Air售價僅100美元,是Whoop的強力競爭對手。經過一週的跑步、力量訓練、瑜伽等測試,我們發現這款設備輕便舒適,電池續航約一週,配合AI健康教練提供全面的追蹤體驗。雖然無屏幕設計減少了干擾,但在運動中查看數據需要打開手機應用。訂閲Google Health Premium可解鎖AI教練的高級功能。
theta 是一個用 Rust 編寫的 CLI 工具,用於管理代理配置。它讀取 theta.toml 文件,解析、鎖定、物化並轉換代理配置到任何支持的 harness(如 Claude Code、Codex CLI、GitHub Copilot、Cursor),通過解決 .theta/ 文件夾中的資源來實現。它就像一個代理 harness 資源的包管理器。安裝簡單,支持添加規則、工具、技能和子代理,並提供驗證和轉換命令。項目深受 uv 啓發,是 theta-spec 的標準實現。
一名東灣母親接到詐騙電話,騙子使用AI和深度偽造技術模仿其女兒的聲音,聲稱她被墨西哥販毒集團綁架。這是利用AI技術進行詐騙的新趨勢,當局提醒公眾警惕。
教皇利奧十四世在其首道通諭《偉大的人性》中呼籲各國政府放緩人工智能系統開發,強調AI在戰爭中的使用必須受到最嚴格的道德約束,並譴責“正義戰爭”理論已過時。
本文探討了防止AI被惡意使用的三大挑戰:管轄權漏洞使不法分子可在無法律約束的地區活動;開源模型難以監控和限制;互聯網匿名性阻礙了身份識別和追溯。作者呼籲在隱私與安全、開源與管控之間做出艱難權衡,並指出當前默認狀態不可持續。
本文探討了AI工具對工程師判斷力的影響,指出被動使用會導致技能退化,而對抗性使用則能鍛鍊判斷力。真正的技能不在於提示詞,而在於提出質疑的能力。
Modal 為 Teams 和 Enterprise 用户推出了基於角色的訪問控制(RBAC),圍繞環境(Environments)構建,支持精細權限管理,確保智能體和人類的安全協作。
本週AI新聞要點:Anthropic公開了此前僅限國防承包商使用的頂級模型Mythos,使五角大樓級AI能力向開發者開放;DeepMind CEO哈薩比斯將AGI時間線提前至2029年;Starlette框架爆出嚴重認證繞過漏洞,影響數百萬AI代理;CrowdStrike等聯合摧毀Glassworm殭屍網絡;法國巴黎銀行與Mistral達成主權AI安全合作;中國限制阿里和深度求索頂尖AI工程師出境;Uber AI預算超支、ClickUp裁員並引入數千AI代理,同時MIT技術評論數據顯示AI暴露崗位失業率更低,奧特曼撤回白領失業預言。
本文詳細介紹瞭如何為Reachy Mini機器人部署完全本地的語音對話管道,無需雲端或API密鑰。採用級聯方式,結合VAD、STT、LLM和TTS,推薦使用llama.cpp與Gemma 4、Silero VAD、Parakeet-TDT 0.6B v3 STT和Qwen3-TTS。提供了多種LLM運行選項,包括本地MLX、Transformers、vLLM或遠程Responses API。
全球選舉前夕,我們致力於幫助人們獲取信息、支持網絡安全防禦者並提升AI透明度。
Warp 利用 GPT-5.5 和 OpenAI 模型,協調跨本地、雲端和開源開發工作流的編碼代理。
Daniel Stenberg近日透露,curl團隊正承受前所未有的壓力,因為AI輔助提交的可信安全報告數量激增,平均每天超過一份,是2024年的4到5倍。儘管報告質量極高,但curl代碼穩固,發現的漏洞多為低或中等嚴重性,最後一個高危漏洞在2023年10月。
本教程詳細介紹瞭如何使用zeroentropy/zerank-2-reranker(一個基於Qwen3的4B參數交叉編碼器重排序器)來提升檢索質量。內容涵蓋環境搭建、模型加載、查詢-文檔對評分、使用model.rank進行排序、構建兩階段檢索-重排序管道、NDCG@10評估以及跨領域(金融、法律、代碼)性能測試,最後還進行了批處理吞吐量測試。
Stability AI發佈了Stable Audio 3,這是一個潛在擴散模型系列,用於生成和編輯44.1 kHz立體聲音頻。該系列提供小型、中型和大型三種規模,其中小型和中型開源。關鍵技術包括高度壓縮的SAME自編碼器、可變長度生成以及結合流匹配、蒸餾和對抗性後訓練的三階段訓練流程。該模型在音樂和音效基準測試中取得了最先進的結果,並支持基於修補的音頻編輯。
隨着AI向智能體方向演進,對CPU提出了新要求:快速內核、海量內存帶寬以及全核高負載下的持續性能。Phoronix今日發佈的基準測試結果顯示,NVIDIA Vera CPU滿足這些需求。Vera採用88個定製Olympus核心,1.2TB/s內存帶寬,在功率效率內提供強勁性能。測試中,Vera在單插槽系統中展現了卓越的代碼編譯、文件壓縮、視頻轉碼等能力,並在STREAM TRIAD測試中實現了90%峯值帶寬,遠超傳統x86 CPU。與上一代Grace相比,Vera性能提升1.6倍,在多項測試中領先於Intel和AMD的最新處理器。NVIDIA已向主要AI公司和雲提供商交付首批Vera CPU,預計下半年通過合作伙伴上市。
儘管97%的電信高管正在評估或採用AI,但許多項目因“數據債務”——即分散、無治理且語義不清晰的數據——而停滯在規模化之前。NVIDIA的2025年報告指出,瓶頸並非模型質量,而是數據可用性。Databricks Unity Catalog通過統一的語義層和治理機制,實現跨系統數據聯邦、細粒度訪問控制和豐富的語義上下文,從而將AI從演示推向可信賴的生產系統。
Zero.xyz是一個免費工具,能讓AI代理通過統一API訪問超過4000種工具和服務,無需配置API密鑰。它兼容Claude Code、Codex、Gemini等多種CLI代理,並提供5美元免費額度。
在 OpenAI 推翻 Erdős 單位距離猜想後不久,Anthropic 展示了 Claude Mythos 也能解決這一問題——且是在“週末內”。工程師 Sholto Douglas 稱 Mythos 用一個“可愛、簡單的證明”破解了 1946 年的猜想,這標誌着 AI 驅動數學發現存在“嚴重過剩”現象。
Mina 是一款AI會議助手,能夠在通話中響應並執行任務,提升團隊協作效率。