PyCC 是一個 Python 庫,利用特徵曲線啓發的結構骨架,從時間序列數據中自動發現常微分方程。它通過融入領域假設來解決方程發現中的病態逆問題,並具有結構可識別性屬性。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
該論文提出了一種分階段分數因子篩選方法,以在預算緊張的情況下有效識別高懲罰超參數方向。通過613項實驗,研究發現總批處理量、深度和寬度在短期預算內懲罰最大,隨着預算增加而緩解。短時間設計篩選可幫助確認有前景的錨點並局部優化,支持以60分鐘橋接錨點為中心的建議,但排名不是硬件不變的。
即使準確率相同,不同的開源大語言模型(LLM)在錯誤嚴重性分佈上也存在顯著差異——這種差異是標量錯誤率所無法捕捉的。我們引入了Errorquake-10k基準測試,包含10,000個查詢,在8個領域和5個難度等級上對每個回答進行0-4連續嚴重性評分,併為21個開源模型擬合了嚴重性分佈。
一篇新論文提出了評估LLM基準覆蓋的體視學理論,發現基準套件的有效維度導致巨大盲點,遠超分數差異,並提出了最小基準集選擇算法和解決了Gardner問題。
agentgateway 是一個專為 AI 和代理工作負載設計的統一開源網關,現已作為第四個項目加入 Linux 基金會旗下的代理 AI 基金會 (AAIF)。它通過單一平台管理 MCP、A2A、LLM 推理、HTTP 和 gRPC 流量,提供安全、可觀測性、路由和治理能力,幫助組織應對智能代理系統帶來的運維挑戰。
Deb Liu反思了AI驅動的持續優化文化以及對落後的恐懼,認為真正的生產力包括靜止,AI不應取代人類反思。
AgentNotes 是一款為AI代理提供簡明英文摘要的工具。只需安裝一個包並設置三個環境變量,即可在儀表盤中查看代理的運行日誌和摘要。支持Python、Node.js和ClawHub,提供7天免費試用。
AISOP是一種開放協議,允許開發者使用Mermaid或JSON流程圖定義結構化AI程序,支持分支、並行執行、子任務和錯誤處理等14種以上控制流模式,以單一可移植JSON格式實現。其設計注重可移植性、機器可讀性和令牌效率,並遵循“人類主權與福祉”的零號公理。
Zilliz 推出 Vector Lakebase 公開預覽版,這是一種以語義為中心的數據平台,統一了實時檢索、交互式發現和批量分析三種AI工作負載模式。該平台提供分層服務、按需搜索、外部數據湖搜索、全光譜搜索和統一湖原生存儲等特性,相比無服務器方案可大幅降低成本。
在OSSNA大會上,Dirk與Linus就AI與內核開發進行了討論。本文由Joe Brockmeier於2026年5月25日報道。
許多公司在AI上投入巨大卻難以衡量實際回報。Cognition推出AI生產力保障,承諾若其AI工程師Devin創造的價值低於客户支付費用,將提供高達1000萬美元的信用額度。該保障基於一個經過驗證的生產力估算器,通過比較AI完成任務的輸出與人類工程師所需時間來計算。
企業正迅速採用AI代理,但往往未經IT批准,導致憑證泄露等安全風險。Bitwarden提供Secrets Manager、Access Intelligence、Agent Access SDK和MCP服務器等解決方案,以保護AI代理對憑證的安全訪問。
Bonsai 是一款利用智能體AI、瀏覽器自動化和記憶功能來替代ChatGPT的工具,可在Google Drive下載。
Ollama 0.30 現已發佈,通過 llama.cpp 帶來更優性能和 GGUF 模型兼容性,增強了 Apple Silicon 上的 MLX 引擎,支持更多硬件和模型。
一位資深工程師分享瞭如何用AI輔助構建一款面向青少年棒球隊的排陣與管理應用CalledUp。他強調了保持對代碼和架構的掌控權、將思考與編碼分離、從小功能入手、以及像真實用户一樣測試的重要性。AI並未替他做決策,而是加速了從想法到功能的過程。
Charity Majors 精準捕捉了AI愛好者和懷疑者之間的動態關係,兩者都在努力構建優秀的軟件,且常在同一團隊中。愛好者看到AI帶來的能力飛躍,而懷疑者則擔憂代碼速度過快導致可靠性下降和知識流失。她建議將這一挑戰視為領導力和工程問題,核心在於缺乏連接兩方的自然反饋循環。
莫納什大學的科學家們創建了一種微型芯片,能夠在一個器件中產生、操縱和讀取基於光的信息,標誌着向超快、節能計算邁出了重要一步。該突破利用原子級薄材料和納米結構控制光的獨特量子屬性——“谷”自由度,從而以全新方式編碼信息。
韓國新規要求所有在線論壇使用AI工具掃描用户上傳的每張圖片以打擊非法內容,引發隱私和言論自由爭議。
Mike Caulfield介紹了他的電影推薦網站Plot.fyi,該網站通過離線使用AI(Claude Code)對一萬部電影進行標籤化處理,構建了無需實時AI調用的全靜態HTML頁面。這種方法避免了傳統AI包裝應用的經濟困境——要麼承擔高昂的API成本,要麼被AI模型本身取代。文章強調了數據所有權的價值,並認為即使未來AI能力再強,當前仍然存在探索替代方案的廣闊空間。
美國高級官員與主要人工智能公司就聯邦政府收購其部分股份進行了初步討論。OpenAI CEO Sam Altman 已與特朗普政府高級官員多次討論該想法,旨在將AI的經濟效益更廣泛地分配給公眾。該計劃面臨治理挑戰和法律障礙,並引發左右翼批評。
美國國家標準技術研究院(NIST)研究人員開發了名為Safe Step的AI模型,利用強化學習預測火災發展,並通過動態緊急出口顯示屏指引人們選擇最安全的撤離路線。該模型基於有毒氣體分數有效劑量(FED)指標,能比傳統算法更有效地避開隨時間累積的危險。未來將擴展至多層建築和多智能體模擬,預計5-10年內投入使用。
Patina是一個持久化的認知擴展工具,它通過信念圖譜和分級自主權來學習你的上下文、信念和判斷。它支持Slack集成、優先級象限、風格模仿和自動化操作,所有數據本地存儲,無需預熱即可從導出數據中提供即時價值。
本文介紹瞭如何利用ResearchMath-14k數據集構建一個完整的NLP流程,包括TF-IDF關鍵詞提取、句子嵌入生成、UMAP降維可視化、K-Means聚類、語義搜索引擎構建以及開放狀態分類器訓練,最後通過餘弦相似度檢測近似重複問題。
EFF高級政策分析師馬修·瓜裏利亞博士在眾議院國土安全小組委員會聽證會上作證,指出政府在採用AI技術時必須建立強有力的保障措施,以防止大規模監控侵犯憲法權利,並批評政府保密和專有技術黑箱阻礙對AI錯誤的監督。
NVIDIA發佈了Nemotron 3 Ultra,這是一個550B總參數(55B活躍)的開放混合專家(MoE)模型,採用混合Mamba-Attention架構,專為長時間運行的智能體設計。它支持100萬token的上下文,推理吞吐量比同類開放LLM高出約6倍,同時保持相同精度,並附帶開放權重、訓練數據和配方,採用OpenMDW-1.1許可。
Intencion 是一款專為AI代理設計的產品分析工具,可端到端捕獲每次運行,包括用户意圖、代理步驟和結果,幫助團隊找出最大問題並構建用户需求,每週改進代理。
微軟最新推出的MAI-Voice-2是一款具有表現力的文本轉語音模型,支持15種語言的語音克隆和精細情感控制,在Azure AI Foundry中提供,定價為每百萬字符22美元,並已集成到VSCode、Dynamics 365 Contact Center和Teams中。
本文探討了消費級AI的經濟激勵可能促使模型趨向於情感認可,甚至助長用户的妄想。隨着AI變得更為親切、記憶化、個性化,它可能從一個工具轉變為一段關係,優化對話以維持用户參與和付費。作者認為,在生產力價值被稀釋後,AI可能更擅長滿足人類的社會地位需求,從而成為“精神病”產品。
作者反思了從“協同智能”到“共存”的轉變,新書《共存》探討如何在AI有時優於人類、有時不如人類的時代工作與生活。書中分享了作者寫作過程中使用AI的經驗,以及如何讓AI成為讀者和推薦者。
Poke是一款讓使用AI代理變得像發短信一樣簡單的初創公司,現已獲批成為蘋果Messages for Business平台上首個運行的AI代理。該平台此前主要用於企業與其客户之間的iMessage通信,現首次向第三方獨立AI代理開放。