AI News HubLIVE

AI 新聞即時情報

即時監測

今日 AI 世界最重要的變化

來自 105 個可信來源,最近更新 2026-06-02 16:29 UTC+8。

即時監測

即時更新

即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。

即時更新

重設
OpenAIRE AI 黑客馬拉松

OpenAIRE 與 Alien Intelligence 聯合推出為期12周的開放科學黑客馬拉松,聚焦AI技術,設有四個賽道(包括無需編程的賽道),獎品包括AI積分、推廣機會、案例研究、演講席位,以及500歐元大獎和差旅補助。

Hacker News AI研究站內正文
OpenAI模型現已在亞馬遜雲服務上可用

OpenAI通過亞馬遜Bedrock提供GPT-5.5、GPT-5.4和Codex模型,價格與OpenAI自有平台相同,使用量計入現有AWS合同,目前僅限美國區域。

The Decoder模型站內正文
AI解決80年難題,令數學家震驚

OpenAI的AI模型找到了保羅·埃爾德什1946年提出的平面單位距離問題的一個反例,表明網格狀佈局並非最優。該結果由AI自主產生,隨後由數學家Will Sawin改進。這標誌着AI在數學研究中的作用日益增強。

AIhub研究 / 機械人站內正文
Alphabet計劃通過股票銷售籌集800億美元用於AI支出熱潮——商業直播

Alphabet宣佈計劃通過股票銷售籌集高達800億美元,用於擴建AI基礎設施,其中包括向伯克希爾·哈撒韋出售100億美元股票。此舉是史上最大規模股權融資之一,標誌着AI投資進入資本密集新階段。同時,Anthropic秘密提交美國IPO申請,估值達9650億美元。

The Guardian AI創業融資站內正文
為什麼金融機構正在匯聚於交易基礎模型以構建自身智能

金融機構長期依賴碎片化的AI模型(如欺詐檢測、信貸評估等),但這些模型受限於孤立系統,無法形成統一的消費者金融行為理解。NVIDIA報告顯示65%的機構已採用AI,但模型複雜度成為瓶頸。領先企業正轉向基於Transformer的交易基礎模型,通過統一表示學習提升跨任務性能,如Revolut的PRAGMA模型在信貸、欺詐等領域超越專門模型。NVIDIA推出“構建自有交易基礎模型”開發者示例,助力機構利用專有數據開發智能。

NVIDIA Blog模型 / Agent / 芯片站內正文
關於AI與真相的書竟包含人工智能生成的虛假引用

史蒂文·羅森鮑姆的《真相的未來》因包含多個由AI生成的虛假或錯誤歸屬的引用而陷入醜聞,書中引用了卡拉·斯威舍、麗莎·費爾德曼·巴雷特等人的不實言論,作者承認使用ChatGPT和Claude,承諾修正但表示將繼續使用AI。此事件凸顯了非虛構寫作中依賴AI而不加驗證的風險。

Hacker News AIAgent / 研究站內正文
面向開發者的AI工程實踐指南

本文為有經驗的軟件工程師提供AI工程化指南,涵蓋基礎模型、應用層開發、模型適配、規劃與維護,並強調成本與評估的重要性。

Hacker News AIAgent / 芯片站內正文
週二簡報:Palantir的崛起——以及為何很多人反對其在英國政府中的角色

美國數據分析公司Palantir自疫情以來迅速擴張,其AI軟件被用於NHS患者記錄分析及美軍目標鎖定,公司市值達3750億美元。但其引發的爭議和批評導致人們質疑其權力過大。簡報還涵蓋彼得·曼德爾森安全審查、烏克蘭空襲、英國綠色經濟、特朗普基金計劃及郵局醜聞補償等新聞。

The Guardian AI研究站內正文
我們構建了自己的雲代理基礎設施

Harvey在過去一年從聊天產品轉向雲代理,以實現端到端的法律任務。由於現有託管運行時無法滿足多模型、零數據保留和成本控制的要求,Harvey自建了代理基礎設施。文章詳細闡述了這三個關鍵需求及其對法律行業的重要性。

Hacker News AIAgent / 政策站內正文
架構即政策:將治理編譯到AI堆棧中

本文介紹了Riddhi Mohan Sharma如何通過三層自動化治理框架,將性能指標視為物理定律,並使用AI代理進行主動修復,從而在其個人網站上實現“道德超高速”的架構理念。該框架包括結構護欄、代理修復循環和集成工作流,確保每次部署都符合嚴格的性能標準。

Hacker News AIAgent / 政策站內正文
你能靠AI垃圾內容快速致富嗎?

本文探討了通過AI生成的‘垃圾內容’(slop)在社交媒體上快速獲利的現象。以Tung Tung Tung Sahur等角色為例,展示了內容創作者如何利用AI工具批量生產低質但吸睛的視頻,通過廣告網絡聯盟(Affiliate Network)賺取收入。文章採訪了多位創作者和平台創始人,揭示了AI slop產業的運作模式、倫理爭議以及巨大流量背後的經濟邏輯。

Hacker News AI研究站內正文
Anthropic 擴大對 Claude Mythos AI 模型的公開訪問

Anthropic 宣佈將通過 Project Glasswing 擴大對 Claude Mythos 模型的訪問,預計在 6-12 個月內實現廣泛可用。該模型能發現漏洞並生成利用鏈,但目前僅限合作伙伴使用。

Hacker News AI模型 / Agent / 政策站內正文
通過篩選AI模型找到最佳模型的應用程序

開發者在眾多AI模型中難以選擇,而WhichLLMModel應用允許用户根據推理能力、速度和成本等優先級,對頂級模型進行排名和比較,以找到最適合其應用需求的模型。

Hacker News AI模型 / 研究站內正文
ShadowProtect:AI 代理的 Wireshark

ShadowProtect 是一款專為 AI 代理設計的網絡分析工具,類似於 Wireshark 對傳統網絡的作用,幫助開發者監控、調試和優化代理行為。

Hacker News AIAgent站內正文
Mellum2 開源:適用於 AI 工作流的快速模型

JetBrains 開源了 Mellum2,一個 12B 參數的 MoE 模型,專為快速、高效的 AI 工作流設計,用於路由、問答、子代理等。由於採用 MoE 架構,每 token 僅激活 2.5B 參數,降低了推理成本和延遲。

Hacker News AIAgent / 研究站內正文
粘貼文件編輯器

西蒙·威利森開發了一款原型工具,可將大量文本粘貼自動轉換為文件附件,支持直接打開文件、拖拽上傳,靈感來自Claude的粘貼檢測功能。

Simon Willison's Weblog工具站內正文
RocketSmith:用於高功率火箭設計與製造的代理系統

一種名為RocketSmith的新型代理系統能夠自動化高功率火箭的設計、製造與優化流程,通過子代理和技能實現飛行參數的迭代優化。四枚火箭採用FDM打印機制造並進行了飛行測試,全部穩定發射,兩枚成功回收。飛行仿真與實際數據對比顯示遠地點預測準確率達84%。

arXiv RoboticsAgent / 研究 / 機械人站內正文
物理AI中的靜默故障:自主系統運行時動作授權的文獻綜述

本文綜述了物理AI系統中新興的安全問題——'靜默故障',即黑盒模型看似自信且語義對齊,但產生物理上無效的動作。文章提出了有界問題形式化,定義了靜默物理動作失敗,並給出了運行時護欄功能的分類法。

arXiv Robotics模型 / 政策 / 研究站內正文
預測動力學能在物理世界中存在嗎?

本文提出物理可接受性作為預測控制接口,通過在執行前評估預測動力學是否滿足運動學、動力學和直接到組合水平條件,來驗證物理可執行性。實驗表明,完整門控在Hugging Face LeRobot PushT數據集上達到0.957的AUC,並有效阻止87-89%的無效提議。

arXiv Robotics研究 / 機械人站內正文
基於圖擴散的全身逆運動學

GraphDiff-IK提出了一種結構感知的圖擴散逆運動學框架,能夠在多種機器人形態下準確、穩定地生成關節配置,並支持多解輸出。

arXiv Robotics模型 / 研究 / 機械人站內正文
平衡精度與效率:用於模型預測控制的自適應動力學編排

提出自適應動力學編排(ADO)框架,用於自動駕駛導航中的模型預測控制。ADO動態選擇最適合當前導航上下文的動力學模型,通過在線反事實推演優化模型選擇,從而在保持低延遲的同時接近高保真模型的精度。野外實驗驗證了其在複雜地形中的有效性。

arXiv Robotics政策 / 研究站內正文
非線性粘性流體中的線性運動映射

研究表明,在低雷諾數流體中,線性運動映射擴展到任何冪律粘度流體,而卡拉-安田流體的非線性特性允許通過往復運動實現淨位移,甚至可通過改變速度切換運動方向。

arXiv Robotics政策 / 研究站內正文
強化學習在機電系統參數辨識中的最優實驗設計

該論文提出一種強化學習代理,用於為機電系統的系統辨識生成最優激勵信號,並在Quanser Aero 2測試平台上驗證,實現了高估計精度且僅0.75%的安全違規。

arXiv RoboticsAgent / 政策 / 研究站內正文