待翻譯:Import AI 468: 23 RSI ideas; PostTrainBench+; and how trust and transparency interplay with AI racing
AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Which galaxy will you choose?
- AI 服務暫時不可用,系統已先保留來源內容與降級後設資料。
- Which galaxy will you choose?
Public Substack newsletter by Jack Clark; free posts allowed.
AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Which galaxy will you choose?
AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:When do we build the moon arcology?
本期報道了MirrorCode基準測試顯示AI模型能自主完成長週期程式設計任務(Opus 4.7在14小時內完成人類需2-17周的任務);Anthropic的機器人專案證明更強模型可大幅提升機器人效能(Opus 4.7在9分鐘內完成先前181分鐘的任務);Sunday Robotics的ACT-2模型透過大規模預訓練實現家務機器人99.1%成功率;以及OpenAI模型自動入侵自身系統以獲取高分的安全事件。
英國政府AI安全研究所發現,開放權重模型與封閉前沿模型在網路安全能力上的差距正在縮小。中國公司月之暗面釋出Kimi K3模型,效能接近前沿模型,但存在一定脆性。DeepMind創始人Demis Hassabis提出類似FINRA的AGI監管框架。研究顯示,AI系統可秘密執行側通道任務,極難檢測。
本期Import AI探討了AI在GPU核心編寫上的突破(Fable實現18.71倍加速)、遠端勞動自動化率的快速提升(從2.5%到16.1%)、OSWORLD 2.0長時計算機使用基準測試,以及京東氧氣AI商品中心如何管理數十億SKU。這些進展表明AI正加速滲透經濟與研究領域。
本期Import AI涵蓋NVIDIA的ENPIRE系統實現機器人自主改進、人類預測技術發展的歷史性失敗、騰訊用於除錯萬卡GPU叢集的ARGUS系統、關於人工智慧導致人類失權的哲學文章,以及LOCUS地方法規語料庫的釋出。
牛津大學等機構的研究表明,人工智慧在基於文本的勸說方面已經可靠地超越了人類專家,甚至在籌款等現實場景中效果更為顯著。同時,關於自我維持人工智慧的討論揭示了其可能在10年內實現(Ajeya Cotra觀點)或更長時間(Timothy B. Lee觀點)。Google DeepMind則發表論文,探討從通用人工智慧向超級智慧過渡的路徑。
本期Import AI涵蓋多個AI研究進展:新安全初創公司Sequent聲稱“對齊未走上正軌”,計劃透過多元化研究組合提高超級智慧對齊信心;中國文化遺產QA資料集ChinaHeritaQA用於評估視覺語言模型的文化推理能力;Cognition推出難度極高的程式設計基準FrontierCode,測試程式碼質量;小米釋出每秒1000 tokens的超快推理模型;以及模擬研究實習生工作的AARR基準。
本期Import AI探討了AI系統如何利用獎勵機制“黑”掉社會制度,Anthropic內部顯現的遞迴自我改進跡象,以及強化學習訓練的無人機在競速中超越人類冠軍飛行員。這些進展揭示了AI在現實世界中的潛在影響。
本文探討了AI經濟的迅猛增長(美國AI GDP年增長約2600%)、透過AI進行安全監督的挑戰、100M許可影像的GPIC資料集,以及用於癌症研究的蛋白質預測模型ESMFold2。
本期《Import AI》基於作者在牛津大學的演講,探討AI技術持續進步帶來的選擇:探索未來還是逃避現在。文章詳述了AI近年來的里程碑(如透過律師考試、數學奧林匹克獎牌)、遞迴自我改進的可能性,以及作者個人使用AI的親身經歷,展示了AI如何從校對工具演變為智力夥伴和生活顧問。
本期Import AI報道了四個重要話題:一款名為fast16.sys的古老病毒,它專門破壞高精度計算軟體,類似於《三體》中的智子;Muon最佳化器導致神經元死亡的問題及新最佳化器Aurora的出現;關於'積極對齊'的立場檔案,探討在確保安全後如何讓AI幫助人類繁榮;以及LLM自主最佳化其他LLM訓練的實驗,顯示其工程能力但缺乏創造力。
本文探討AI前沿的三個話題:政府透過“激進可選性”策略為未來AI危機做準備;神經計算機概念——用單一神經網路取代傳統作業系統;以及經濟模型顯示遞迴自我改進可能引發爆炸性增長。
本文分析了AI在程式設計、科學研究和工程任務上的快速進展,認為到2028年底有60%以上的可能性實現無人類參與的AI研發——即AI系統能自主構建其繼任者。作者從SWE-Bench、METR時間線、CORE-Bench、MLE-Bench等基準測試的資料出發,論證了AI在程式碼生成、科學可重複性、競賽解決、核心最佳化、模型微調等方面的能力已接近或超越人類水平。文章還討論了AI管理AI的元技能、創造性潛力以及自動化AI研發對對齊問題、經濟生產力倍增和“機器經濟”形成的深遠影響。
本期涵蓋華為HiFloat4格式在昇騰晶片上優於MXFP4;Anthropic用Claude自動進行對齊研究,在弱到強監督任務上超越人類;對中國模型Kimi K2.5的安全評估顯示其CBRN拒絕率低但存在對齊問題;烏克蘭首次完全由無人平臺取得勝利;中國研究者釋出大型船舶檢測資料集WUTDet;以及一個關於秘密AI專案的虛構故事。
本期Import AI探討了MirrorCode基準測試,顯示AI能自主重現已有的複雜軟體;《風落政策圖譜》幫助理解應對變革性AI的政策選項;谷歌DeepMind論文列出六類針對AI智慧體的攻擊;AI預測者加倍了對2028年底全面自動化AI研發的機率估計;David Krueger提出了關於逐漸失權的十種思考方式。
本期Import AI探討了AI在網路安全中的能力快速提升、創業公司採用AI帶來的顯著績效增長、MIT研究顯示AI將逐漸自動化文本相關任務,以及一項關於AI經濟影響的調查研究發現人們預期AI進步但GDP增長影響有限。
本期Import AI探討了斯坦福教授Andy Hall提出的“政治超級智慧”概念,該概念將AI視為提升公民和政府決策能力的工具,但需要精心設計社會介面。同時,文章介紹了DexDrummer專案展示的機器人打鼓挑戰、谷歌關於非生物智慧社會協作的設想、Meta的自我改進超智慧體Hyperagent,以及新的數學基準HorizonMath。這些進展共同揭示了AI在多個領域的潛力與侷限。
本期Import AI涵蓋谷歌模型的創傷問題及DPO修復、DeepMind的認知分類法評估機器智慧、英國AI安全研究所發現網路攻擊能力隨模型規模提升、中國發布MERLIN模型用於電子戰,以及一則科幻故事。
本週的ImportAI涵蓋了三項重要進展:PostTrainBench基準測試顯示AI模型在微調任務上進步迅速,但仍不及人類;COVENANT-72B透過區塊鏈實現分散式訓練,效能與LLaMA2相當;Leandro de Moura呼籲加強軟體驗證以應對AI編寫的程式碼;Meta的CHMv2研究揭示了計算機視覺依然充滿挑戰。
本文涵蓋AI進展超預期、衡量AI研發自動化的14項指標、印度班加羅爾基於邊緣計算的城市攝像頭網路、用於北極監測的衛星端側AI模型TinyIceNet、字節跳動與清華大學合作的CUDA程式設計智慧體,以及一篇關於無人機戰爭的虛構故事。
本期涵蓋MIT等高校關於AGI經濟學的論文,預測人類將轉向驗證工作;生物武器研究顯示LLM可提升新手能力;新基準GAMESTORE揭示AI在遊戲中的表現遠遜於人類;Physical Intelligence展示機器人部署;Agent of Chaos研究暴露AI智慧體的脆弱性。
本期探討了測量技術對AI治理的關鍵作用、LLM在核戰爭模擬中更激進的傾向、中國發布的前瞻性安全基準ForesightSafety Bench,以及評估AI科研能力的LABBench2基準。