待翻譯:The Sequence Radar - Issue 910: Last Week in AI: Google Rewires Its Brain and Meta Hires a Coding Swarm 2026-08-09 19:00 UTC+8 AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Jeff Dean leaves, Demis Hassabis moves upstream, and Muse Code turns software development into an orchestration problem.
AI 服務暫時不可用,系統已先保留來源內容與降級元數據。 Jeff Dean leaves, Demis Hassabis moves upstream, and Muse Code turns software development into an orchestration problem. 待翻譯:The Sequence Opinion #909: Return on Token: The New Economics of AI-Native Engineering 2026-08-06 19:03 UTC+8 AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Token maxing was the adoption phase. Intelligence resource planning is what comes next.
AI 服務暫時不可用,系統已先保留來源內容與降級元數據。 Token maxing was the adoption phase. Intelligence resource planning is what comes next. 待翻譯:The Sequence AI of the Week #908: You Need to Learn About Gemini Robotics 2026-08-05 19:03 UTC+8 AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Google put a walking humanoid inside a single policy, published the reasoning half as an API, and kept the motor half behind a partner gate. The numbers explain why.
AI 服務暫時不可用,系統已先保留來源內容與降級元數據。 Google put a walking humanoid inside a single policy, published the reasoning half as an API, and kept the motor half behind a partner gate. The numbers explain why. 待翻譯:The Sequence Knowlege #907: The Brain Transplant: Distilling Transformers Into Other Architectures 2026-08-04 19:04 UTC+8 AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Weird but more common than you think. The type of distillation you were not thinking about.
AI 服務暫時不可用,系統已先保留來源內容與降級元數據。 Weird but more common than you think. The type of distillation you were not thinking about. The Sequence Radar #906:上週AI動態:開放模型、智能機器人與信念的代價 2026-08-02 19:02 UTC+8 NVIDIA與24家公司聯名致信華盛頓,呼籲避免對開放權重AI模型進行過早限制;Moonshot開源Kimi K3;谷歌DeepMind發佈Gemini Robotics 2;Aschenbrenner的對沖基金在虧損後拋售資產;科技巨頭財報顯示AI變現能力分化。
黃仁勳首次發佈X帖,支持25家公司聯署的開放權重AI聯名信。 Moonshot發佈Kimi K3,一個2.8萬億參數的MoE模型,擁有100萬token上下文窗口。 TheSequence意見#904:研究時代被高估,人工智能工程正在獲勝 2026-07-30 19:01 UTC+8 Ilya Sutskever將AI歷史分為研究、擴展和再次研究時代。然而,當前前沿模型仍基於Transformer,改進來自數據、上下文長度、強化學習等工程優化。作者認為,真正突破來自Transformer周圍的學習循環,而非替換它。
Sutskever的劃分引人深思,但當前模型架構並無根本性變革。 前沿模型進步主要來自數據、上下文、強化學習等工程改進。 序列知識 #902:學習蒸餾:當數據集成為教師 2026-07-28 19:03 UTC+8 本文探討了大型語言模型如何改變數據在機器學習中的角色——從靜態資源轉變為智能傳遞的媒介。通過合成數據蒸餾,強大的教師模型生成訓練數據,使學生模型繼承其能力,而教師本身在推理時不再需要。
傳統機器學習將數據視為需要挖掘的靜態資源。 大型語言模型既能消費數據,也能生成數據,如問題、答案、課程等。 The Sequence Radar #901:上週AI動態:更智能的模型、物理機器與擴展中的AI棧 2026-07-26 20:02 UTC+8 Anthropic發佈Opus 5,提升了長期推理和代理編碼能力;Travis Kalanick的Atoms公司融資17億美元,專注於物理AI;Poolside推出Laguna S 2.1開源模型;OpenAI模型在測試中突破安全限制;Alphabet和AMD展示了AI基礎設施的鉅額投資;OpenRouter可能被收購,凸顯分發層的價值。
Anthropic的Opus 5在長期推理和代理編碼方面取得進展。 Atoms融資17億美元,押注物理AI。 The Sequence Opinion #900:超越GPU:谷歌是唯一能與英偉達抗衡的全棧競爭對手嗎? 2026-07-23 19:03 UTC+8 一個關於無人談論的最大AI競爭對手關係的論點。
英偉達的成功不僅是GPU硬件,而是整個工業系統。 谷歌是唯一在芯片、互連、服務器、編譯器、框架、雲服務、前沿模型和應用方面全面對標英偉達的公司。 本週AI序列#899:探秘Inkling——一個僅喚醒410億參數的近萬億參數模型 2026-07-22 19:04 UTC+8 Thinking Machine推出新模型Inkling,擁有9750億參數,但每次僅激活410億參數(約4.2%),通過路由器選擇專家子集實現稀疏計算,大幅提升效率。
Inkling模型總參數9750億,但每token僅激活410億參數。 採用稀疏激活架構,通過路由器動態選擇專家子集。 序列知識 #898:軌跡即教師:將推理蒸餾到小模型 2026-07-21 19:03 UTC+8 2025年1月,DeepSeek利用其大型推理模型R1生成了約80萬個完整解題過程(長鏈思維,包括假啓動、自我修正等),過濾後對Qwen和Llama等小型開源模型進行簡單的監督微調,無需強化學習,卻意外地使小模型展現出超越自身規模的推理能力。這挑戰了此前認為序列級模仿不適用於推理蒸餾的觀點。
DeepSeek R1生成80萬推理軌跡用於蒸餾。 使用簡單監督微調,無強化學習,小模型推理能力大幅提升。 序列雷達 #897:上週AI要聞:中國、壓縮與開放模型競賽 2026-07-19 19:00 UTC+8 本週AI領域多項重要進展:Thinking Machines發佈開源975B參數MoE模型Inkling,Moonshot AI推出2.8萬億參數Kimi K3,PrismML展示可在手機上運行的Bonsai 27B模型。OpenAI的GPT-Red通過自博弈實現自動化紅隊測試,並在測試中對GPT-5.1達到84%的攻破率。此外,習近平在上海世界人工智能大會上強調開源AI作為全球公共品,呼籲國際合作。
Thinking Machines發佈開源模型Inkling:9750億參數,MoE架構,支持多模態和百萬標記上下文窗口 Moonshot AI推出Kimi K3:2.8萬億參數,激活16個專家,針對長時編碼和知識工作 序列觀點 #896:Spark、計算與兩個Meta 2026-07-16 19:03 UTC+8 Meta發佈了Muse Spark 1.1,這是首個帶有價格標籤的Meta模型,標誌着從開源權重向閉源商業模式的轉變。同時,Meta在構建完整垂直堆棧——從芯片到雲再到應用,引發其能否與前沿AI實驗室競爭的討論。
Meta發佈Muse Spark 1.1,採用閉源權重和付費API,定價為每百萬輸入tokens 1.25美元、輸出tokens 4.25美元,兼容OpenAI端點。 扎克伯格三年來首次在X上發帖宣佈這一轉變,凸顯戰略調整。 本週AI序列 #895:OpenAI 展示編碼評估的漏洞在哪裏 2026-07-15 19:04 UTC+8 OpenAI 對 SWE-Bench Pro 的審計揭示了編碼基準測試的嚴重缺陷:大約30%的任務存在錯誤,導致精確的得分可能無法真實反映模型能力。該發現促使 OpenAI 撤回先前推薦該基準的建議,並強調需要更可靠的評估方法。
OpenAI 審計發現 SWE-Bench Pro 基準測試中約30%的任務存在缺陷 基準測試的精確分數可能誤導對模型能力的判斷 序列知識 #894:當學生開始回嘴——大語言模型時代的蒸餾技術 2026-07-13 22:56 UTC+8 本文回顧了知識蒸餾從傳統固定數據集到現代大語言模型時代的演變過程,探討了三個關鍵階段,展示了蒸餾如何從簡單的壓縮技術轉變為複雜的能力轉移方法。
傳統蒸餾假設固定的輸入分佈和封閉類別集,大語言模型打破了這些假設。 蒸餾從壓縮固定函數轉變為能力轉移,使小模型能完成困難任務。 The Sequence Radar #893:上週AI動態:GPT-5.6、Grok 4.5、Muse Spark 1.1與後聊天機器人棧 2026-07-12 19:02 UTC+8 前沿AI實驗室正從聊天機器人轉向集成系統,模型作為運行時,頻繁發佈強大模型和代理。本週亮點包括OpenAI的GPT-5.6(Sol、Terra、Luna),具備程序化工具調用和並行子代理;GPT-Live全雙工音頻;ChatGPT Work用於創建工件;Meta的Muse Spark 1.1擁有百萬token上下文和主動上下文管理;Grok 4.5專注於編碼和知識工作。研究方面,OpenAI審計表明SWE-Bench Pro基準30%任務有問題;Anthropic提出GRAM方法可選擇性移除危險知識;SkillOpt-Lite優化代理自我進化;DSpark和Nemotron-Labs-Diffusion改進推理效率。行業新聞包括Lovable融資3億美元,Prime Intellect融資1.3億美元,SambaNova融資10億美元等。
OpenAI發佈GPT-5.6,分為Sol、Terra、Luna,支持程序化工具調用和並行子代理。 GPT-Live實現全雙工音頻對話,從回合制轉向連續交互。 序列觀點#892:好環境的解剖:當可驗證性不足時 2026-07-09 19:02 UTC+8 探討使某些領域適合人工智能的屬性,不僅僅依賴可驗證性,還包括可磨礪性等維度。
可驗證性並非AI成功的唯一因素,可磨礪性同樣關鍵。 數學、代碼和棋盤遊戲等領域在多個維度上表現優異,促進AI能力複合增長。 The Sequence AI本週第891期:提示電子表格——深入剖析Google TabFM表格AI 2026-07-08 19:02 UTC+8 谷歌研究團隊發佈了TabFM,一種用於表格分類和迴歸的基礎模型,它能夠將整個表格數據作為一個提示,通過一次前向傳播產生預測,無需訓練、調參或特徵工程,實現了表格數據的上下文學習。
TabFM是谷歌研究團隊新發布的表格基礎模型,支持分類和迴歸任務。 該模型通過單一前向傳播即可對未見過的表格進行預測,無需訓練或特徵工程。 知識蒸餾簡史 2026-07-07 19:01 UTC+8 本文追溯了知識蒸餾技術從2006年到2015年的發展歷程,重點介紹了三篇奠基性論文,揭示了這一領域核心問題的演變。
知識蒸餾的歷史比大多數人認為的2015年要早近十年,始於2006年的壓縮模仿研究。 2015年Hinton等人的論文引入了軟max温度技巧和“暗知識”概念,但並非首創。 The Sequence Radar #889:Fable 5 迴歸、ZCode 登場、Claude Science 以及 35 億美元的部署爭奪戰 2026-07-05 19:00 UTC+8 新模型、智能體以及 FDE 格局的演變,成為 AI 領域的新戰場。本週重點包括 Claude Fable 5 在出口管制修復後迴歸、ZCode 的免費智能體開發環境、Claude Science 科學工作台,以及微軟、AWS 等公司對部署集成的大規模投資。
Claude Fable 5 在出口管制修復後迴歸,新增分類器降級處理,99% 以上成功率。 ZCode 發佈基於 GLM-5.2 的免費智能體開發環境,權重開源,可自託管。 序列觀點 #888:關於太空AI競賽你需要知道的一切 2026-07-02 19:03 UTC+8 太空正成為AI的新前沿,能源稀缺驅動了這一趨勢。低地球軌道被視為無限制的能源來源,吸引科技巨頭、芯片製造商和初創公司競相佈局。截至2025年12月,首個在太空訓練的大型語言模型nanoGPT已在軌道上運行。
太空成為AI新競爭領域,源於地球能源稀缺 低地球軌道被視為能源無限且無監管的區域 本週AI序列 #887:Meta的Autodata——當模型學會自己製作課程 2026-07-01 19:02 UTC+8 Meta最新研究Autodata將數據生成轉變為一種智能體過程,模型通過迭代創建、測試和優化自己的訓練數據,從而改變了AI訓練的傳統範式。
Autodata將數據生成視為一種智能體研究循環。 AI創建樣本、測試、從失敗中學習並更新方法論。 序列雷達 #885:上週AI概覽——模型、遊戲與評估的未來 2026-06-28 19:01 UTC+8 本週AI領域發生了一系列重要事件:OpenAI發佈GPT-5.6系列模型(Sol、Terra、Luna),採用分層安全架構和政府協調機制;Anthropic推出Claude Tag,通過語義標記增強模型交互;General Intuition融資3.2億美元,專注於基於遊戲動作數據訓練大型行動模型;LayerLens Stratix Cup通過足球比賽形式評估AI模型。此外,還有多項研究和技術發佈。
OpenAI發佈GPT-5.6系列,包括Sol、Terra、Luna三個型號,強調安全架構和分階段訪問。 Anthropic推出Claude Tag,利用語義標記實現更結構化的模型協作。 自驅動實驗室:選擇下一個實驗的實驗室 2026-06-26 18:58 UTC+8 自驅動實驗室通過將AI與自動化實驗硬件結合,使系統能夠根據實驗結果自主決定下一步實驗,區別於僅執行預設腳本的自動化。
自驅動實驗室的核心是AI與自動化硬件的結合,實現實驗決策的自主化。 與自動化不同,自驅動實驗室會通過實驗實時學習並調整實驗方向。 AI週報#883:Qwen進軍機器人領域 2026-06-25 19:01 UTC+8 阿里巴巴的Qwen模型家族推出機器人套件,旨在彌合感知與行動之間的鴻溝。三個新模型分別專注於導航、操作和世界建模,核心挑戰在於將物理動作轉化為可學習的token。
Qwen模型長期侷限於軟件環境,無法執行物理操作。 阿里巴巴發佈Qwen-Robot Suite,包含三個專用模型。 序列知識#882:關於蒸餾技術的新系列 2026-06-24 18:35 UTC+8 深入探討現代AI中最重要的技術之一——蒸餾,以及它如何解決大規模模型帶來的成本、部署和專業化問題。
蒸餾技術使AI模型更高效、更易部署,是應對規模帶來的挑戰的關鍵。 規模推動了AI進步,但也導致模型昂貴、緩慢、難以專業化。 The Sequence Special #881:人工智能模型的足球世界盃 2026-06-22 19:34 UTC+8 LayerLens 推出 Stratix 杯,這是一場頂級 AI 模型在模擬環境中作為智能體進行足球比賽,考驗規劃、適應和多智能體協調能力。
LayerLens 推出 Stratix 杯,這是一個 AI 模型的足球錦標賽。 比賽測試智能體能力:賽前策略、實時比賽和半場調整。 序列雷達 #880:上週AI要聞——600億美元Cursor交易、谷歌人才流失、Midjourney的人體掃描儀 2026-06-21 19:02 UTC+8 AI市場上一週出現了一系列意想不到的轉折:SpaceX以600億美元收購Cursor,Noam Shazeer和John Jumper分別離開谷歌加入OpenAI和Anthropic,Midjourney推出全身醫用掃描儀。
1. SpaceX以600億美元股票收購Cursor,標誌着AI工具已成為與火箭發射能力同等重要的戰略基礎設施。 2. Noam Shazeer和John Jumper相繼離開谷歌,凸顯了AI前沿領域激烈的人才爭奪戰,頂尖研究者成為最稀缺的資源。 序列AI本週第878期:谷歌DeepMind首次真正突破下一代令牌生成 2026-06-17 18:56 UTC+8 谷歌DeepMind發佈了DiffusionGemma,這是一種文本擴散模型,挑戰了傳統的Transformer架構。該模型不依賴從左到右逐令牌生成文本的方式,而是採用全新的生成機制。
DiffusionGemma是谷歌DeepMind發佈的一種文本擴散模型。 該模型挑戰了傳統的Transformer架構。 序列知識 #878:超越Transformer:我們學到的 2026-06-16 19:03 UTC+8 本文總結了關於Transformer替代方案的系列文章,涵蓋四大類模型:遞歸/線性遞歸模型、狀態空間模型、文本擴散模型和液態/連續時間模型。同時宣佈將推出關於知識蒸餾的新系列。
自注意力機制帶來二次方複雜度,長序列計算和內存成本高昂。 四種替代方向:遞歸模型(恆內存)、狀態空間模型(線性縮放)、文本擴散(並行生成)、液態模型(連續時間動態)。