LWiAI播客 #252 - GPT 5.6、Grok 4.5、Nemotron-Labs-Diffusion、AI 2040
OpenAI 推出了 GPT-5.6 並重塑 ChatGPT Work;SpaceX AI 發佈超低成本編碼模型 Grok 4.5;Meta 推出 Muse Spark 1.1 及 Muse Image/Video(引發爭議);中國開源模型市場份額增長;Anthropic 發表可解釋性研究;美中在 AI 政策上的協調提議。
LWiAI 播客第252集回顧了2026年7月11日當週AI領域的重大新聞。主持人 Andrey Kurenkov 和 Jeremie Harris 在節目開頭為播客的暫停致歉,並承諾恢復定期更新。
首先,OpenAI 正式發佈了 GPT-5.6,包含 Sol 和 Luna 兩個版本,同時將桌面代理編碼產品重新品牌化為 ChatGPT Work。然而,有爭議稱美國政府實際上既批准又延遲了該模型的發佈,引發了關於前沿模型監管不一致和可越獄性的擔憂。此外,OpenAI 還關閉了其 Atlas 網頁瀏覽器,並面臨英國機構指出其新模型存在類似導致 Anthropic 的 Fable 受到出口管制的網絡安全漏洞。
模型競爭方面,SpaceX AI 推出了 Grok 4.5,定價極低,據稱達到 Opus 級別的編碼能力,但安全文檔極少。該模型主要面向金融和法律應用,並與 Cursor 合作推出。Meta 則發佈了 Muse Spark 1.1,以激進定價進入市場,在編碼和網絡基準測試中取得大幅提升,並附有詳細的安全評估。此外,Meta 預覽了 Muse Video 並迅速推出 Muse Image,但因用户可輕易生成 Instagram 公開賬户的圖片而招致批評,隨後撤回。與此同時,中國開源模型在 OpenRouter 上的每週令牌使用份額增長至超過 30%,凸顯了成本壓力以及潛在內部威脅等風險。
基礎設施與政策方面,Meta 考慮將 AI 計算能力作為雲業務出售;美國能源監管機構要求電網運營商應對大型數據中心接入問題,PJM 電網運營商下令採取緊急措施以避免大規模停電;Anthropic 發表了“全局工作空間”方法,用於將語言模型中的內部表徵轉化為可描述的形式;有報道稱中國可能限制頂級模型的海外訪問;最後,AI 2040 提議美中兩國協調放緩進展,直到 AI 對齊得到改善。該提案由前 OpenAI 員工提出,旨在提供一條更為樂觀的路徑。
此外,本期還介紹了 Nemotron-Labs-Diffusion 項目(一種三模式語言模型,統一了自迴歸、擴散和自推測解碼)以及騰訊發佈的 Hy3 開源模型(295B 參數 MoE,21B 活躍參數,支持 256K 上下文)。時間戳顯示節目涵蓋了工具應用、商業項目、開源和政策安全等多個板塊。