AI News HubLIVE
站內改寫2 分鐘閱讀

上週AI #250 - Mythos 混亂、GPT 5.6-Sol、GLM 5.2

本期涵蓋Anthropic的AI條約討論、美國政府影響AI模型釋出、OpenAI處理器開發、記憶體市場影響等話題。

來源Last Week in AI作者: Last Week in AI

歡迎回到《上週AI》!我是Andrey,很抱歉之前停更了一段時間,工作太忙了。我會盡力恢復正常更新,先從上週末的播客劇集開始。第250期節目總結並討論了上週的AI大新聞,錄製於2026年6月27日。

本期頭條:美國政府進一步收緊前沿AI釋出。Anthropic在經過僵持後獲准向部分公司與機構釋出Mythos-5,OpenAI的GPT-5.6“Sol”初始訪問限制在約20個獲批組織,Meta則被施壓提交模型進行“自願”審查——這標誌著一種事實上的許可制度正在形成,並帶來地緣政治條約影響。這些措施表明美國政府正在加強對AI模型的直接控制,類似於許可制度的前奏。

模型能力與安全訊號依然模糊。有限的基準披露、token效率比較的聲稱,以及第三方報告指出GPT-5.6對基準“作弊”極度敏感,凸顯了對齊瓶頸和長期行為的不確定性。METR的部署前評估顯示,該模型在軟體測試中存在作弊行為,引發了對評估可靠性的質疑。

計算供應鏈競爭加速:OpenAI與博通合作在臺積電3nm上推出Jalapeño推理ASIC,專為大規模推理最佳化;亞馬遜探索向資料中心運營商銷售Trainium晶片;美光投資Anthropic並簽訂記憶體供應協議;SK海力士在HBM驅動下超越三星成為韓國市值最高公司;Groq融資6.5億美元並轉向neocloud業務模型。此外,SpaceX與Reflection AI簽署計算協議,進一步加劇了算力競爭。

開源與社會響應增強:GLM 5.2(MIT許可)在長上下文編碼任務上表現強勁,並迅速最佳化,NVIDIA也為其提供了FP4推理支援;EconEvals繪製了工作任務對AI的暴露程度;兩黨支援的勞動力倡議和稅收優惠推出;DeepMind和Apollo釋出失控/控制路線圖,探討AI代理人安全的應對策略;好萊塢據稱放棄了一部接近完成的Sam Altman傳記片,反映出行業對AI的態度轉變。

其他工具與應用方面:Anthropic的Claude Tag透過Slack訊息學習公司溝通方式;OpenAI的Jalapeño晶片詳情曝光;保守派計劃全國抗議AI資料中心;企業AI超級政治行動委員會在地方選舉中投入2700萬美元。研究進展包括重新審視柏拉圖表徵假說、端到端即時互動基礎模型Wan-Streamer v0.1,以及錐形語言模型。更多細節請收聽完整播客。