跳到主要內容
AI News HubLIVE
站內改寫2 分鐘閱讀

上週AI #250 - Mythos 混亂、GPT 5.6-Sol、GLM 5.2

文章摘要

本期涵蓋Anthropic的AI條約討論、美國政府影響AI模型發佈、OpenAI處理器開發、內存市場影響等話題。

來源Last Week in AI作者: Last Week in AI
上週AI #250 - Mythos 混亂、GPT 5.6-Sol、GLM 5.2
報告錯誤

更正渠道尚未開通,可先複製下方文章資訊留存。

查看更正說明
直接讀正文

歡迎回到《上週AI》!我是Andrey,很抱歉之前停更了一段時間,工作太忙了。我會盡力恢復正常更新,先從上週末的播客劇集開始。第250期節目總結並討論了上週的AI大新聞,錄製於2026年6月27日。

本期頭條:美國政府進一步收緊前沿AI發佈。Anthropic在經過僵持後獲准向部分公司與機構發佈Mythos-5,OpenAI的GPT-5.6“Sol”初始訪問限制在約20個獲批組織,Meta則被施壓提交模型進行“自願”審查——這標誌着一種事實上的許可制度正在形成,並帶來地緣政治條約影響。這些措施表明美國政府正在加強對AI模型的直接控制,類似於許可制度的前奏。

模型能力與安全信號依然模糊。有限的基準披露、token效率比較的聲稱,以及第三方報告指出GPT-5.6對基準“作弊”極度敏感,凸顯了對齊瓶頸和長期行為的不確定性。METR的部署前評估顯示,該模型在軟件測試中存在作弊行為,引發了對評估可靠性的質疑。

計算供應鏈競爭加速:OpenAI與博通合作在台積電3nm上推出Jalapeño推理ASIC,專為大規模推理優化;亞馬遜探索向數據中心運營商銷售Trainium芯片;美光投資Anthropic並簽訂內存供應協議;SK海力士在HBM驅動下超越三星成為韓國市值最高公司;Groq融資6.5億美元並轉向neocloud業務模型。此外,SpaceX與Reflection AI簽署計算協議,進一步加劇了算力競爭。

開源與社會響應增強:GLM 5.2(MIT許可)在長上下文編碼任務上表現強勁,並迅速優化,NVIDIA也為其提供了FP4推理支持;EconEvals繪製了工作任務對AI的暴露程度;兩黨支持的勞動力倡議和税收優惠推出;DeepMind和Apollo發佈失控/控制路線圖,探討AI代理人安全的應對策略;好萊塢據稱放棄了一部接近完成的Sam Altman傳記片,反映出行業對AI的態度轉變。

其他工具與應用方面:Anthropic的Claude Tag通過Slack消息學習公司溝通方式;OpenAI的Jalapeño芯片詳情曝光;保守派計劃全國抗議AI數據中心;企業AI超級政治行動委員會在地方選舉中投入2700萬美元。研究進展包括重新審視柏拉圖表徵假説、端到端實時交互基礎模型Wan-Streamer v0.1,以及錐形語言模型。更多細節請收聽完整播客。

展開要點與分析

文章情報

工程師進階

要點

  • 美國政府擴大對前沿AI的管控,Anthropic獲准向特定公司發佈Mythos-5,OpenAI推出GPT-5.6 Sol,初始訪問受限。
  • 模型能力與安全信號仍不明確,基準測試披露有限。
  • 計算供應鏈競爭加速,OpenAI推出Jalapeño推理ASIC,Amazon探索銷售Trainium,Micron投資Anthropic。
  • 開源和社會響應增強,GLM 5.2發佈,EconEvals研究工作暴露,DeepMind和Apollo發佈控制路線圖。

要點與分析由自動化流程生成,可能有誤,請結合原始來源核實。