跳到主要內容
AI News HubLIVE
站內改寫2 分鐘閱讀

推出 Grok 4.5 · Cursor

文章摘要

Cursor 與 SpaceXAI 聯合釋出 Grok 4.5,這是迄今為止最智慧的模型,不僅限於軟體工程,還能處理資料科學、金融、法律等領域的複雜任務。模型採用混合專家架構,結合 Cursor 使用者互動資料訓練,並透過強化學習解決困難問題。即日起在 Cursor 平臺可用,個人和團隊套餐包含大量使用額度,首周翻倍。

推出 Grok 4.5 · Cursor
回報錯誤

更正管道尚未開通,可先複製下方文章資訊留存。

查看更正說明
直接讀正文

今日,Cursor 與 SpaceXAI 聯合釋出了 Grok 4.5,這是迄今最為智慧的模型,也是首款不僅為軟體工程設計的模型。Grok 4.5 能夠處理需要創造性使用工具的複雜、長期任務,涵蓋軟體工程、資料科學、金融、法律以及計算機上的任何工作。

Grok 4.5 是一個混合專家模型,由 Cursor 和 SpaceXAI 聯合訓練。訓練資料包括數萬億 tokens 的 Cursor 資料,捕捉了使用者與程式碼庫及軟體工具的廣泛互動。這一資料集使模型能夠從現有軟體以及開發者與代理的互動中學習,理解開發者如何工作以及代理如何與環境互動。與之前的 Composer 2.5 模型專注於編碼不同,Grok 4.5 的訓練資料更加廣泛,包含了高質量的 STEM 任務、研究論文和其他知識工作,使其在多個領域具備熟練能力。

模型採用了強化學習,在軟體工程和更廣泛知識工作的現實環境中解決困難問題。這些環境教導模型如何調查問題、使用工具、從錯誤中恢復以及驗證結果。為了確保任務具有挑戰性,許多問題被設計成連前沿模型也難以解決。隨著模型進步,現有任務不再能提供新的學習經驗,因此需要不斷設計更困難的問題。Cursor 開發了一套分散式代理系統來大規模構建這些環境,工程師指定問題和驗證方式,大量代理協作構建、測試和最佳化環境。這一過程本可能需要數百名工程師數月時間,但透過使用前代模型加速了開發。

Grok 4.5 即日起在 Cursor 的桌面、網頁、iOS、CLI 和 SDK 上可用。個人和團隊計劃包含該模型的大量使用額度,首周使用量翻倍。基礎模型定價為 $2/M 輸入 tokens 和 $6/M 輸出 tokens,另有快速變體定價為 $4/M 輸入 tokens 和 $18/M 輸出 tokens。Composer 2.5 將繼續保留並得到支援,未來也會發布同尺寸的新模型。

值得注意的是,Grok 4.5 在 CursorBench 上的優勢部分源於早期 Cursor 程式碼庫被意外包含在訓練資料中,儘管確切影響尚不明確。未來模型已移除該資料,同時 Cursor 正在對 CursorBench 進行更大規模的更新。

展開要點與分析

文章情報

工程師進階

要點

  • Grok 4.5 是 Cursor 與 SpaceXAI 聯合訓練的混合專家模型,訓練資料包括數萬億 tokens 的 Cursor 使用者互動資料。
  • 模型在軟體工程、資料科學、金融、法律等多個領域具有強大能力,透過強化學習在現實環境中解決困難問題。
  • Grok 4.5 即日起在 Cursor 桌面、網頁、iOS、CLI 和 SDK 上可用,定價為 $2/M 輸入 tokens 和 $6/M 輸出 tokens,首周使用量翻倍。
  • 該模型在 CursorBench 上的優勢部分源於意外包含早期 Cursor 程式碼庫資料,但未來模型已移除該資料。

要點與分析由自動化流程生成,可能有誤,請結合原始來源核實。