跳到主要內容
AI News HubLIVE
站內改寫1 分鐘閱讀

推出 Grok 4.5 · Cursor

文章摘要

Cursor 與 SpaceXAI 聯合發佈 Grok 4.5,這是迄今為止最智能的模型,不僅限於軟件工程,還能處理數據科學、金融、法律等領域的複雜任務。模型採用混合專家架構,結合 Cursor 用户交互數據訓練,並通過強化學習解決困難問題。即日起在 Cursor 平台可用,個人和團隊套餐包含大量使用額度,首周翻倍。

推出 Grok 4.5 · Cursor
報告錯誤

更正渠道尚未開通,可先複製下方文章資訊留存。

查看更正說明
直接讀正文

今日,Cursor 與 SpaceXAI 聯合發佈了 Grok 4.5,這是迄今最為智能的模型,也是首款不僅為軟件工程設計的模型。Grok 4.5 能夠處理需要創造性使用工具的複雜、長期任務,涵蓋軟件工程、數據科學、金融、法律以及計算機上的任何工作。

Grok 4.5 是一個混合專家模型,由 Cursor 和 SpaceXAI 聯合訓練。訓練數據包括數萬億 tokens 的 Cursor 數據,捕捉了用户與代碼庫及軟件工具的廣泛交互。這一數據集使模型能夠從現有軟件以及開發者與代理的交互中學習,理解開發者如何工作以及代理如何與環境互動。與之前的 Composer 2.5 模型專注於編碼不同,Grok 4.5 的訓練數據更加廣泛,包含了高質量的 STEM 任務、研究論文和其他知識工作,使其在多個領域具備熟練能力。

模型採用了強化學習,在軟件工程和更廣泛知識工作的現實環境中解決困難問題。這些環境教導模型如何調查問題、使用工具、從錯誤中恢復以及驗證結果。為了確保任務具有挑戰性,許多問題被設計成連前沿模型也難以解決。隨着模型進步,現有任務不再能提供新的學習經驗,因此需要不斷設計更困難的問題。Cursor 開發了一套分佈式代理系統來大規模構建這些環境,工程師指定問題和驗證方式,大量代理協作構建、測試和優化環境。這一過程本可能需要數百名工程師數月時間,但通過使用前代模型加速了開發。

Grok 4.5 即日起在 Cursor 的桌面、網頁、iOS、CLI 和 SDK 上可用。個人和團隊計劃包含該模型的大量使用額度,首周使用量翻倍。基礎模型定價為 $2/M 輸入 tokens 和 $6/M 輸出 tokens,另有快速變體定價為 $4/M 輸入 tokens 和 $18/M 輸出 tokens。Composer 2.5 將繼續保留並得到支持,未來也會發布同尺寸的新模型。

值得注意的是,Grok 4.5 在 CursorBench 上的優勢部分源於早期 Cursor 代碼庫被意外包含在訓練數據中,儘管確切影響尚不明確。未來模型已移除該數據,同時 Cursor 正在對 CursorBench 進行更大規模的更新。

展開要點與分析

文章情報

工程師進階

要點

  • Grok 4.5 是 Cursor 與 SpaceXAI 聯合訓練的混合專家模型,訓練數據包括數萬億 tokens 的 Cursor 用户交互數據。
  • 模型在軟件工程、數據科學、金融、法律等多個領域具有強大能力,通過強化學習在現實環境中解決困難問題。
  • Grok 4.5 即日起在 Cursor 桌面、網頁、iOS、CLI 和 SDK 上可用,定價為 $2/M 輸入 tokens 和 $6/M 輸出 tokens,首周使用量翻倍。
  • 該模型在 CursorBench 上的優勢部分源於意外包含早期 Cursor 代碼庫數據,但未來模型已移除該數據。

要點與分析由自動化流程生成,可能有誤,請結合原始來源核實。