我使用Anthropic的Claude AI工具完成截然不同的工作:如何在模型、Code和Cowork之間選擇
Anthropic的Claude系列包括聊天機器人、編碼代理和工作流程代理。Claude Code專注於軟體開發,Claude Cowork處理計算機任務。文章透過汽車類比解釋Haiku、Sonnet、Opus、Fable和Mythos等模型,並討論了代理作為力量倍增器的潛力以及監督和安全的重要性。
Anthropic目前是全球最有價值的AI公司,本月初在二級市場上的估值高達1.2萬億美元。該公司的產品今年一直佔據新聞頭條,尤其是在美國政府暫時禁止使用Anthropic的Fable模型之後,因為它太智慧、太危險了。但拋開炒作、興奮、誇張和金融瘋狂,Anthropic的產品中哪些是你我可能關心的?Claude.ai、Claude Code和Claude Cowork是什麼?Haiku、Sonnet、Opus、Fable和Mythos又是什麼?
本文深入探討這些問題,重點分析Claude.ai、Claude Code和Claude Cowork,同時將Haiku、Sonnet、Opus、Fable和Mythos納入視野。
汽車類比
有時,用汽車來類比會更容易理解。當你走進汽車經銷商,通常要做兩個選擇:選擇車輛型號——是轎車、SUV還是皮卡?它們各有優缺點,適合不同活動。第二個選擇是如何裝備——關鍵是發動機大小。我的道奇Challenger RT是一款肌肉車,從日常駕駛到競賽車型都有,差異主要在於發動機和懸掛。我的車搭載375馬力、5.7升Hemi V8發動機,足夠強大,甚至有一個我從未敢嘗試的賽道模式。但它遠不及6.2升機械增壓高輸出Hemi V8,後者讓Challenger Demon成為街頭合法怪物。但問題在於,我喜歡我的車有推背感和轟鳴聲,但不會去賽道。我開它去五金店和咖啡店,不用於通勤,甚至不算日常代步。
回到AI,Haiku、Sonnet、Opus、Fable和Mythos都是大語言模型,大致相當於不同的發動機排量。Fable和Mythos被禁就像賽車引擎,過於強大且昂貴。Opus如同我的375馬力V8,強大但不過分。Haiku和Sonnet則像小型V6發動機,不錯但不突出。
而Claude.ai、Claude Code和Claude Cowork則像不同的車型,用於不同用途。Claude.ai是聊天機器人,Claude Code和Claude Cowork是代理助手,負責代表你執行任務。它們更像是皮卡或廂式貨車,可以配備技能和外掛,如同工作車頂加裝梯子、內部裝有工具。
聊天機器人 vs. 代理
簡單來說,聊天機器人回答問題,代理則執行操作。2023年生成式AI剛興起時,我們只是向聊天機器人輸入提示和問題,AI基於龐大知識庫回答。但訓練資料有截止日期,導致資訊滯後。一年後,聊天機器人開始整合即時網路搜尋,技術上改變了AI的“思考”方式,因為它使用訓練資料和整個網路兩個資訊源。它們能進行對話、跨會話保留資訊、執行程式設計等任務,但僅限於給出可複製的程式碼塊。ChatGPT、Claude.ai和Gemini都是聊天機器人。而Anthropic和OpenAI都使用聊天機器人名稱後加焦點詞來指定代理工具:ChatGPT Work和ChatGPT Codex是代理,Claude Code和Claude Cowork是代理工具。
另一個類比:過去我們用手機通話時,有些朋友可以愉快聊天,有些則會在凌晨3點過來幫忙重新佈線以供電。聊天朋友屬於聊天機器人,幫忙的朋友屬於代理。聊天機器人談話,代理能執行跨多步的複雜任務。
Claude Code
Claude Code可能是最知名的編碼代理之一,大多數主要提供商現在都有自己的編碼工具。代理AI能夠規劃並執行一系列任務,在過程中決策、糾正方向,最終達成目標。與輸出程式碼塊不同,Claude Code和Codex會建立和修改目錄、檔案,執行檔案,檢查結果,觸發指令碼,生成影像,甚至編寫並執行自己的程式。它們令人驚歎但遠非完美,需要強力指導。我曾給Claude Code分配需要一年個人開發才能完成的複雜影像分析和轉換任務,但它仍會犯低階錯誤。我必須告訴它如何使用能力以及開發哪些能力。
儘管如此,在我的持續參與下,它們構建了大型複雜程式設計專案。我能夠從構思到完成,所需時間僅為自行編碼的一小部分。但請注意,我有經驗:前電腦科學教授,產品營銷總監和工程經理,懂得管理產品和工程師。這些管理技能直接適用於代理管理。
與Claude Code合作就像透過Slack與團隊成員溝通。我分配任務後,它便去工作。作為獨立開發者,能與Claude Code或Codex配對程式設計非常強大且解放。
Claude Cowork
Claude Code和Codex是編碼代理,主要工作流程和功能集針對程式設計專案。Anthropic和OpenAI還推出了生產力工作流代理,更側重於計算機使用,如組織檔案或建立簡報。Anthropic的是Claude Cowork,OpenAI的是ChatGPT Work。我的經典例子是用Cowork和Work按主題組織PDF資料夾。傳統工具能按日期和型別排序,但AI能確定分類並建立分類法。我使用它們重新命名檔案、確定資料夾分類、移動PDF。
工作流代理還可以(經許可)控制你的計算機、使用瀏覽器、執行程式、生成文件。這些工具源於編碼代理,為了完全能力,它們必須能建立資料夾、檔案、執行程式甚至控制計算機。後來,Anthropic和OpenAI注意到使用者開始用編碼代理執行非編碼任務,於是在2026年推出了更友好的工作環境。
另一個例子:我讓Claude Cowork從一週7000多封郵件中找出對我所寫文章主題有特定看法的郵件。這通常會花我半天多時間,我會變得煩躁。委託給AI後,我需要的資訊得到了,心情也好多了。
最近我發現,結合使用一個或多個編碼代理與工作流代理進行研究和分析特別強大,感覺就像一個團隊在工作。
房間中的大象
最後討論兩個“大象”:工作替代和安全。AI代理無疑在影響就業,也降低了輸出質量,導致網上、YouTube和亞馬遜上出現大量AI垃圾內容。但對於像我這樣的獨立從業者,它們是力量倍增器。我用AI增強我的工作,並不是因為我會僱傭程式設計師或助手,而是要麼自己花更長時間、勞損手腕,要麼根本不開始任務。
有報道稱AI編碼代理導致初級崗位減少,但同時創造了監督AI的新角色。獨立開發者利用它們快速完成專案,而大公司則用它們提高效率。最終,工作性質正在轉變,但人類監督仍必不可少。
安全方面,代理需要訪問你的計算機、檔案和網路,這帶來風險。Anthropic和OpenAI都實施了沙盒和安全措施,但仍有漏洞。代理可能不正確地修改檔案、洩露敏感資訊或執行危險命令。因此,永遠不要給予代理完全自由,要監控其操作,並限制其許可權。在我的工作中,我讓代理在隔離環境中執行,並仔細審查所有更改。
總之,Anthropic的Claude工具提供了從聊天到編碼到工作流的全面解決方案,但使用者必須理解它們的能力和侷限,從而安全有效地利用它們。