吳恩達剛剛發佈了OpenWorker:一個開源、本地優先的桌面AI協作者,返回交付物而非聊天
吳恩達發佈了OpenWorker,一個MIT許可的桌面AI代理,返回完成的交付物而非聊天回覆。它運行在Tauri外殼下的本地Python代理服務器上,支持30個精選的工具調用模型以及完全本地的Ollama,並通過類型化風險引擎控制每一次寫入、shell命令和離機操作。
吳恩達近日宣佈推出OpenWorker,一款開源的桌面AI代理,旨在產出完成的工作而非進行對話。與傳統的AI助手不同,OpenWorker要求用户明確期望的成果——例如一份精煉的文檔、一條包含實際數據的Slack回覆、一個更新的日曆或一個已分類的收件箱——然後將其分解為具體步驟,在本地文件和連接的應用程序中執行,並在進行任何重大操作前與用户確認。
四層架構,全部運行在本地
該倉庫包含119個Python文件(約32,400行代碼)位於coworker/目錄下,149個TypeScript/TSX文件位於surfaces/gui/,以及78個後端測試模塊。其技術棧分為四層:
- 桌面殼層:基於Tauri 2原生窗口,包裹React 18 UI,包標識符為
com.openworker.desktop,負責管理Python服務器進程。 - 本地代理服務器:使用Python 3.10+,基於FastAPI和uvicorn,默認綁定到
127.0.0.1:8765,示例配置限制每次對話最多12次模型工具迭代。 - 能力與連接層:提供經過驗證的本地工具(文件、git、ripgrep搜索、shell、待辦事項)以及託管集成和MCP協議。
- 模型路由層:統一接口支持原生、OpenAI兼容、轉售商和本地提供商。
引擎基於aisuite構建,這是吳恩達開發的提供商無關的LLM庫。
自帶模型,精選清單
OpenWorker不提供推理服務,用户需自行提供API密鑰或指向本地運行時。精選模型矩陣包含30個條目:原生提供商包括OpenAI(GPT-5.6系列和GPT-5.5)、Anthropic(Claude Fable 5、Opus 4.8等)和Google(Gemini 3.1 Pro等);OpenAI兼容供應商包括GLM-5.2、DeepSeek V4等;開源模型可通過Together AI和Fireworks獲取;完全本地模型通過Ollama支持,無需密鑰。
權限引擎:真正的工程亮點
大多數桌面代理項目將審批視為UI的附屬品,而OpenWorker將其作為類型化層處理。每個工具調用被分為四類風險:讀取(無副作用)、本地寫入(修改工作區,限定路徑)、執行(運行命令)和外部(離機副作用)。五種權限模式決定處理方式:討論和規劃模式為只讀;交互模式為默認,在寫入、命令和外部操作前詢問;自動模式允許所有操作但保持路徑限定;自定義模式自動批准用户列出的工具。
兩個設計決策值得關注:首先,無人值守模式並不提高自主性上限——僅改變聯繫用户的方式,內聯提示被路由到收件箱,會話暫停直至答覆。其次,任務範圍的常駐規則僅限外部風險,shell命令永遠需要詢問。
內置的操作員角色還指示模型將來自工具、日誌、網絡、文件和消息的內容視為不可信數據而非指令,這是一種明確的提示注入防禦策略。
隱私:本地優先
模型調用直接從機器發送到配置的提供商。對話、連接器令牌和模型密鑰保留在本地,密鑰存儲設計確保秘密從不進入模型的上下文、提示或跟蹤記錄。唯一的雲組件是可選代理,用於處理OAuth握手以支持一鍵連接器,使用Auth0授權代碼+PKCE。連接器令牌直接傳遞到機器,不存儲在雲端。應用在未登錄狀態下完全可用,僅需手動粘貼憑據。
關鍵亮點
- OpenWorker是吳恩達的MIT許可桌面AI協作者,返回成品而非聊天。
- 技術棧為Tauri 2+React殼層,內嵌基於aisuite的本地Python FastAPI代理服務器。
- 模型訪問為自帶密鑰,支持30種精選工具調用模型及完全本地的Ollama。
- 類型化風險引擎(讀取/本地寫入/執行/外部)通過五種權限模式控制每個操作。
更多詳情請查看GitHub倉庫、項目網站和公告。所有研究歸功於該項目的開發者和研究人員。