什麼是AI員工?
AI員工是一種擁有持久工作空間和工具集、能夠端到端完成分配任務的智慧代理,遠不止於簡單的聊天助手。Construct 作為一款工作作業系統,為AI員工提供檔案、記憶、日程和工作流等支援。
隨著人工智慧技術的發展,AI助手的形態正在從簡單的聊天視窗向更復雜的“AI員工”演進。傳統的AI助手通常只能在一問一答的聊天介面中工作,使用者提出一個問題,獲得一個答案,然後需要手動將結果應用到實際工作中。而AI員工則更進一步:它能夠接受一個成果目標,自主選擇工具,完成多步驟的工作,並將工作的檔案、上下文和中間結果持久儲存,供後續使用。
Construct 正是圍繞AI員工設計的工作作業系統。它將持久檔案、可檢查的記憶、日程安排、線性工作流、原生收件箱,以及網路研究、即時瀏覽器執行、沙箱終端和各類已連線應用整合在一個網頁桌面中,為AI員工提供了完整的工作環境。
四個階梯
“AI員工”這一概念需要明確它與底層工具的區別。一個有用的區分標準是:軟體能夠承擔多少工作,以及工作完成後能留下什麼。
- 聊天機器人:給出一個問題,返回一個答案,幾乎不留任何東西。
- 副駕駛:在文件上下文中提出內聯建議,宿主文件保留。
- 智慧體:接受任務和工具,完成一個任務,但永續性因產品而異。
- AI員工:接受一個成果,完成工作並留下檔案、記憶和流程。
每個階梯都比下一層增加了新的能力。副駕駛知道使用者所處的文件,而聊天機器人不知道;智慧體可以操作工具,而副駕駛大多隻能建議;AI員工則擁有一個工作空間,因此工作不會隨會話結束而消失。
在實際應用中,最關鍵的區別在於最後一列:工作結果是否持久存在。許多產品可以一次性執行任務,但只有極少數能留下一個工作空間,讓輸出、推理過程和步驟在下週依然可查。
聊天助手 vs AI員工
聊天助手的工作空間主要是對話,工作方式是回答問題或提供草稿,連續性依賴當前產品和執行緒,輸出通常是聊天文本。而AI員工(Construct)的工作空間包含檔案、記憶、工具、日程和工作流,工作方式是在瀏覽器、終端、檔案和應用程式中執行任務,具有持久的工作空間和可糾正的記憶,輸出可以是檔案、傳送的訊息、應用更新和執行歷史。
兩者的區別不僅在於智慧水平,更在於AI員工是否擁有一個持久的工作場所和執行任務所需的介面。
Construct 的日常用途
Construct 基於一個專門構建的網頁桌面執行,包含聊天、檔案、瀏覽器、終端、電子郵件、日曆、工作流、記憶、活動記錄和已連線應用。使用者可以分配成果目標,例如:研究市場並儲存一份引用報告;閱讀原生收件箱並草擬或回覆郵件;從 Slack 訊息更新 Linear 問題;執行每週一的競爭對手監測;分析上傳的電子表格並附上清理後的結果;為重複的內部流程構建一個小型工作空間應用。
AI員工會規劃步驟,使用即時瀏覽器執行、沙箱終端、檔案或已整合應用,然後在工作空間中留下持久的輸出。活動記錄會提供有限的操作摘要和最佳理由,詳細的工具記錄則保留在聊天中。
一個完整的工作例項
抽象的定義不如一個具體的請求來得直觀。假設使用者要求:“找出我們五個競爭對手中誰本月調整了定價,並將摘要放在共享資料夾中。”
AI員工首先判斷這需要公開研究而非內部系統,然後使用網路搜尋和獲取定價頁面,對於需要互動才能顯示價格的頁面,它還會開啟即時瀏覽器。它將新發現與之前執行中儲存的檔案進行比較,最後寫出摘要,儲存到工作空間,並通知使用者。
這個任務之所以更符合“員工”而非“聊天機器人”的形態,並非因為研究本身,而是因為比較依賴於上個月的檔案,輸出被存放到持久位置,並且下個月的執行將從本月的結果開始。任務有了“前因”和“後果”。
持久與重複的工作
持久化使得AI員工比一次性任務執行器更有價值。Construct 跨會話保留工作空間檔案和長期記憶。記憶可以被檢查、糾正、遺忘或恢復,因此連續性不需要永遠接受不透明的記錄。
使用者或AI員工可以將可重複的步驟編碼為可重複使用的工作流。Construct 的工作流將智慧體步驟、已連線應用操作和應用內通知組合在版本化的線性執行中。分支、延遲、審批步驟、扇出和子工作流尚不支援。工作流可以按需啟動,而原生日曆可以一次性或定期排程智慧體任務或工作流。
可監督的工作
AI員工不應因為獨立工作而變得不可見。Construct 在同一網頁桌面中暴露檔案、即時瀏覽器活動、終端轉錄、工作流、記憶、聊天工具記錄和有限的活動摘要。使用者可以檢查結果、中斷正在進行的回合,並在智慧體需要缺失資訊時回答問題。
Construct 還可以將有限的子任務委託給臨時智慧體。計劃允許2、4或8個臨時作業同時執行;額外作業排隊,而瀏覽器和終端工作可能仍會競爭共享執行表面。
如何評估AI員工產品
在比較類別中的產品時,大多數營銷語言聽起來相似。以下問題可以快速區分它們:
- 工作完成後儲存在哪裡?如果答案是“聊天曆史”,則永續性不足。
- 它能實際操作哪些介面?連線的應用程式、真實瀏覽器、終端和電子郵件是不同的能力,許多產品只具備其中一部分。
- 它能在無人監視時執行嗎?依賴瀏覽器標籤頁開啟的排程不是真正的排程。
- 它留下什麼證據?使用者應該能重構發生了什麼,而不只是相信摘要。
- 使用者能糾正它的信念嗎?無法檢查或修復的記憶會隨著事實變化成為負擔。
- 明確說明了哪些限制?一個能說明自身邊界的產品比暗示沒有邊界的產品更值得信賴。
常見誤解
- “它會取代人類。”AI員工完成的是有限、工具驅動、可重複的工作。關係密集型和判斷密集型職責不會轉移。
- “它從第一天開始就無需監督。”自主權是按工作獲得的。合理的路徑是先按需執行,待輸出可靠後再安排定期執行。
- “更多整合意味著更強大。”整合數量並不能說明產品能否完成跨越多個整合的工作並記住發生了什麼。
- “它只是帶外掛的ChatGPT。”區別在於工作空間:檔案、記憶、日程和執行歷史超越了一個對話執行緒。
何時使用AI員工
當需要重複性工作、跨應用執行、持久上下文或可檢查的輸出時,選擇AI員工。聊天助手仍然是快速起草、頭腦風暴和一次性問題的更簡單選擇,尤其是那些不需要工具執行的問題。