← 全部文章

Grok Bot:給 AI 一台電腦,它就開始接手真正的工作

Grok Bot 將 AI 從「回答問題」推向「完成工作」:它有雲端電腦、可以登入真實工具、並行協作,而且……

作者Open Market Notes類型文章

截至 2026 年 8 月 12 日,AI Agent 領域出現了一個值得獨立拆出來看的產品:Grok Bot。

Grok Bot 把「AI 能否完成最後一英里」本身做成了產品。官方描述稱其為 AI teammates,也就是 AI companions。Bot 擁有自己的雲端電腦,可以登入使用者既有的工具和網站,並跨應用程式執行任務。當它完成後,會帶著結果回來,只有在需要判斷或核准時才會打斷使用者。

Grok Bot 的競爭單位是一整個工作:結果是否真的被寫入 Gmail、CRM、工單系統、試算表,或產品後端。

Key facts

ItemVerified detail
ReleaseEarly beta opened on August 11, 2026.
CompanyxAI operates within SpaceX following the acquisition announced on February 2, 2026.
AccessSuperGrok Heavy, Cursor Ultra, and Cursor Teams Premium are the first eligible plans named by xAI.
ExecutionEach Bot uses a persistent cloud computer, signs in to existing tools, and can continue while the user is offline.
Human controlApproval checkpoints cover actions that need user judgment.
OMC contextSee the AI topic hub and all OMC articles for related coverage.

First, make the factual boundary clear: who it is, and when it was released

Grok Bot entered early beta on August 11, 2026. The official news page and product page use the SpaceXAI/xAI brand, while the legal footer still shows X.AI LLC. On February 2, 2026, SpaceX announced the acquisition of xAI. This confirms that Grok Bot comes from the xAI business under SpaceX. As of the time of writing, official materials do not show that ‘SpaceXAI’ has an independent ticker, and the claim ‘$SPCX’ lacks evidence.

Its first wave of access is also much narrower than ‘all Grok users’: the official launch page lists SuperGrok Heavy, Cursor Ultra, and Cursor Teams Premium users; enterprise users can join a waitlist for future access. The prices listed on the official product page are Cursor Ultra at $200 per month and Cursor Premium Teams at $120 per seat per month, with a note that users who already have Cursor Ultra or SuperGrok Heavy can get access included directly.

On the platform side, the official materials explicitly mention desktop and iOS, and list a macOS download as one of the current entry points. Windows, Android, and standard SuperGrok should not be written as confirmed facts based only on community retellings.

Relevant official materials:

1. What Grok Bot really changes

傳統聊天助理的基本循環是:使用者提問,模型生成答案,然後使用者再把那個答案複製進工作流程。即使它能呼叫工具,這些工具通常也只是以 API 或外掛的形式存在,使用者仍然必須設計呼叫鏈、檢查中間狀態,最後把結果搬回業務系統。

Grok Bot 把這個循環改成了不同的形狀:

分派任務 → Bot 登入工具 → Bot 在真實介面中工作 → Bot 產出結果 → 在關鍵點進行人工核准

系統邊界也隨之擴展。模型的輸出會直接改變目標系統的狀態:CRM 增加一筆跟進紀錄,收件匣收到一份草稿,工單系統收到重現步驟,試算表被整理好,跨團隊交接再往前推進一步。

官方發布頁面把這種差異說得很直接:Bot 可以進入既有工具、收件匣和網站,即使平台沒有乾淨的 API 或 MCP,它也仍然可以像人一樣操作。這項能力特別適合「軟體可用,但自動化介面不完整」的組織。大量真實企業工作,正發生在半結構化網頁、舊式 CRM、後端表單與電子郵件串之中。

Grok Bot 將任務從收件匣一路推進到 CRM 和試算表,把工作推到需要人工確認的最後一步{width=1536 height=1024}

說明:Grok Bot「跨工具最後一英里」的示意圖。圖中的工具介面使用抽象符號,並未複製任何供應商的真實介面。

2. How it works: what does ‘its own computer’ mean

1. 雲端工作區讓任務持續執行

官方描述中的關鍵詞是「their own computer」。這台電腦位於雲端,因此即使使用者闔上筆電或放下手機,任務也可以繼續執行。對於需要等待、批次處理,或跨時區執行的任務來說,這更接近「委派工作」而不是一次性的 API 呼叫。

「擁有一台電腦」只代表執行容器在雲端。安全邊界仍然取決於登入憑證、工作階段狀態、網站權限、可存取資料的範圍,以及關鍵動作前的核准門檻。早期 beta 最值得觀察的是,Bot 是否能可靠地停在正確的按鈕前。

2. 透過真實介面操作,覆蓋 API 不完整的工具

從產品邏輯來看,Grok Bot 利用了瀏覽器/桌面互動層的一般性:它可以觀察頁面、輸入內容、點擊控制項、讀取結果,然後把狀態傳遞給下一個工具。優點是可廣泛接入;缺點是更脆弱:頁面改版、彈出視窗、權限過期、CAPTCHA、網路抖動與區域限制,都可能讓一條看似簡單的流程失敗。

‘No API or MCP required’ 的意思是,即使缺少成熟介面,產品也能先開始運作。企業仍然必須定義帳號邊界、登入策略、可操作動作,以及失敗回滾規則,因此整合與維護成本依然存在。

3. 記憶與例行流程:從一次性展示到可重複使用的工作流

官方產品頁面支援讓 Bot 先陪跑一次完成某項任務,而 Bot 之後會把步驟儲存為可反覆執行的例行流程。它也會保留對話上下文,逐步記住使用者的語氣、偏好、客戶資訊,以及什麼時候應該繼續、什麼時候應該停下來詢問。

Grok Bot 站在通用模型與個人工作方式的交叉點。它的產品價值取決於一個具體問題:它能否學會組織內部使用者實際完成工作的方式。

這裡也有一個很容易被忽略的風險:一旦累積了工作流記憶,它可能會儲存臨時習慣、錯誤的例外處理,或是不應長期保留的客戶資訊。在演示之前,企業應先決定哪些步驟值得被編碼化,哪些資料絕不應進入長期上下文。

3. 為什麼多 Bot 協作比單一 Agent 更重要

單一 Agent 解決的是「幫我把這件事做完」;多 Bot 解決的是「把一組責任拆分給不同角色,讓它們彼此交接。」

官方材料給出的組織結構是:可以有一個 Chief of Staff 作為整體協調者,然後把 sales outreach、inbox、expenses、recruiting、product bugs、operations 以及其他工作分配給專門的 Bot instance。Bots 可以在同一條 thread 內傳遞任務與上下文,也可以進入 group chats,自行指派 ownership,只有在需要做判斷時才把人類拉回來。

產品把多個 Bots 組織成一支小型數位團隊:

LayerRoleTypical actions
Coordination layerChief of StaffReceive goals, break down tasks, chase handoffs, summarize status
Specialist layerSales, Finance, Recruiting, Engineering BotComplete a segment of specialized work in its own toolchain
Approval layerHuman ownerHandle judgment calls such as sending, payment, external commitments, and permission changes

這種架構減少了「人類是黏著劑」的工作。研究結果可以直接交給 marketing Bot,marketing 草稿也可以直接流向 sales manager。代價是錯誤可能沿著 thread 傳播:如果某個 Bot 讀到了錯誤的客戶資訊,其他 Bots 可能會繼續沿用。因此,多 Bot 系統需要可追溯的上下文來源、任務所有權與回滾機制;單純保存更長的對話歷史並不能解決這個問題。

4. 官方案例指向後端勞動

The early internal scenarios listed by the official materials are very representative:

  • Sales outreach: overnight 研究帳戶,評估聯絡意圖,以 salesperson 的語氣起草 emails and LinkedIn messages,最後生成一份待核准清單。
  • CRM and customer follow-up: 更新通話筆記,同步下一步,整理客戶狀態,並生成一份 Monday dashboard。
  • Finance and office operations: 從 Gmail 收集 invoices or receipts,並處理新員工 onboarding operations。
  • Product and engineering: 在產品介面中重現 bugs,建立 tickets,然後把修正交給另一個 debugging Bot。
  • Demo preparation: overnight 檢查 demo environment,修復 seed data 或 expired states,並在會議開始前提供一份 preparation checklist。

這些案例都依賴由數十個小動作組成的封閉迴路,且很少需要憑空創造新答案。AI Agents 的價值,可能首先會出現在低光環、高頻率、跨系統的工作中。對這些角色而言,令人驚豔的長篇輸出幫助有限。

5. 它與一般 Grok、傳統自動化,以及 Browser Agent 的差異

Comparison dimensionRegular GrokTraditional workflow automationGeneral Browser AgentGrok Bot
Core unitOne conversation and answerA pre-defined rules chainOne browser taskContinuously delegated work
Tool boundaryIn-chat capabilities and connectorsAPIs, plugins, fixed nodesBrowser pagesCross-application execution across real tools and websites
Continuous executionUsually request-responseTriggered by scheduleMostly one-off runs24/7 cloud execution
Memory modeConversation contextVariables and databasesTask contextConversation memory, preferences, and routines
ParallelismUser opens multiple chatsOrchestrator schedulingMultiple task instancesMulti-Bot collaboration, thread handoffs, and group chats
Main failuresInaccurate answersInsufficient rule configurationPage changes, login issues, and timeoutsThe above issues plus permission and collaboration risks

If put in one sentence: regular Grok is more like ‘an assistant that can think,’ traditional automation is more like ‘a reliable pipeline,’ Browser Agent is more like ‘an executor that can operate pages,’ while Grok Bot is trying to combine all three into ‘a digital colleague that can take over work for a long time.’

6. 工作狀態可能是護城河

Grok Bot 的產品野心不能只用模型基準來衡量。它想要打造的是一種工作狀態:登入狀態、歷史 thread、偏好、例行流程、跨 Bot 上下文,以及任務在真實系統中的落點。

這帶來三個潛在優勢:

  1. Higher switching costs: 一旦 Bot 知道客戶規則、審批路徑與團隊語言,切換工具就需要遷移整個工作狀態。
  2. 更短的回饋迴路:人們可以直接在目標工具中更正錯誤,而 Bot 也能據此調整下一次執行。
  3. 更明顯的並行收益:多個 Bot 在夜間處理不同工作流,使用者可在早晨檢視一組等待核准的項目,節省整理零散建議所花的時間。

這也改變了產品的評估指標。最有用的衡量方式包括:任務完成率、實際落地率、需要人工接手的次數、錯誤動作的可逆性、跨 Bot 交接損失率,以及從委派到任務完成的總時間。

7. 權限與隱私:錯誤能否回滾

Grok Bot 的關鍵賣點也是它最大的風險:它需要登入真實工具,並且能讓動作真正落地到實際系統中。官方產品頁強調,當需要使用者判斷時,它會回來請求核准,但在早期 beta 階段,公開資料仍不足以讓外部使用者完整評估權限矩陣、稽核日誌、資料保留,以及各種站點異常的處理方式。

因此,企業在測試時應設定四條硬邊界:

  • 先讀取後寫入:先讓 Bot 研究、整理、起草並產生待辦事項;一開始不要開放發送、付款、刪除、重新定價或公開發布。
  • 分離帳號與最小權限:為不同 Bot 建立不同登入身分,依工作流隔離,不要直接把個人管理員帳號交給通用 Bot。
  • 把核准點前移:將「發送、付款、刪除、發布、提交」視為預設需要人工確認的動作。
  • 保留回滾證據:保存輸入、操作軌跡、輸出與最終狀態,以便定位、回復並檢查錯誤。

Grok Bot 在權限邊界前等待人工確認{width=1536 height=1024}

圖示:自主性將核准從每一次點擊壓縮到真正需要判斷的節點。

xAI 的消費者條款要求使用者對其提交的內容、提供的指令以及 Agentic Actions 負責,且不保證每一個 Agentic Action 都一定準確、安全或合法。Grok Bot 可以代表使用者行動,但商業後果仍由使用者承擔。

8. Cursor 在這裡扮演什麼角色

Cursor 是 Grok Bot 的重要下載與產品入口。官方頁面將 macOS 下載連結導向 Cursor,同時也把 Cursor Ultra 和 Cursor Teams Premium 列為存取入口。這些安排顯示,Grok Bot 的產品交付、桌面體驗,以及 Cursor 的雲端 Agent 基礎設施彼此高度連結。

Cursor 品牌頁要求統一使用 ‘Cursor’ 這個名稱,並明確排除 ‘Cursor AI’ 和 ‘Cursor Code’。其官方資源將 Agents、Teams、Enterprise 和 Cloud Agents 納入同一產品系統。現有公開資訊支持以下分工:xAI 提供 Grok/Bot 的模型與產品能力,而 Anysphere/Cursor 提供重要的桌面與 Agent 產品入口。雙方之間的法律合作架構與基礎設施分工尚未完全披露,因此不能由此推斷收購或產品所有權。

xAI Logo(用於準確指向 xAI 產品)
xAI Logo(用於準確指向 xAI 產品)
Cursor Logo(官方品牌資源)
Cursor Logo(官方品牌資源)

品牌標誌:xAI Logo 依照官方品牌規範使用;Cursor Logo 與使用規則可見於 Cursor Brand Guidelines。這些標誌僅用於指向相關產品,不表示與 OMC 存在任何贊助或背書關係。

9. 應如何評估早期 beta

第一天的證據有限。此時的評估可聚焦於三個問題,對應 AI Agents 最持續存在的三個問題。

它能 100% 完成工作嗎

許多 Agents 可以研究、生成與建議,但把最後一步留給人類。Grok Bot 把「在完成後將結果真正落到實際工具中」作為核心賣點。如果它能在大多數低風險工作流中可靠地做到這一點,其價值將明顯高於只是在摘要寫作上更強的聊天助理。

它能把複雜性留在系統內嗎

產品頁強調,使用它應像傳訊息給同事一樣自然,而不必先建立複雜自動化。若要求使用者為每個 Agent 都先設計一條工作流,等於把自動化複雜性轉回給他們。例外處理是產品測試的關鍵:當流程失敗時,系統應以易懂語言說明問題,並提供可回復的下一步。

它是否把控制權交還給人類

24/7 自主運作仍需要清楚邊界。成熟的 Bot 應能區分自動動作、需要核准的動作,以及被禁止的動作。若最後一步只顯示模糊的「繼續?」提示,卻缺乏例如讀取範圍、已經做出的變更與下游影響等資訊,使用者就無法做出有效判斷。

結論:Grok Bot 的真正押注,是把 AI 變成可管理的工作狀態

Grok Bot 的目標是讓 AI 維持一種可管理的工作狀態:登入工具、理解上下文、推進任務、協調多個角色、等待核准,然後把結果寫回人類實際工作的地方。

這條路徑的上限非常高,因為它瞄準的是日常企業工作的真實摩擦;風險也同樣具體,因為每一次登入、點擊和提交都可能產生業務後果。早期 Beta 適合從可逆、低風險且邊界明確的任務開始,然後逐步觀察它在真實工具中的完成率與錯誤模式。

一般的 Grok 擅長回答問題;Grok Bot 則是在嘗試承擔責任。它能否成為真正的「隊友」,取決於兩件事:在權限邊界內完成工作,以及始終讓使用者清楚知道正在發生什麼。

Source verification

確認的主張Primary sourceChecked
Product description, release date, and eligibilityIntroducing Grok Bot2026-08-12
Product workflow, pricing, and platform entry pointsMeet Grok Bot2026-08-12
xAI and SpaceX corporate relationshipxAI joins SpaceX2026-08-12
User responsibility for agentic actionsxAI Consumer Terms2026-08-12

Frequently asked questions

When did Grok Bot launch?

xAI 在 2026 年 8 月 11 日開放了早期 beta。

Which subscriptions include early access?

xAI 指名 SuperGrok Heavy、Cursor Ultra 和 Cursor Teams Premium。存取條款在 beta 期間可能會變更。

Can a Bot continue after the user closes a device?

可以。它的持久化電腦運行在雲端,並支援使用者離線時持續工作。

Which tasks fit an enterprise pilot?

從可逆工作開始,例如研究、分類、撰寫草稿、收據收集和 bug 重現。在發送、付款、刪除、發佈或變更權限之前加入核准檢查點。

References and brand notes

這篇文章是 Open Market Notes 基於公開資訊所做的獨立編輯與分析。產品、資格、定價與平台支援皆以官方頁面的最新狀態為準;Grok Bot 處於早期 beta,並且在正式企業部署之前,應完成權限、資料保留、稽核與回滾評估。

內容僅供參考,不構成投資、法律、稅務或財務建議。