同時開三個 AI agent 寫程式,真正卡住的是什麼?看完 Orca 示範,再對照我自己在 Windows 上跑三席的那一天

Joe Maddalone 在 2026 年 8 月 21 日的影片裡,用開源工具 Orca 讓三個 AI 程式助理各開一個 git 工作樹同時改同一個專案。這篇只挖一個論點:工作樹解決了互相踩檔,卻沒解決額度與驗收,席位一多,瓶頸就搬到你身上。附 Orca、herdr、Claude Code 內建工作樹的比較表,以及我 9 月 22 日在 Windows 上實跑三席撞到的坑。技術學習分享,不是任何商業建議。

陛下不過能將十萬……臣多多而益善耳。
—— 司馬遷《史記・淮陰侯列傳》(西漢)
韓信說自己帶兵越多越好,劉邦只能帶十萬。這句話常被拿來誇韓信,但我看完一支講 AI agent 的影片之後,想到的是另一半:帶得動多少人,不是看營房蓋得多大,是看將軍一個人管得過來多少。
2026 年 8 月 21 日,Joe Maddalone 在影片〈Parallel Agent Orchestration with Orca〉裡,用開源工具 Orca 讓 OpenCode、Antigravity、Pi 三個 AI 程式助理各開一個 git 工作樹,同時修同一個專案的三個小問題;結果三席裡有一席(Antigravity)中途免費額度用完、沒做完。Orca 由 YC 2022 冬季班的 Stably AI 開發,MIT 授權,2026 年 10 月 4 日 GitHub 上有 84,769 顆星。我的看法是:工作樹解決了「互相踩檔」,但沒解決「額度」和「驗收」,席位開得越多,卡住的地方就越往你自己身上移。
影片在示範什麼
影片六分半,分兩段。第一段叫 Design Mode:在 Orca 裡開一個瀏覽器分頁跑自己的網站,點一下畫面上的卡片,那塊網頁的原始碼就複製起來,貼給 agent 說「把描述拉滿卡片寬度」,它改完,再一鍵產生 commit 訊息、開 PR。第二段才是重點:開三個工作樹,各派一個 agent、各修一個問題,切到看板看誰做完,逐一看改動、開 PR。
先把「工作樹」講白話:git worktree 是同一個專案在硬碟上開出好幾個資料夾,每個資料夾各自在一條分支上。三個 agent 各待一個資料夾,就不會你改到一半、我把你的檔蓋掉。這件事 Orca 做得很乾淨,影片裡三個 PR 互不干擾。
主論點:工作樹只解決了三個問題裡的一個
同時跑好幾個 agent,會撞到三種衝突。
第一種是檔案衝突,兩個 agent 改同一個檔。工作樹解決的就是這個,而且解決得很徹底。
第二種是額度衝突。Orca 的官方說明寫得很清楚,它是「用你自己的訂閱跑任何 agent」,Orca 本身不付錢給模型。所以開三席,就是同時燒三份額度;同一題派五家比答案(官方範例就是「一個提示分給五個 agent,比完挑贏家」),就是五倍的花費換一份答案。
影片裡 Antigravity 那一席斷糧,正好當場示範了這件事——那一席的錢包空了。
第三種是注意力衝突,也就是驗收。三席同時做完,三份改動要你一份一份看。影片作者很誠實,他在看板上「等它們做完再來看」,然後一份一份讀 diff、加註解、才開 PR。agent 可以平行,看改動的人只有一個。
為什麼大家容易只看到第一種?因為第一種的痛最吵:兩個 agent 互蓋檔案,畫面立刻壞掉,你馬上知道。後兩種是安靜的,額度是月底才發現燒光,驗收是三個 PR 堆在那裡、你以為做完了,其實只是「它們說」做完了。
這個論點什麼時候不成立?如果你的任務很小、改動一眼看得完(像影片裡「描述拉滿寬度」這種),驗收幾乎不花時間,那開越多席越划算。如果你的訂閱額度多到用不完,第二種衝突也消失。反過來,任務越大、越需要讀懂才敢合併,席位就越該少。
我自己跑三席的那一天
2026 年 9 月 22 日,我在 Windows 筆電上裝了 Orca 1.4.206,照它的玩法開了三席:一個 Claude 當總指揮、Codex 負責寫、另一個模型負責挑錯,任務是修一支安裝腳本「明明沒裝成功卻回報成功」的毛病。
跑起來之後,三件事是影片沒提的。第一,Orca 不准 agent 再開自己的 agent,總指揮想再往下分派,直接被擋(錯誤訊息是 nested_worker_depth_exceeded),只好改成在終端機裡直接下指令。第二,第一次進新專案,Claude 會跳出「信不信任這個資料夾」的確認框,預設選項是離開,Orca 送去的任務指令就這樣被當成「按 Enter 離開」吃掉了。第三,在 Windows 上把 Orca 主視窗關掉,整個程式就結束,背景在跑的也一起停。
三席跑了三輪,挑錯的那席抓到四個分歧,看起來很完整。但最後我還是自己從頭量了一次:做一個「假裝成功」的假指令,舊版在它底下印出三個成功、新版印出三個錯誤,對照組成立才算數。這一步也抓到我自己量錯兩次,一次是路徑格式寫錯、量到的其實是真指令,一次是引號被殼吃掉。三席省下的是打字時間,驗收的時間一分鐘都沒省。
三種開法並排比
| Orca | herdr | Claude Code 內建 --worktree | |
|---|---|---|---|
| 長什麼樣 | 桌面程式,內建編輯器、瀏覽器分頁、看板 | 終端機裡的分割視窗 | 一個指令旗標 |
| 每個 agent 一個工作樹 | 有,自動建 | 自己建 | 有,每個工作階段一個 |
| 看全部 agent 狀態 | 看板 | 會標每席在做事、在等你、做完了 | 沒有 |
| 手機看進度 | 有 iOS/Android 程式 | 要自己接遠端連線 | 沒有 |
| 平台 | macOS/Windows/Linux | 終端機能跑的地方 | 跟著 Claude Code |
| 授權 | MIT | Apache-2.0 | 隨 Claude Code |
| GitHub 星數(2026-10-04) | 84,769 | 42,192 | 不適用 |
三樣都不會替你付額度,也都不會替你驗收。差別在你要多少「看得見」:只開兩席,終端機分割就夠;要開到四席以上、還想在手機上看誰卡住,Orca 的看板與手機端才開始值回安裝的麻煩。
另外幾件值得記的
- Design Mode 適合改畫面:點一下元素就把原始碼帶給 agent,比你描述「左邊第二張卡片」準得多。
- 影片示範的 AI 自動寫 commit 訊息可用,但它開的 PR 沒有說明文字,作者自己也說「沒關係」,正式專案要補。
- 網路上不少介紹文寫 Stably 是「四人小團隊」,但 YC 公司頁在 2026 年 10 月 4 日寫的是 25 人。星數也一樣,常見的「四萬三千顆星」是舊數字,同一天實際是 84,769 顆。介紹文會過期,引用前回原始頁面看一眼比較保險。
- Orca 的版本跑得很快,我 9 月 22 日裝的是 1.4.206,10 月 4 日已經到 1.4.220,教學影片裡的按鈕位置可能對不上。
帶得走的一件事
能同時開幾件事,取決於你收得了幾件,不是你發得出幾件。
今天試一個小練習:把手上同時在跑的事列出來(工作、家事、在等別人回的訊息都算),每件旁邊寫「它做完時,要我花幾分鐘確認」。加起來超過你一天真正有空的時間,就先停掉一件再開新的。
留言
載入留言中…