multi-agent-starter 開發記事
一套多代理開發起手包的十一個決策故事:把自己從人肉路由器的職位上開除之後發生的事。
我不想再當 AI 之間的人肉路由器
同時用三家 AI 開發的下場,是人退化成訊息搬運工。這個系列記錄一套起手包不到三個月的演化:讓 AI 之間直接協作,人只負責決策。
買現成、自己造,還是等官方?
跨模型協作的執行層,我評估過現成方案、自己造了一套一千六百行的,最後被官方 plugin 整批做掉。而我居然很開心。
看起來 multi-agent,不等於有隔離
兩個代理輪流上場不等於互相制衡:它們可能是同一個模型呼叫兩次。這套 kit 最重要的框架是四種隔離。AI 出錯時,先問缺的是哪一種。
少即是多,我連砍了三刀
專案出生就帶兩千多行,六成是說明文件。後來我砍了三刀:實作、介面、所有權。每一刀砍掉的,都是不同種類的「多」。
superpowers 是個強勢房客
superpowers 用最高音量宣告自己該被觸發,弱模型每次都聽它的。反制的方式不是對抗,是引用它自己承認的優先權順序。
我的守門員親手教模型造假
收工閘門出生時檢查的是一顆沒有人會寫入的記號;後來它擋下模型時,還親手印出繞過自己的指令。這是一個 gate 學會「要證據」的過程。
請最強模型立一次法,然後退場
不是踩到痛點的修補,是一次預防性立法:請最強模型設計給弱模型用的制度,寫完診斷書與交接信就退場。判準只有一句:這條規則被違反時,能被物理偵測嗎?
測試全過了,但敵人不在裡面
給文字規則建了行為測試,結果失敗場景全數重現不了。沒有假裝勝利,而是把「敵人不在測試裡」這件事原樣寫下來。這一筆可能比測試本身更值錢。
11 個專案,誰在燒錢?
機隊擴到 11 個專案後,「哪個在跑、怎麼啟動、誰在燒錢」只存在人的記憶裡。解法樸素到近乎無聊:一個 TOML、一支彙總指令、一條寫給 AI 的維護慣例。
上線五天的決策,被一場 rebase 掀翻
全機隊剛決定不讓設定目錄進 git,五天後整個翻轉。導火線是一場把檔案從磁碟上靜默抹掉的 rebase。不可重建性,排在整潔前面。
3 個小需求、6 輪 review、87 分鐘
防線建好之後,接下來修的都是同一件事的反面:gate 擋得住,但擋到不該擋的。流程成本要和它擋下的風險成比例。