Skip to main content
Thoughts

Keep up with Agents: async and non-linear

Keep up with Agents: async and non-linear

我覺得現在工作很大一部分的 bottleneck 在於 process agents' outputs,尤其當我開始採用 a single master session 的方法之後,這個 master session 的 output 不但又多又快而且還很雜亂,因為 chat 是 linear 的,所以很難用於管理這樣的 session(master session 的目的是我希望這個 agent 能夠知道我所有的 work,而不是一件事情就是一個 chat、有一堆散亂的 sessions 卻沒有一個完整的全局視野)。

我目前的解法是嘗試用 Google Doc 為主的溝通方式,我想達到的是:

Google Doc 剛好可以滿足這些需求,我的做法是讓 Agent 定期維護一個 Status Board,因為不像 chat 是 append only,所以可以以更接近我們熟知的 UI 來展示資訊,例如列出需要我注意力的項目,同時我也可以用 comment 的方式 follow-up / deep dive 或是 steer。

最直接的好處是我跟 agent 之間的合作不再是 synchronous 的,我可以 async 的查看現在的狀況然後留言、給 feedback,所以除了一些 hard blockers 之外我不再是 bottleneck。

第二個好處是解決了在一個 master session 內資訊雜亂的問題,即使有多個 projects 同時進行,我還是可以清楚的知道每個 projects 的狀況,以及可以針對不同 projects 用 comment 的方式來 steer,我覺得這個算是一個 non linear 的合作方式,agent 只需要定期 review comments 就能知道我在哪些問題上想要做什麼,其實很像是 code review。

壞處是 agent 透過每次 cronjob wakeup 都得花一些 context token 來檢查目前的狀況並且確保 status board 是符合現狀的,如果能有一個更結構化的、agent 能夠 RW 並且人類也可以 async & non-linear 互動的 interface,也許能做到更 token efficient。