agent 做完的工作,最後都變成一份你要讀的 Markdown。
你請 coding agent 規劃一次資料庫遷移、寫一份規格,或追一個 bug。它自己跑了一陣子,交回來的是一個檔案:plan.md、SPEC.md、一份進度報告,或一份研究摘要。你能檢查的工作,全在這份檔案裡。
agent 有沒有做對,要讀過它交回來的東西才知道。MarsDawn 就是為這種閱讀做的 Mac app。
做 agent 的人怎麼說
以下引文照原文,我們的解讀放在最後。
- Anthropic 的〈Building Effective Agents〉(Erik S. 與 Barry Zhang,2024 年 12 月)列出打造 agent 的三個核心原則,其中一條是「Prioritize transparency by explicitly showing the agent’s planning steps.」(優先重視透明度:明確展示 agent 的規劃步驟。)這是寫給開發 agent 的人的原則;站在你這邊,這份透明就是你手上那份要讀的計畫。
- 同一篇也寫到:「Agents can then pause for human feedback at checkpoints or when encountering blockers.」(Agent 可以在檢查點或遇到阻礙時暫停,等待人類回饋。)注意原文用的是 can,可以,沒有說必須。
- Chip Huyen 在〈Agents〉(2025 年 1 月)解釋為什麼規劃要和執行分開:「Without oversight, an agent can run those steps for hours, wasting time and money on API calls, before you realize that it’s not going anywhere.」(沒有監督的話,agent 可能執行那些步驟好幾個小時,在 API 呼叫上浪費時間和金錢,你才發現它根本沒有進展。)她也描述了一種失敗:「The agent is convinced that it’s accomplished a task when it hasn’t.」(Agent 深信自己已完成任務,但其實並沒有。)請它把 50 個人分到 30 間飯店房間,它只排了 40 人,還堅稱做完了。
- Andrew Ng 在 The Batch(2024 年 4 月)談 planning 這個設計模式:「On one hand, Planning is a very powerful capability; on the other, it leads to less predictable results.」(一方面,規劃是非常強大的能力;另一方面,它會導致較難預測的結果。)他講的是可預測性,並沒有呼籲要人工審閱,而且他相信規劃能力很快會進步。
以下是我們的推論,不是作者的主張:agent 把計畫攤開、在檢查點停下來,那在檢查點讀計畫的通常就是你。agent 可能以為自己做完了,那它的「完成報告」也得有人讀過。上面這幾位作者都沒有提到 MarsDawn,也沒有推薦 MarsDawn 或任何 Markdown 工具。
比看起來難讀
檔案很長,重要的地方很少在最上面。裡面有 Mermaid 圖表和數學式,看原始碼很難跟上。你讀到一半,agent 可能還在改寫同一個檔案。它通常不只交一個檔案,有時還分散在不同的分支或 worktree。等你找到問題,說「快取那段怪怪的」,agent 只能用猜的;說「docs/plan.md:42 在回填跑完前就把舊表刪了」,它就知道要改哪裡。
MarsDawn 幫得上忙的地方
- 檔案很長:側邊欄(⌃⌘S)的「大綱」分頁列出所有標題,點一下,兩邊窗格都會跳過去。
- 圖表和數學式:Mermaid 和 KaTeX 直接畫在預覽裡,和原始碼並排(⌘2),兩邊一起捲動。
- 讀到一半被改寫:agent 改寫檔案時,MarsDawn 會重新載入,停在你原本讀到的位置,前提是你自己沒有未儲存的修改。
- 好幾個檔案:用「檔案 ▸ 打開資料夾⋯」(⇧⌘O)打開 agent 工作的資料夾,新檔案大約一秒內就會出現在「檔案」分頁;如果是 git 檢出,清單上方會標出分支或工作樹。
- 回饋要準:「編輯 ▸ 拷貝引用」(⌥⌘C)把目前位置拷貝成
docs/plan.md:42,「拷貝給 AI」(⌃⌥⌘C)會在下面附上你選取的文字,直接貼給 agent 就好。
另外兩件事也和這個循環有關:agent 可以執行 marsdawn open plan.md:42,在 MarsDawn 裡幫你打開檔案,直接停在第 42 行,也就是它想先讓你看的那一行;審完的檔案可以從 app 輸出 PDF,也可以用免費的 marsdawn export 指令。
MarsDawn 裡沒有 AI 模型。它不會幫你摘要計畫、打分數,也不會告訴你哪裡錯了。讀的人是你,它負責讓又長又會變的檔案保持好讀,讓你能準確指出是哪一行。
五分鐘審完一份 agent 計畫
用什麼編輯器都適用。
- 先只看標題。大綱和你要求的對得上嗎?少一段,通常就是少做一件事。
- 找出所有寫著「完成」「通過」「已驗證」的地方,挑一個自己查:打開那個檔案、跑那個測試、數一下筆數。
- 找出做了就回不去的步驟:刪資料、資料庫遷移、force push,還有任何會寄出、付款或發佈的動作。這些要等你明確點頭。
- 圖表要看畫出來的樣子,逐一對照每個箭頭和文字說的是不是同一回事。
- 列出計畫會動到的檔案和系統。你沒要求的部分,執行前先問清楚。
- 回饋寫成「位置、問題、改法」:「
plan.md:88:回填排在刪表之後,第 4、5 步對調。」一行只講一個問題。
時間只夠做一步的話,就做第 2 步吧。以為自己已經做完的 agent,多半是在這一步被抓到的。完整版本、附實際例子:五分鐘審完一份 agent 計畫。
試試看
MarsDawn 已在 Mac App Store 上架。另外還有免費的 marsdawn 命令列工具:
brew install redtear1115/tap/marsdawn
它不需要 app 就能把 Markdown 輸出成 PDF;agent 也能用 marsdawn open 在 MarsDawn 裡幫你打開檔案。
命令列工具 · 給 AI agent 的 marsdawn 參考 · 買之前先看:MarsDawn 做不到的事
接下來
- 為什麼 AI 寫的東西需要人讀,短一點的版本:為什麼 AI 寫的東西還是需要人讀過。
- 審閱時不佔用 agent 的 context:節省 token 的審閱方式。
- agent 為什麼要把計畫攤開:Anthropic 說 agent 要透明,那攤開的東西誰來讀?
- 上面那份清單一步一步來,附實際例子:五分鐘審完一份 agent 計畫。
- 不同類型的 agent 會交給你什麼文件:四種 agent 設計模式,各自會交給你什麼文件。
資料來源
- Erik S. 與 Barry Zhang,〈Building Effective Agents〉,Anthropic,2024 年 12 月 19 日:https://www.anthropic.com/engineering/building-effective-agents (引文依 2026-09-26 的線上版本;該文現已註明,文中提到的工具生態自 2024 年 12 月以來已有很多改變)
- Chip Huyen,〈Agents〉,2025 年 1 月 7 日:https://huyenchip.com/2025/01/07/agents.html
- Andrew Ng,〈Agentic Design Patterns Part 4, Planning〉,The Batch,2024 年 4 月 10 日:https://www.deeplearning.ai/the-batch/agentic-design-patterns-part-4-planning/