审阅不花 agent 的 token。
这个循环里有两件事分开来看,都很省:agent 调用工具拿回什么,以及确认结果排版正确要花多少力气。
工具调用返回的是一个小小的 JSON 对象,不是排版后的页面;排版后的页面由人在 MarsDawn 里阅读——不会被读回 agent 的 context。
工具调用本身很便宜
不管是从 CLI、skill,还是MCP 服务器调用 marsdawn export,返回的都是精简的 JSON 对象:ok、output、pages、theme、paper 和 diagramErrors。完整 schema 在 export.v1.json。里面没有排版后的文稿内容。一份 50 页、有十几张 Mermaid 图表的 PDF,返回的字段和一份一页的笔记一样多。
审阅在另一边进行
PDF 生成之后,人会打开它——在 MarsDawn 里,或任何 PDF 查看器——阅读排版好的图表、数学式和版面。agent 不需要把排版结果读回自己的 context 才能确认它看起来对:审阅在另一个窗口、另一个屏幕上进行,不会变成又一轮花 token 描述一张图表长什么样子。
这样省下什么
- 不用把排版后的 Markdown、一张截图,或对截图的描述贴回对话里,只为了让 agent 确认导出成功。
- agent 不需要重建 Mermaid 图表或 KaTeX 公式排版后的样子,直接让人去看就好。
- 不需要在第一次调用已经报告成功之后,再多一次调用去读取 PDF 的内容。
接下来
- 调用 marsdawn 的三种方式——CLI、skill 文件、MCP 服务器:三种入口。
- JSON 结果的每个字段:给 AI agent 的 marsdawn 参考。
- 为什么还是需要有人读 agent 写的东西:审阅的理由。