Anthropic はエージェントに透明性を求めた。では誰がそれを読むのか?
2024 年 12 月、Anthropic は AI エージェントを作る人向けのガイド「Building Effective Agents」を発表した。その要約は 3 つの原則を挙げていて、その 1 つが透明性だ。この記事は、その原則のもう一方の端について書く。エージェントが自分のステップを示したあと、結局は誰かがそれを読むことになる。
透明性はエージェントがすることで、読むのはあなたがすることだ。Anthropic は開発者に、エージェントの計画のステップを示すよう求めている。コーディングエージェントを日々動かす多くの人にとって、そのステップは結局、しかるべきタイミングで誰かが読む Markdown ファイルとしてやって来る。
ガイドが書いていること
Erik S. と Barry Zhang は、要約でこうまとめている。
“When implementing agents, we try to follow three core principles: Maintain simplicity in your agent's design. Prioritize transparency by explicitly showing the agent’s planning steps. Carefully craft your agent-computer interface (ACI) through thorough tool documentation and testing.”
(エージェントを実装するとき、私たちは 3 つの中心的な原則に従おうとする。エージェントの設計をシンプルに保つこと。透明性を優先し、エージェントの計画のステップを明示的に示すこと。十分なツールのドキュメントとテストを通じて、エージェントとコンピュータの間のインターフェース(ACI)を丁寧に作り込むこと。)
これらはエージェントを作る人向けの設計原則であって、使う人への操作指示ではない。原則が求めているのはステップを示すことで、誰がそれを読むかは書かれていない。
同じ記事は、タスクを受け取ったあとエージェントが何をするかも描いている:「Once the task is clear, agents plan and operate independently, potentially returning to the human for further information or judgement.」(タスクが明確になると、エージェントは計画を立て、自律的に動く。必要に応じて、追加の情報や判断を求めて人間に戻ってくることもある。)そして:「Agents can then pause for human feedback at checkpoints or when encountering blockers.」(エージェントはチェックポイントや障害に出会ったとき、人間のフィードバックを待って一時停止できる。)動詞に注目してほしい:potentially(必要に応じて)と can(できる)。チェックポイントは、エージェントが持ちうる設計として描かれていて、必須のものとしてではない。
チェックのほとんどは、あなたがしているわけではない
ここは誇張しやすいところなので、ガイドが実際に最初に置いていることを見ておこう。エージェントは、世界に対して自分自身をチェックする:「During execution, it's crucial for the agents to gain “ground truth” from the environment at each step (such as tool call results or code execution) to assess its progress.」(実行中、エージェントが自分の進捗を評価するには、各ステップで環境から「ground truth」(ツール呼び出しの結果やコード実行の結果など)を得ることが重要だ。)この一文の ground truth は、テスト結果やツールの出力を指していて、人間のことではない。
ガイドはリスクについても率直だ:「The autonomous nature of agents means higher costs, and the potential for compounding errors.」(エージェントの自律的な性質は、より高いコストと、エラーが積み重なる可能性を意味する。)その答えは、ガードレール付きのサンドボックス環境での広範なテストであって、「もっと注意深く読め」ではない。
人が実際に登場するのは、コーディングエージェントについての付録だ:「However, whereas automated testing helps verify functionality, human review remains crucial for ensuring solutions align with broader system requirements.」(しかし、自動テストは機能の検証には役立つ一方、解決策がより広いシステム要件に沿っているかを確かめるには、人によるレビューが依然として重要だ。)この一文はコードについてのものだが、それが指し示すギャップは、どんなエージェントを使っていても見覚えがあるはずだ。テストは、何かが動くことは教えてくれても、それがあなたの意図どおりかまでは教えてくれない。
示されたステップは、どこへ行くのか
ここから先は、私たちの解釈であって、Anthropic の主張ではない。
コーディングエージェントを日々使っているなら、その計画のステップは、たいていダッシュボードには現れない。ファイルとして現れる:plan.md、チェックボックス付きのタスクリスト、エージェントが書き換え続ける進捗ファイル、最後にまとめの文書。透明性は、あなたの側から見ると、読むものが増えるということを意味する。
ステップを示すのはエージェント側の役割だ。もう半分は、それが重要な場面で人が読むこと。マイグレーションを実行する前、ブランチをマージする前、「完了」を受け入れる前。すべてを 600 行の、誰も開かないファイルに書き出すエージェントは、紙の上では透明でも、実際には監督されていない。
Harrison Chase は 2024 年、文書についてではなくエージェントフレームワークがどう動くべきかについて、関連することを述べている:「You’ll want the ability to observe what is going on inside, since the exact steps taken may not be known ahead of time.」(内部で何が起きているかを観察できる必要がある。実際に取られるステップは、事前には分からないことがあるからだ。)彼が話しているのは、エージェントを作る人向けのツールだ。もしあなたがエージェントを動かしている当人なら、それがずっと書き続けている素のファイルこそ、あなたが観察できる部分であることが多い。
ここに挙げた著者は誰も MarsDawn について触れておらず、MarsDawn や他の Markdown ツールを推奨してもいない。
見た目より読みにくい理由
ファイルは長く、重要な部分はたいてい先頭にはない。変更を説明する図は Mermaid のソースであって、絵ではない(実際に描画されたものを見る方法は「Mac で Markdown を見る方法」にある)。読んでいる途中で、エージェントがファイルを書き換えることもある。ファイルは複数にまたがることが多く、ブランチや worktree が違うこともある。そして問題を見つけたとき、「キャッシュの部分がおかしい」ではエージェントは推測するしかない。この話の詳しい版は「エージェントが返してくるものを読む」にある。
MarsDawn ができること、できないこと
MarsDawn は、この読み方のための Mac アプリだ。エージェントをより透明にするわけではなく、中に AI モデルもない。計画を要約したり、正しいかどうか教えたりはしない。できることは:
- 長いファイル:「表示 ▸ サイドバーを表示」(⌃⌘S)でアウトラインタブを開くと、見出しが並ぶ。クリックするとそこへ移動する。
- 図と数式:ソースとレンダリングされたページが並んで表示され(⌘2)、一緒にスクロールする。Mermaid と KaTeX は描画される。図が壊れている場合、プレビューはそのソースとエラーを一緒に表示する。
- 読んでいる途中の書き換え:エージェントがファイルを書き換えると、MarsDawn は再読み込みしつつ、あなた自身に未保存の編集がなければ、読んでいた位置を保つ。
- 複数のファイル:「ファイル ▸ フォルダを開く⋯」(⇧⌘O)でエージェントの作業フォルダを開く。新しいファイルは 1 秒ほどでファイルタブに現れ、git のチェックアウトならヘッダーにブランチや worktree の名前が出る。
- 行を指し示す:「編集 ▸ 参照をコピー」(⌥⌘C)で、いまいる場所を
docs/plan.md:42の形でコピーできる。「AI 用にコピー」(⌃⌥⌘C)は、その下に選択したテキストを付け加える。エージェントのチャットに貼り付ければいい。
読むのはやはりあなただ。MarsDawn は、長く変わり続けるファイルを、あなたが読んでいる間、読みやすく保つだけだ。
試してみる
MarsDawn は Mac App Store で配信中です。無料の marsdawn コマンドラインツールもあります:
brew install redtear1115/tap/marsdawn
アプリなしで Markdown を PDF に書き出せます。
コマンドライン · 購入前に:MarsDawn ができないこと
次に
- エージェントの出力がなぜ読みにくいか、そのチェックリスト:エージェントが返してくるものを読む。
- そのチェックリストを、実例つきで詳しく:エージェントの計画を 5 分でレビューする。
- エージェントの種類ごとに、どんな文書が返ってくるか:4 つのエージェント設計パターンと、それぞれが返す文書。
- AI の出力をそもそも読むべき理由(短い版):AI の出力を人が確認する理由。
出典
- Erik S. and Barry Zhang, “Building Effective Agents,” Anthropic, December 19, 2024: https://www.anthropic.com/engineering/building-effective-agents(2026-09-26 時点のオンライン版から引用。同記事は現在、2024 年 12 月以降ツール環境が大きく変わったと注記している)
- Harrison Chase, “What is an agent?,” LangChain, June 28, 2024, archived copy: http://web.archive.org/web/20240724003401/https://blog.langchain.dev/what-is-an-agent/(元の URL は現在 2026 年の別記事を表示している)