MarsDawn Mac App Store で配信中

Anthropic はエージェントに透明性を求めた。では誰がそれを読むのか?

2024 年 12 月、Anthropic は AI エージェントを作る人向けのガイド「Building Effective Agents」を発表した。その要約は 3 つの原則を挙げていて、その 1 つが透明性だ。この記事は、その原則のもう一方の端について書く。エージェントが自分のステップを示したあと、結局は誰かがそれを読むことになる。

透明性はエージェントがすることで、読むのはあなたがすることだ。Anthropic は開発者に、エージェントの計画のステップを示すよう求めている。コーディングエージェントを日々動かす多くの人にとって、そのステップは結局、しかるべきタイミングで誰かが読む Markdown ファイルとしてやって来る。

ガイドが書いていること

Erik S. と Barry Zhang は、要約でこうまとめている。

“When implementing agents, we try to follow three core principles: Maintain simplicity in your agent's design. Prioritize transparency by explicitly showing the agent’s planning steps. Carefully craft your agent-computer interface (ACI) through thorough tool documentation and testing.”

(エージェントを実装するとき、私たちは 3 つの中心的な原則に従おうとする。エージェントの設計をシンプルに保つこと。透明性を優先し、エージェントの計画のステップを明示的に示すこと。十分なツールのドキュメントとテストを通じて、エージェントとコンピュータの間のインターフェース(ACI)を丁寧に作り込むこと。)

これらはエージェントを作る人向けの設計原則であって、使う人への操作指示ではない。原則が求めているのはステップを示すことで、誰がそれを読むかは書かれていない。

同じ記事は、タスクを受け取ったあとエージェントが何をするかも描いている:「Once the task is clear, agents plan and operate independently, potentially returning to the human for further information or judgement.」(タスクが明確になると、エージェントは計画を立て、自律的に動く。必要に応じて、追加の情報や判断を求めて人間に戻ってくることもある。)そして:「Agents can then pause for human feedback at checkpoints or when encountering blockers.」(エージェントはチェックポイントや障害に出会ったとき、人間のフィードバックを待って一時停止できる。)動詞に注目してほしい:potentially(必要に応じて)と can(できる)。チェックポイントは、エージェントが持ちうる設計として描かれていて、必須のものとしてではない。

チェックのほとんどは、あなたがしているわけではない

ここは誇張しやすいところなので、ガイドが実際に最初に置いていることを見ておこう。エージェントは、世界に対して自分自身をチェックする:「During execution, it's crucial for the agents to gain “ground truth” from the environment at each step (such as tool call results or code execution) to assess its progress.」(実行中、エージェントが自分の進捗を評価するには、各ステップで環境から「ground truth」(ツール呼び出しの結果やコード実行の結果など)を得ることが重要だ。)この一文の ground truth は、テスト結果やツールの出力を指していて、人間のことではない。

ガイドはリスクについても率直だ:「The autonomous nature of agents means higher costs, and the potential for compounding errors.」(エージェントの自律的な性質は、より高いコストと、エラーが積み重なる可能性を意味する。)その答えは、ガードレール付きのサンドボックス環境での広範なテストであって、「もっと注意深く読め」ではない。

人が実際に登場するのは、コーディングエージェントについての付録だ:「However, whereas automated testing helps verify functionality, human review remains crucial for ensuring solutions align with broader system requirements.」(しかし、自動テストは機能の検証には役立つ一方、解決策がより広いシステム要件に沿っているかを確かめるには、人によるレビューが依然として重要だ。)この一文はコードについてのものだが、それが指し示すギャップは、どんなエージェントを使っていても見覚えがあるはずだ。テストは、何かが動くことは教えてくれても、それがあなたの意図どおりかまでは教えてくれない。

示されたステップは、どこへ行くのか

ここから先は、私たちの解釈であって、Anthropic の主張ではない。

コーディングエージェントを日々使っているなら、その計画のステップは、たいていダッシュボードには現れない。ファイルとして現れる:plan.md、チェックボックス付きのタスクリスト、エージェントが書き換え続ける進捗ファイル、最後にまとめの文書。透明性は、あなたの側から見ると、読むものが増えるということを意味する。

ステップを示すのはエージェント側の役割だ。もう半分は、それが重要な場面で人が読むこと。マイグレーションを実行する前、ブランチをマージする前、「完了」を受け入れる前。すべてを 600 行の、誰も開かないファイルに書き出すエージェントは、紙の上では透明でも、実際には監督されていない。

Harrison Chase は 2024 年、文書についてではなくエージェントフレームワークがどう動くべきかについて、関連することを述べている:「You’ll want the ability to observe what is going on inside, since the exact steps taken may not be known ahead of time.」(内部で何が起きているかを観察できる必要がある。実際に取られるステップは、事前には分からないことがあるからだ。)彼が話しているのは、エージェントを作る人向けのツールだ。もしあなたがエージェントを動かしている当人なら、それがずっと書き続けている素のファイルこそ、あなたが観察できる部分であることが多い。

ここに挙げた著者は誰も MarsDawn について触れておらず、MarsDawn や他の Markdown ツールを推奨してもいない。

見た目より読みにくい理由

ファイルは長く、重要な部分はたいてい先頭にはない。変更を説明する図は Mermaid のソースであって、絵ではない(実際に描画されたものを見る方法は「Mac で Markdown を見る方法」にある)。読んでいる途中で、エージェントがファイルを書き換えることもある。ファイルは複数にまたがることが多く、ブランチや worktree が違うこともある。そして問題を見つけたとき、「キャッシュの部分がおかしい」ではエージェントは推測するしかない。この話の詳しい版は「エージェントが返してくるものを読む」にある。

MarsDawn ができること、できないこと

MarsDawn は、この読み方のための Mac アプリだ。エージェントをより透明にするわけではなく、中に AI モデルもない。計画を要約したり、正しいかどうか教えたりはしない。できることは:

読むのはやはりあなただ。MarsDawn は、長く変わり続けるファイルを、あなたが読んでいる間、読みやすく保つだけだ。

試してみる

MarsDawn は Mac App Store で配信中です。無料の marsdawn コマンドラインツールもあります:

brew install redtear1115/tap/marsdawn

アプリなしで Markdown を PDF に書き出せます。

コマンドライン · 購入前に:MarsDawn ができないこと

次に

出典