元Googleエンジニアのエージェント型エンジニアリング・ワークフロー
概要
Google、Amazon、IBM、Microsoftで働いたシニアソフトウェアエンジニアのMaddy Zhangが、AIエージェントを日常業務で活用するワークフロー全体を紹介する動画です。メモリファイルとスキルによるコンテキスト設定、プランモードでの事前計画、並列エージェントの運用、ループ/グラフエンジニアリング、リスクに応じたコードレビューまでを一貫して解説しています。特定のツールに依存しない習慣として語られている点が特徴です。
主なポイント
- メモリファイル: エージェントはコードベースの規約を知らず、同じ間違いを繰り返す。そこでCLAUDE.mdやAGENTS.mdなどのメモリファイルにルールを書き込み、セッション開始時に自動読み込みさせる。
- グローバルとローカルの使い分け: 全コードに共通するルールはグローバルなメモリファイルに、リポジトリ固有のルールはローカルのファイルに分けて管理する。
- スキルの活用: DB移行、リリース手順、特定のデバッグ手順など、たまにしか使わない詳細な手順はスキルにする。メモリファイルに入れると無関係なタスクでも毎回読み込まれてしまう。
- プランモード: コードを書く前にエージェントに読み込みと提案だけをさせ、その計画を設計ドキュメントとして扱う。既存コードへの影響範囲やスケール時の挙動など、間違えると高くつく点を重点的に確認する。30分の要件整理で後の数時間の手直しを減らせる。
- 会議内容を要件に繋げる: スポンサーのGranolaは、ボットなしで会議を文字起こしして要約し、MCPコネクタでコーディングエージェントに会議の文脈を渡せる。
- ターミナルとtmux: tmuxなどのマルチプレクサで作業し、ノートPCを閉じても、スマホからでも同じ環境を再開できる。ハーネスはClaude CodeとCodexが中心で、DeepSeekのオープンソース版も試している。
- Git worktrees: 同一リポジトリの複数ブランチを別ディレクトリで同時に使え、stashや汚いコミットに頼らず並行作業ができる。
- 並列エージェント: Claude Codeのサブエージェントを隔離環境で動かし、リードエージェントがタスクを割り振って結果を回収する。セッション間メッセージングも使える。
- ループ/グラフエンジニアリング: ループは、タスク、自己検証方法、完了の定義を与え、エージェントが書く・テスト・修正を自律的に繰り返す設計。「テストが全部通るまで止めない」のように指示する。グラフはリサーチ、執筆、レビューなど役割ごとにクリーンなコンテキストを持つ複数ループを組み合わせる。
- リスクに応じたレビュー: 影響が小さい変更は要約と差分の確認のみ。中程度は流し読みに加え、エージェントにE2Eテストやスクリーンショット、動画で動作を証明させる。決済、認証、権限、DBスキーマなど影響が大きい変更は全行を読み、手動デプロイして自分でテストする。ステージング環境での確認も用意する。
実践に使えること
- リポジトリごとにCLAUDE.mdを作り、エージェントが間違えるたびに根本原因のルールを追記する。共通ルールはグローバルファイルに置く。
- 頻度の低い手順(移行、リリース、デバッグ)はスキルに切り出し、コンテキストの肥大化を避ける。
- 重要な機能は、実装前にプランモードで設計を詰める。
- 「テストが全部通るまで続けて」のように、完了条件と自己検証方法を含む指示でループを回す。
- Git worktreeとtmuxを組み合わせ、複数のエージェントを並行して走らせる。
- 変更の影響度を3段階に分け、レビューの深さを決める。決済や認証まわりは必ず自分で動作確認する。