AI にコードを書かせるとき、いちばん難しいのは、書かせることではなく、書かれたものを信用してよいかを、誰がどこで決めるかだ。このページでは、その判断を何がどこで受け持っているかを 1 枚にまとめた。
ここでいうハーネスは、AI を取り囲む足場のこと。決まった場面で勝手に走る自動処理(フック)、役目を 1 つに絞って呼び出す別の AI(専門役)、自分で定義した呼び出し(コマンド)、作業のやり方を書いた手順書(スキル)に、それぞれへ与える権限の設定を加えた一式を指す。すぐ下の数字が、その内訳になる。設計の方針は 1 つだけで、機械的な作業だけを自動で走らせ、判断が要る品質の作業は、AI が状況を見て自分で呼ぶようにしてある。
自動化を増やしすぎると、判断が要る場面でも同じ処理が走って邪魔になる
逆に全部を手動にすると、急いでいるときにチェックごと飛ばされる
この 2 つを避けた結果、いまは変更が通るどの段階にも、チェックを 1 つ以上置いてある
変更が通る段階と、それぞれに入るチェック
1 つの変更が通る流れを、 段階に分けた。チェックの置き場は、呼ばなくても走る層(AUTO)と、AI が状況を見て自分で呼ぶ層(GATE)の 2 つ。どちらかが空の段階もある(完了保証がそうで、理由は図の中に書いた)。各項目には、それが何として作ってあるか(専門役・スキル・規約・コマンド)の印を付けた。規約は、AI に読ませる設定文書に書いた決まりのこと。
下の表では、上の図と同じ件数を、段階ごとに説明を付けて並べ直した。図には名前しか出していない。1 件は、フック・専門役・スキル・規約・コマンドのどれか 1 つ。例外として、曜日で走る定期処理が混ざっている。
段階ごとに AUTO と GATE を分けて並べた。画面が狭いときは、横並びが縦に積み重なる。
どの段階でも、常にかかる決まり
ここに挙げる決まりは、特定の段階ではなく、すべての判断・報告・実行に常にかかる。守りたいのは、判断そのものの質。段階ごとの仕掛けでは拾えない、AI 自身の思い込みをここで止める。「自動」の印が付いたものは、フックが機械的に止めるか、警告を出す。「規約」の印が付いたものは文章で書いてあるだけで、守るかどうかは AI に任されている。
効いているのに気づきにくい仕組み
毎日使っていると、当たり前に感じてしまう。けれど、この使い心地は自然にできたものではない。「勝手に品質が上がっている」と感じるとき、裏では次の仕組みが働いている。
できていないこと・伸びしろ
良いことだけを報告しないために、この欄を置いている。最優先の 1 件(必ず走る自動の処理と、AI の自己申告に任せた部分の差)は、2 段階で直す計画の 1 段目に手を付け、効果を測っている。残りの項目と、棚卸しの途中で新しく見つかった項目も、そのまま並べた。直ったものも消さずに残してある。消すと、何を課題として数えたのかが、後からたどれなくなる。
四角 1 つが 1 件。上の段ほど深刻(最優先・中・低)。塗ってあるのは手を入れたもので、手を付けただけのものと、もう直ったものが混ざっている(どちらかは、下の一覧の表示で分かる)。破線の枠は、手つかずの印。
このページは、設定・フック・専門役・スキル・規約・コマンド・記録の 7 か所を 1 つずつ読み直して作った。それぞれについて、「いつ走るか」「何をするか」「どの段階に入るか」を照らし合わせている。
頭の中で考えただけでは言い切れないものには、「できていないこと」の欄に「実測が要る」と書き添えた。数えた日は上に書いた。
c:\work 作品紹介ギャラリー