Jevブームの中で見落とされがちなこと
Jev(TypeSafe AI)やClaude CodeのAGENTS.md対応など、ここ数日で自律エージェント周りのニュースが立て続けに出ている。社内勉強会で50件以上の統合アイデアが出た、という話も見かけた。
こういうタイミングでは「何を作るか」の話ばかりが盛り上がりがちだが、実際にエージェントを自律運用してみると、最初にぶつかる壁は機能不足ではなく「止め方」を決めていないことだ。
よくある失敗パターン
- エージェントが同じAPI呼び出しをリトライし続けて、コストが想定の10倍になる
- 承認なしで外部サービスに書き込み系の操作を実行してしまう
- 失敗した処理を「安全に再実行できるか」を判断せずリトライして、二重実行が起きる
これらは全部、機能実装の前に「運用ルール」として決めておけば防げる種類の問題だ。
最低限決めておくべき3つのルール
1. コストの上限をハード制約にする
「予算の何%を使ったら止まる」をエージェント自身がチェックできる形にしておく。事後にログを見て気づく、では遅い。
2. 書き込み系アクションには承認ゲートを挟む
読み取りは自由に、外部に影響を与える操作(送金・投稿・削除など)は人間の承認ステップを必須にする。Jevのような新しいエージェント基盤を試すときほど、ここを先に決めておいた方がいい。
3. リトライ前に「安全に再実行できるか」を判定する
冪等なアクション(safe)、キー付きで重複排除できるアクション(dedupe_required)、絶対にリトライしてはいけないアクション(unsafe)を区別してから再試行ロジックを書く。ここを飛ばすと決済や注文の二重実行につながる。
実際に手を動かした人向け
上記の考え方をコードに落とした無料スキル(承認ゲート・予算ガードレール・再試行安全性判定の3つ)をGitHubに公開している。
→ https://github.com/tkimblack/capsule26-skills
それぞれ標準ライブラリのみで動く単体スクリプトなので、自分のエージェントのフックにそのまま組み込める。
もう少し体系的に「コスト設計・承認フロー・失敗時の振る舞い」をまとめた電子書籍も出している。興味があれば覗いてみてほしい。