0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?

AIエージェントに勝手にコードを書き換えられるのが怖くて、自分で作りました【2026年9月・無料】

0
Last updated at Posted at 2026-09-27

AIエージェントに勝手にコードを書き換えられるのが怖くて、自分で作りました【2026年9月・無料】

Trust governance

Andromity

はじめに(結論を先に言います)

こんにちは、shekhar です。2年間、Webプラットフォーム(POSレジ、ダッシュボード、マーケットプレイスなど)を作ってきた個人開発者です。

先に開示しておくと、私はこの記事で紹介するOSS「Andromity」の作者です。 身内びいきにならないよう、良いところも「まだ言えないこと」も正直に書きます。

この記事の結論を先に言うと:

  • Andromityは、「信頼」でブレーキをかけられるAIコーディングエージェントです(VS Code拡張+ターミナルCLI、無料・オープンソース)
  • 4つの権限モード(SAFE→TRUST→FULL→YOLO)で、エージェントの自由度を自分で決められます
  • /waterfallでエージェントの思考が全部見える、/undoで一発巻き戻し、/cronで夜間バッチ
  • モデルは396種類以上対応。Ollamaなら完全無料・完全オフラインで動きます

🌐 公式サイト: https://andromity.agenticmarket.dev

僕の考えはシンプルです。エージェントは速くあるべき。でも、速さより大事なのは「いつでも止められる」ことです。

Andromityとは

Andromityは、プライバシー重視・BYOK(自分のAPIキーを持ち込む)方式の自律型AIコーディングエージェントです。VS Codeの拡張機能としても、ターミナルのCLIとしても動きます。MITライセンスのオープンソースです。

世の中にはCursorやClaude Codeという素晴らしいツールがあります。僕も毎日使っています。でも一つだけ、ずっと引っかかっていたことがありました。

エージェントが、確認なしにファイルをどんどん書き換えていくことです。

「このファイル直しておきました」と言われてdiffを見ると、頼んでいないところまで変わっている。そんな経験、ありませんか?僕は何度もありました。特に疲れている深夜だと、diffをちゃんと確認せずにそのままコミットしてしまいそうになるんです。

便利さと引き換えに、コードの主導権を渡してしまう感じ。それが嫌で、「信頼」でブレーキをかけられるエージェントを作ることにしました。

インストール(30秒)

1. VS Code拡張の場合

マーケットプレイスからインストールできます。

code --install-extension agenticmarket.andromity-agent

VS Codeを開いて、拡張機能タブから「Andromity」で検索してもOKです。

2. ターミナルCLIの場合(Linux / macOS)

curl -fsSL https://raw.githubusercontent.com/agenticmarket/andromity/main/install.sh | bash

3. Windowsの場合(PowerShell)

irm https://raw.githubusercontent.com/agenticmarket/andromity/main/install.ps1 | iex

インストール後、自分のAPIキー(Claude / OpenAI / Geminiなど)を設定すればすぐ使えます。お金をかけたくない人は、後述のOllamaで完全無料から始められます。

使い倒して分かった実践Tips 7選

ここからは、実際に使いながら掴んだコツを7つ紹介します。どれも「失敗談→設定→効き目」の順で書きます。

1. 最初はSAFEモードで始める(エージェントの仮免許)

Andromityには4つの権限モードがあります。

モード プラン ファイル書き換え コマンド実行
SAFE(デフォルト) 1つずつ承認 1つずつ承認 1つずつ承認
TRUST 承認 そのまま実行 そのまま実行
FULL 自動(ログ表示) そのまま実行 そのまま実行
YOLO 自動(サイレント) サイレント サイレント

最初にやりがちな失敗が、いきなり全自動で回して「あれ、なんか変なことしてる」となるパターンです。僕も最初はそうでした。

おすすめは、最初の1週間はSAFEのまま使うことです。 エージェントがどんな判断をするのか、癖を掴んでから徐々に緩めていく。車の仮免許みたいなものです。

Trust governance

こんなときに便利: 初めて触るリポジトリや、壊したらシャレにならない本番コードを触るときはSAFEのまま。逆に、毎回同じ定型リファクタを回すだけならFULLにして放っておけます。

権限は「信頼のレベル」で変えるもの。最初から全開にしないのがコツです。

2. /waterfallでエージェントの頭の中を覗く

エージェントを使っていて一番ストレスなのは、「今、何をしているんだろう」というブラックボックス感です。

/waterfallと打つと、エージェントの思考ステップやツールの実行が、時系列のタイムラインで見られます。

Live execution waterfall

どこで時間がかかっているかが一目瞭然なので、「このツール呼び出しで詰まっている」と原因の特定ができます。

こんなときに便利: エージェントが遅い・変な動きをするとき。ウォーターフォールを見れば、プロンプトのどこを直すべきかも見えてきます。デバッグのつもりが、いつの間にかプロンプト改善の練習になっています。

見えないものは信用できない。見える化は安心の近道です。

3. モデル選びで迷ったら、まずOllamaから始める

AndromityはClaude、GPT-4o、Gemini、DeepSeek、Groq、OpenRouterなど396種類以上のモデルに対応しています。選択肢が多すぎて迷う、という声ももらいます。

396+ models

僕のおすすめはシンプルです:

  • まずOllamaで試す → 完全無料・完全オフライン。コードが外部に出ません
  • 慣れてきたらClaudeやGPT-4o → 本番のコードに向き合うとき
使い方 おすすめモデル コスト
とりあえず試す・学習用 Ollama(ローカル) 無料
日常のコーディング Claude / GPT-4o(BYOK) API従量課金のみ
社内規定で外部送信NG Ollama(ローカル) 無料

こんなときに便利: 学生さん、とにかく無料で試したい人、会社のコードを外部APIに送れない人。僕も普段は「Ollamaで試して、本番はClaude」という使い分けをしています。

お金をかける前に、無料で「信頼の育て方」を練習できます。

4. /undoがあるから、怖がらずに任せられる

エージェントに仕事を任せられない最大の理由は、「失敗したらどうしよう」という恐怖です。

Andromityには/undoがあります。エージェントの1ターン分の変更を、まとめて元に戻せます。gitの履歴は汚しません。

# エージェントの作業が気に入らなかったら
/undo

こんなときに便利: 「あ、違う指示だった」と気づいた瞬間に戻せる。失敗のコストがほぼゼロになると、不思議と大胆に任せられるようになります。怖がらずに任せられるのは、この機能があるからです。

巻き戻しがあるゲームは、思い切って遊べます。

5. /cronで「めんどくさい」を夜間に押し付ける

Andromityにはスケジューラーが内蔵されています。地味ですが、個人的に一番気に入っている機能です。

/cron → "毎晩2時に pytest を回して、失敗したら直してコミット" → 0 2 * * *

朝起きたら、直ったコードがコミットされている。派手さはないですが、効きます。

こんなときに便利:

  • 毎朝の定型チェック(テスト、Lint)
  • 依存パッケージの更新確認
  • 夜間に回したい重いテスト

小さな「めんどくさい」を全部エージェントに押し付けられます。信頼モードと組み合わせれば、夜間はFULL、日中はSAFEという使い分けもできます。

エージェントの真価は、あなたが寝ている時間に発揮されます。

6. 大きい変更はプランモードで「合意」してから書かせる

いきなりコードを書かせるのではなく、まず計画を立てさせて、合意してから実行させる。これだけで事故率が体感でかなり下がります。

Planning mode

プランモードは、いわばエージェントとの合意形成ツールです。「この方針で進めていい?」と聞かれた段階で方向性を修正できるので、手戻りが減ります。

こんなときに便利: 新機能の実装、複数ファイルにまたがるリファクタ、設計判断が必要な作業。5分の合意が、1時間の手戻りを防ぎます。

❌ 悪い例:いきなり「この機能作って」と投げる
✅ 良い例:プランモードで方針を確認 → 承認してから実行

書かせる前に、考えさせる。合意は最強のバグ予防です。

7. 日本語IMEの入力問題を直した話

これは機能紹介というより、作者としての向き合い方の話です。

v0.2.8では、日本語IMEの入力問題(変換中にEnterで誤送信されてしまう問題)を修正しました。日本のユーザーにとっては地味に致命的なバグで、報告をもらってすぐ直しました。

まだ小さなプロジェクトですが、こういう「その言語の人が毎日触る部分」は大事にしていきたいと思っています。日本語のドキュメント整備も進めているところです。

こんな人に: 日本語環境でAIコーディングツールを使っていて、IMEの挙動にイライラしたことがある人。ぜひ試して、気づいたことがあればIssueで教えてください。

小さなバグに真剣な作者は、大きなバグにも真剣です。

信頼モードの選び方(判断フロー)

7つのTipsを踏まえて、モード選びの判断フローをまとめました。コピペして使ってください。

Q1. このリポジトリ、初めて触る?
  → YES → SAFEモードで開始(1週間は様子見)
  → NO  → Q2へ
Q2. 壊したらシャレにならないコード?
  → YES → SAFEのまま(承認は手間に見えて保険)
  → NO  → Q3へ
Q3. 毎回同じ定型作業?
  → YES → FULLモード + /cronで自動化
  → NO  → TRUSTモードで様子見、慣れたらFULLへ

言えないこと(正直に書きます)

トップ記事の流儀に倣って、「測っていないこと・言えないこと」も書きます。これが一番大事だと思っています。

  • まだGitHubスター20ほどの小さなプロジェクトです。 バグもあります。寛大な目で見てもらえると嬉しいです
  • Claude CodeやCursorとの厳密なベンチマーク比較はしていません。 「速い」「安い」とは言いません。測っていないことは測っていないと書きます
  • トークンコストの実測データはまだありません。 BYOKなのでコストはモデル次第、とだけお伝えします
  • 日本語ドキュメントは整備中です。 英語が中心ですが、日本語READMEはあります
  • Windows対応は後発で、検証が薄めです。 Windowsユーザーのフィードバックを特に歓迎します

まとめ

  • AIエージェントの怖さは「勝手に書き換えられること」。Andromityは信頼モードでブレーキをかけられる設計です
  • 最初はSAFE(仮免許)で始め、慣れたら徐々に緩めるのがコツ
  • /waterfallで思考を見える化、/undoで失敗を恐れず、/cronで夜間に働かせる
  • プランモードで合意してから書かせる=最強のバグ予防
  • Ollamaなら完全無料・完全オフラインで始められます
  • まだ小さなプロジェクト。正直に育てていきます

エージェントは速くあるべき。でも、速さより大事なのは「いつでも止められる」ことです。

参考

スター1つ、Issue1つでも、作者としてめちゃくちゃ励みになります。特に日本語環境での不具合報告は大歓迎です。

読んでいただき、ありがとうございました!

検証環境

  • Andromity v0.2.11(2026-09-25リリース)
  • 記事執筆日:2026-09-27
  • 動作確認:Linux / macOS / Windows

0
0
0

Register as a new user and use Qiita more conveniently

  1. You get articles that match your needs
  2. You can efficiently read back useful information
  3. You can use dark theme
What you can do with signing up
0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?