0
1

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?

ローカルのComfyUIをAIエージェントから動かすSkillを作った(Qwen Image 2.1で実測)

0
Last updated at Posted at 2026-10-10

何を作ったか

自分のマシンで動いている ComfyUI を、AIエージェント(Claude Code など)から使うための Skill comfyui-image-generation を作りました。

エージェントがやることは次の流れです。

  1. 一言の依頼を、画像生成向けの英語プロンプトに書き広げる
  2. ユーザーが書き出した API 形式のワークフローに、プロンプト・シード・サイズを入れる
  3. ComfyUI にノードとモデルファイルが揃っているかを先に確認する
  4. 127.0.0.1 の ComfyUI にジョブを投げ、完了を待って画像を保存する
  5. 保存した画像を開いて、依頼と合っているかを確認する

モデルは Skill が選ぶのではなく、渡したワークフローで決まります。Flux でも Z-Image でも、書き出した API 形式のワークフローを渡せば同じ流れで動く設計です(実測したのは Qwen Image 2.1 だけです)。

安全面で決めたこと

ComfyUI にはログイン機能がないので、次のように絞っています。

  • 接続先は既定で 127.0.0.1 のみ。別のマシンに繋ぐには --allow-remote が必要
  • ComfyUI の起動・停止・再起動、ユーザーのジョブのキャンセルはしない
  • モデルのダウンロード、カスタムノードや pip パッケージのインストールはしない。足りないものは名前を報告して止まる
  • スクリプトは Python 標準ライブラリだけ。画像は指定フォルダにだけ保存し、既存ファイルは上書きしない

実測した環境

項目 内容
ComfyUI 0.39.2
OS / マシン macOS 15.3、Apple M4 Max、統一メモリ 64GB(デバイスは MPS)
ワークフロー Qwen Image 2.1 のテキストから画像(内蔵のプロンプト書き換えスイッチはオフ)
使ったモデル qwen_image_2.1_int8_convrot(本体)、qwen3vl_8b_int8_convrot(テキストエンコーダ)、qwen_image_2.1_vae_bf16(VAE)
設定 3:2、25 ステップ、シード 895035350286699
所要時間 約 175 秒(1 枚)

実際に出た画像

依頼は短い一言で、エージェントが英語プロンプトに書き広げました。出力は赤いヴィンテージ自転車が古いレンガ壁に立てかけてある写真風の画像です(修整なし)。

Qwen Image 2.1 で生成した、古いレンガ壁に立てかけられた赤いヴィンテージ自転車

エージェントが書き広げた英語プロンプト(全文):

A photograph of a red vintage bicycle leaning against an old, weathered brick wall on a quiet cobblestone street in a small European town. The bicycle stands slightly left of center, filling about a third of the frame, with a classic step-through frame, curved handlebars and a leather saddle. Low late-afternoon sun comes from the side, casting warm golden light and long soft shadows across the bricks and cobbles; the muted ochre and terracotta wall contrasts with the saturated red of the bicycle. Empty street with softly blurred old buildings in the background. Natural documentary photography, shallow depth of field, landscape composition, no text, no signs, no lettering.

エージェント自身が画像を見て確認した結果は次の通りです。

  • 合っていた点:赤い自転車、古いレンガ壁、石畳の路地、暖かい横からの光、画面内に文字なし
  • 足りなかった点:プロンプトでは長くやわらかい影を指定したが、画像では影があまり目立たない。車体の後ろ側が少しぼやけている

使う前に必要なこと

  • ComfyUI が起動していること(Skill は起動しません)
  • ワークフローを API 形式で保存していること(設定で開発者向けオプションを有効にし、「Save (API Format)」)
  • ワークフローが使うモデルを、先にすべてダウンロードして所定のフォルダに置いておくこと。Skill は存在確認だけで、足りなければ止まります
  • 新しいモデルは新しいノードを使うことがあり、その場合は ComfyUI の更新が必要です

確認できていないこと

  • 試したのは Qwen Image 2.1 のワークフロー 1 つだけです。他のワークフローは未検証です
  • 1 回の試用です(最初の 1 回は途中で止めたので数えていません)
  • Windows / Linux / NVIDIA GPU では試していません

入手先

AIBars の Skills ディレクトリに掲載しています(MIT ライセンス、AIBars 作)。

スクリプトを実行する Skill なので、使う前に中身を読んでください。

0
1
0

Register as a new user and use Qiita more conveniently

  1. You get articles that match your needs
  2. You can efficiently read back useful information
  3. You can use dark theme
What you can do with signing up
0
1

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?