【ComfyUI】AuraFlowの使い方|モデル導入・ワークフロー・生成例

AuraFlowで生成したネオン街と空に浮かぶ青い顔のホログラム

ComfyUIでAuraFlowを使う方法です。

モデル導入とワークフローの読み込み、生成例などを紹介しています。

AuraFlowとは?

AuraFlowは、falと開発者のSimoらが開発した、約68億パラメータのテキストから画像を生成するモデルです。

Rectified Flowという方式を採用し、入力した文章を手がかりに、ランダムなノイズを段階的に画像へ変換します。

学習用の画像には詳しい説明文を付け直しており、文章で指定した被写体や属性、位置関係を画像に反映することを重視したモデルです。

開発元の公開例では、箱の中身と左右の配置を指定するなど、複数の条件を含むプロンプトで追従性を示しています。

主な特徴

  • 文章による画像生成:被写体だけでなく、色・背景・配置などを文章で指定
  • Transformerを採用:テキストと画像の情報を扱うMMDiTとDiTを組み合わせた構造
  • オープンなモデル:モデルの重みと推論コードを公開
  • v0.3の追加学習:v0.2から、美的品質を重視したデータセットでさらに学習
  • 縦長・横長の画像に対応:v0.3は複数のアスペクト比に対応し、幅・高さは最大1536ピクセル
Introducing AuraFlow v0.1, an Open Exploration of Large Rectified Flow Models
Open-source AI is in jeopardy. As community interest in AI models skyrocketed over the past year, we noticed that develo…
fal/AuraFlow-v0.3 · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.

ライセンス

AuraFlow v0.3のライセンスはApache-2.0です。

AuraFlow v0.3のライセンス全文

ComfyUIのインストール

ComfyUIをまだインストールしていない方は、こちらを参考にしてみてください。

【ComfyUI】の使い方・始め方まとめ|インストールから基本操作・カスタムノードまで
ComfyUIを始めたいけど、インストール方法がいくつかあってどれを選べばいいか迷う、という方は多いと思います。この記事では、ComfyUIの導入方法の違いと選び方、そして基本的な使い方の入口をまとめて紹介します。各トピックの詳しい手順は、…

必要なモデルのダウンロードと配置

モデルはaura_flow_0.3.safetensorsだけで生成できます。

種類ファイル名配置先
チェックポイント(comfy_workflow)aura_flow_0.3.safetensorsComfyUI/models/checkpoints/
ComfyUI/
└── models/
    └── checkpoints/
        └── aura_flow_0.3.safetensors
fal/AuraFlow-v0.3 · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.

ワークフローの読み込み

テキストから画像を生成する公式ワークフローは、comfy_workflow.jsonです。

ダウンロードしたJSONファイルをComfyUIにドラッグ&ドロップしてください。

Civitaiでもダウンロードできます。

AuraFlow – Comfy Workflow | AuraFlow Checkpoint | Civitai
Originally posted on Huggingface . AuraFlow is the fully open-sourced largest flow-based text-to-image generation model….

AuraFlowで画像生成する方法

まずLoad CheckpointでAuraflowモデルを指定します。

CLIP Text Encode (Prompt)に生成したい画像を自然言語で入力します。

上がpositive・下がnegativeです。

negativeは空欄でも生成可能ですが、除外したい要素があれば入力してください。

Empty Latent Imageで生成サイズも変えられます。

その他step数などのパラメータはKsamplerで調整可能です。

結果

生成速度は全て50~60秒でした。(RTX4060Ti VRAM16GB/RAM64GB)

プロンプトの忠実性が高いとのことなので、GPTにプロンプトと確認部分を出してもらい検証してます。

・SF系

AuraFlowのSF作例:雨のネオン街に立つロボットと青い顔のホログラム
プロンプト:
a futuristic city skyline at night with neon lights reflecting on wet streets,
a humanoid robot standing near a glowing hovercar,
and a giant holographic billboard showing a human face in the distance,
under a dark cloudy sky with lightning streaks

濡れた路面にネオンが反射する、未来的な夜の街並み。
光るホバーカーの近くに立つ人型ロボット。
遠くに人間の顔を映し出す巨大なホログラフィック広告板。
稲妻が走る暗い曇り空の下。
確認項目プロンプトの指定確認する内容
背景futuristic city skyline at night近未来的ビル群・夜景があるか
照明neon lights reflecting on wet streets濡れた路面の反射表現があるか
主体humanoid robot人型ロボットが認識できるか
位置関係near a glowing hovercarロボットの横に車があるか
遠景holographic billboard showing a face看板に顔やホログラムが見えるか
空dark cloudy sky, lightning streaks雷や雲が確認できるか

顔だけ看板じゃなくて空に映ってますがそれ以外はほぼ再現できてると思います。

・ファンタジー系

AuraFlowのファンタジー作例:滝が流れる浮島の城と白いドラゴン
プロンプト:
a medieval castle on a floating island surrounded by waterfalls,
a white dragon flying above,
a knight in silver armor standing on a cliff with a glowing sword,
and a crescent moon shining in the twilight sky

滝に囲まれた浮島に建つ中世の城、
上空を舞う白い竜、
崖の上に輝く剣を持った銀の鎧をまとった騎士、
そして夕暮れの空に輝く三日月。
確認項目プロンプトの指定確認する内容
中心floating island with castle浮遊島+城が見えるか
周囲waterfalls滝が周囲にあるか
上空white dragon flying above白いドラゴンが空にいるか
前景knight with glowing sword on cliff騎士が崖の上に立ち剣が光っているか
空crescent moon in twilight三日月と夕暮れの空

白いドラゴンの頭が剣、尻尾が三日月になっちゃってる以外は問題なさそうです。

・リアル系

AuraFlowのリアル作例:窓辺で本を持つベージュのセーター姿の女性
プロンプト:
a realistic portrait of a young woman sitting by a window with soft morning light,
wearing a beige sweater,
holding a cup of coffee,
with a book open on the table beside her,
background blurred like a professional photograph

柔らかな朝の光が差し込む窓辺に座る若い女性の写実的な肖像画。
ベージュのセーターを着て、
コーヒーカップを持ち、
隣のテーブルには本が開かれている。
背景はプロの写真のようにぼかされている。
確認項目プロンプトの指定確認する内容
主体young woman女性人物が中心か
姿勢sitting by a window窓際に座っているか
照明soft morning light柔らかい朝の光があるか
小道具cup of coffee / book on tableコーヒーと本が見えるか
質感background blurred被写界深度(ボケ)効果があるか

コーヒーじゃなくて本を持っているのと座っているかちょっと怪しいですが、それ以外は問題なさそうです。

・アニメ系

AuraFlowのアニメ作例:夕焼けの屋上に立つ青髪の少女
プロンプト:
an anime-style illustration of a cheerful girl with long blue hair wearing a sailor uniform,
standing on a rooftop during sunset,
with the city skyline glowing in orange and pink hues,
her hair flowing in the wind

セーラー服を着た、青い長い髪の元気な女の子が
夕暮れの屋上に立ち、
街のスカイラインがオレンジとピンクに輝き、
風になびく髪を描いたアニメ風のイラスト
確認項目プロンプトの指定確認する内容
スタイルanime-style illustration絵柄がアニメ調か
主体cheerful girl with long blue hair青髪の少女が笑顔か
服装sailor uniform制服の形状があるか
場所rooftop with city skyline屋上と街並みが背景にあるか
照明sunset / orange-pink hues夕焼けの色味があるか
動きhair flowing in wind髪が風でなびいているか

指定したものについては全て再現できていると思います。

ただ指とか服とか人体のバランスとか若干崩れてる気がしました。

・ファンタジー系のプロンプトを他のモデルと比較

ファンタジー系だけAuraflowだと崩れ気味だったので他モデルでどうなるか試してみました。

左からAuraflow、Qwen、Flux、Illustriousです。

同じファンタジープロンプトの比較:左からAuraFlow、Qwen、Flux、Illustrious

Qwenはほぼ完ぺきで剣だけ持ってません。

ただwith a glowing swordなのでこれはプロンプトが悪い気もします。

Fluxは夕暮れ感が人によって評価変わりそうですが、ほぼ全部反映されており、Illustriousも滝以外はほぼ生成できていました。

まとめ

現在の主流なモデルと比べるとちょっとクオリティは劣ってしまう気がします。

生成速度もAnimaが30stepで約27秒なことを考えると、そこまで速くもありません。

独自の方式を採用していることもあり、派生モデルも少ないので、26年以降だと使いどころが少し難しい印象でした。

以上Auraflowについて紹介しました。

参考になれば幸いです。

タイトルとURLをコピーしました