
ComfyUIでAuraFlowを使う方法です。
モデル導入とワークフローの読み込み、生成例などを紹介しています。
AuraFlowとは?
AuraFlowは、falと開発者のSimoらが開発した、約68億パラメータのテキストから画像を生成するモデルです。
Rectified Flowという方式を採用し、入力した文章を手がかりに、ランダムなノイズを段階的に画像へ変換します。
学習用の画像には詳しい説明文を付け直しており、文章で指定した被写体や属性、位置関係を画像に反映することを重視したモデルです。
開発元の公開例では、箱の中身と左右の配置を指定するなど、複数の条件を含むプロンプトで追従性を示しています。
主な特徴
- 文章による画像生成:被写体だけでなく、色・背景・配置などを文章で指定
- Transformerを採用:テキストと画像の情報を扱うMMDiTとDiTを組み合わせた構造
- オープンなモデル:モデルの重みと推論コードを公開
- v0.3の追加学習:v0.2から、美的品質を重視したデータセットでさらに学習
- 縦長・横長の画像に対応:v0.3は複数のアスペクト比に対応し、幅・高さは最大1536ピクセル


ライセンス
AuraFlow v0.3のライセンスはApache-2.0です。
ComfyUIのインストール
ComfyUIをまだインストールしていない方は、こちらを参考にしてみてください。

必要なモデルのダウンロードと配置
モデルはaura_flow_0.3.safetensorsだけで生成できます。
| 種類 | ファイル名 | 配置先 |
|---|---|---|
| チェックポイント(comfy_workflow) | aura_flow_0.3.safetensors | ComfyUI/models/checkpoints/ |
ComfyUI/
└── models/
└── checkpoints/
└── aura_flow_0.3.safetensors
ワークフローの読み込み
テキストから画像を生成する公式ワークフローは、comfy_workflow.jsonです。
ダウンロードしたJSONファイルをComfyUIにドラッグ&ドロップしてください。
Civitaiでもダウンロードできます。
AuraFlowで画像生成する方法
まずLoad CheckpointでAuraflowモデルを指定します。

CLIP Text Encode (Prompt)に生成したい画像を自然言語で入力します。
上がpositive・下がnegativeです。
negativeは空欄でも生成可能ですが、除外したい要素があれば入力してください。

Empty Latent Imageで生成サイズも変えられます。

その他step数などのパラメータはKsamplerで調整可能です。

結果
生成速度は全て50~60秒でした。(RTX4060Ti VRAM16GB/RAM64GB)
プロンプトの忠実性が高いとのことなので、GPTにプロンプトと確認部分を出してもらい検証してます。
・SF系

プロンプト:
a futuristic city skyline at night with neon lights reflecting on wet streets,
a humanoid robot standing near a glowing hovercar,
and a giant holographic billboard showing a human face in the distance,
under a dark cloudy sky with lightning streaks
濡れた路面にネオンが反射する、未来的な夜の街並み。
光るホバーカーの近くに立つ人型ロボット。
遠くに人間の顔を映し出す巨大なホログラフィック広告板。
稲妻が走る暗い曇り空の下。| 確認項目 | プロンプトの指定 | 確認する内容 |
|---|---|---|
| 背景 | futuristic city skyline at night | 近未来的ビル群・夜景があるか |
| 照明 | neon lights reflecting on wet streets | 濡れた路面の反射表現があるか |
| 主体 | humanoid robot | 人型ロボットが認識できるか |
| 位置関係 | near a glowing hovercar | ロボットの横に車があるか |
| 遠景 | holographic billboard showing a face | 看板に顔やホログラムが見えるか |
| 空 | dark cloudy sky, lightning streaks | 雷や雲が確認できるか |
顔だけ看板じゃなくて空に映ってますがそれ以外はほぼ再現できてると思います。
・ファンタジー系

プロンプト:
a medieval castle on a floating island surrounded by waterfalls,
a white dragon flying above,
a knight in silver armor standing on a cliff with a glowing sword,
and a crescent moon shining in the twilight sky
滝に囲まれた浮島に建つ中世の城、
上空を舞う白い竜、
崖の上に輝く剣を持った銀の鎧をまとった騎士、
そして夕暮れの空に輝く三日月。| 確認項目 | プロンプトの指定 | 確認する内容 |
|---|---|---|
| 中心 | floating island with castle | 浮遊島+城が見えるか |
| 周囲 | waterfalls | 滝が周囲にあるか |
| 上空 | white dragon flying above | 白いドラゴンが空にいるか |
| 前景 | knight with glowing sword on cliff | 騎士が崖の上に立ち剣が光っているか |
| 空 | crescent moon in twilight | 三日月と夕暮れの空 |
白いドラゴンの頭が剣、尻尾が三日月になっちゃってる以外は問題なさそうです。
・リアル系

プロンプト:
a realistic portrait of a young woman sitting by a window with soft morning light,
wearing a beige sweater,
holding a cup of coffee,
with a book open on the table beside her,
background blurred like a professional photograph
柔らかな朝の光が差し込む窓辺に座る若い女性の写実的な肖像画。
ベージュのセーターを着て、
コーヒーカップを持ち、
隣のテーブルには本が開かれている。
背景はプロの写真のようにぼかされている。| 確認項目 | プロンプトの指定 | 確認する内容 |
|---|---|---|
| 主体 | young woman | 女性人物が中心か |
| 姿勢 | sitting by a window | 窓際に座っているか |
| 照明 | soft morning light | 柔らかい朝の光があるか |
| 小道具 | cup of coffee / book on table | コーヒーと本が見えるか |
| 質感 | background blurred | 被写界深度(ボケ)効果があるか |
コーヒーじゃなくて本を持っているのと座っているかちょっと怪しいですが、それ以外は問題なさそうです。
・アニメ系

プロンプト:
an anime-style illustration of a cheerful girl with long blue hair wearing a sailor uniform,
standing on a rooftop during sunset,
with the city skyline glowing in orange and pink hues,
her hair flowing in the wind
セーラー服を着た、青い長い髪の元気な女の子が
夕暮れの屋上に立ち、
街のスカイラインがオレンジとピンクに輝き、
風になびく髪を描いたアニメ風のイラスト| 確認項目 | プロンプトの指定 | 確認する内容 |
|---|---|---|
| スタイル | anime-style illustration | 絵柄がアニメ調か |
| 主体 | cheerful girl with long blue hair | 青髪の少女が笑顔か |
| 服装 | sailor uniform | 制服の形状があるか |
| 場所 | rooftop with city skyline | 屋上と街並みが背景にあるか |
| 照明 | sunset / orange-pink hues | 夕焼けの色味があるか |
| 動き | hair flowing in wind | 髪が風でなびいているか |
指定したものについては全て再現できていると思います。
ただ指とか服とか人体のバランスとか若干崩れてる気がしました。
・ファンタジー系のプロンプトを他のモデルと比較
ファンタジー系だけAuraflowだと崩れ気味だったので他モデルでどうなるか試してみました。
左からAuraflow、Qwen、Flux、Illustriousです。

Qwenはほぼ完ぺきで剣だけ持ってません。
ただwith a glowing swordなのでこれはプロンプトが悪い気もします。
Fluxは夕暮れ感が人によって評価変わりそうですが、ほぼ全部反映されており、Illustriousも滝以外はほぼ生成できていました。
まとめ
現在の主流なモデルと比べるとちょっとクオリティは劣ってしまう気がします。
生成速度もAnimaが30stepで約27秒なことを考えると、そこまで速くもありません。
独自の方式を採用していることもあり、派生モデルも少ないので、26年以降だと使いどころが少し難しい印象でした。
以上Auraflowについて紹介しました。
参考になれば幸いです。

