これは、安定拡散について学び、このツールの使い方を教えるためのガイドです。
上記の画像は安定拡散法で生成されています。これは以下のテキスト(プロンプト)から生成されました。
スタニスラフ・シドロフによる高層ビル群のある街並み、デジタルアート、超リアル、超詳細、フォトリアリスティック、4K、キャラクターコンセプト、ソフトライト、ブレードランナー、未来的
Stable Diffusionは、テキストから画像を生成する機械学習モデルです。入力として入力されたテキストから画像を生成する人工知能のディープラーニングモデルです。
このスタイルの最初のモデルでもツールでもありません。現在、Dall-e 2、MidJourney、Google Image などが話題になっていますが、Stable Diffusion が代表的であることから、最も重要なモデルです。Stable Diffusion はオープンソースプロジェクトなので、誰でも利用・改変できます。バージョン1.4では、事前学習済みモデル全体が収録されている4G .cpxtファイルが提供されており、これはまさに革命的なことです。
リリースからわずか2、3週間で、Photoshop、GIMP、Krita、WordPress、Blenderなどのプラグインが登場し、画像を扱うほぼすべてのツールがStable Diffusionを実装しています。Midjourneyのような競合他社でさえ、ツールの強化にStable Diffusionを採用しています。しかし、Stable Diffusionはツールの生成だけでなく、ユーザーがPCにインストールして実行することで、ローカルで画像を取得することもできます。
オープンソースだからといって、以前のものより機能が劣るわけではありません。本当に素晴らしいツールです。私にとって、今のところ、あらゆるプロジェクトで画像を生成したい場合に最適なツールです。
Stable Diffusionのインストールと使用方法
使い方はいくつかありますが、今のところ2つ目の方法をおすすめします。お使いのコンピューターに必要なパワー、つまり8GB程度のRAMを搭載したグラフィックカードがあれば、インストールしてください。ハードウェアの性能が十分でない場合は、Google Collabをご利用ください。今のところは、グラフィカルインターフェースが付属していて使いやすいAltryneのものをおすすめします。
詳細に踏み込む。
アルトラインのコラボ
これは、コンピューターの性能が十分でない場合 (GPU と 8GB の RAM)、または何もインストールせずにすべての機能を試してみたい場合に推奨されるオプションです。
このツールは、画像や、画像間変換、アップスケールなどの他のモデル ツールを制御するための多くのオプションを備えた非常に快適なグラフィカル インターフェイスを備えているため、お勧めします。
モデルと結果の保存には、Altryneが作成したGoogle ColabとGoogle Driveを使用します。
すべて無料です。手順全体を説明した動画を添付しましたので、ご覧いただければお分かりいただけると思いますが、とても簡単です。
続きを読む