top of page

【キャラクターを創り動かす】画像・動画生成AI スタートガイド体験記①〜環境構築と画像生成の基礎〜 #SG26

55 分前
読了時間: 11分

AICU編集部より 本記事は、『【キャラクターを創り動かす】画像・動画生成AI スタートガイド』(通称:SG26)を実際に購入いただいた「あも🌙」さんによる体験記です。 すでにComfyUIやLoRA制作にも挑戦されているあもさん。一方で、「なんとなく動かせる」から一歩進んで、画像・動画生成AIの基礎をあらためて学び直していく過程を、初心者目線でそのまま寄稿いただきました。



あも🌙さん ( X@amo_ai_jp )



⭐︎本記事は読者のご寄稿を確認して、出版権利を侵害しない引用として編集部が画像等を許諾・追記した内容となります。また執筆時点での寄稿者の環境・体験に基づくものですので、実際に試す際は書籍の引用元記載に加え、各ツールの最新情報・利用規約等もあわせてご確認ください。



『画像・動画生成AI スタートガイド』好評発売中 — 全7章320ページでキャラクターを創り、動かす



j.aicu.ai _ComfyUI・LoRA・ControlNet から Wan2.2 と Seedance の動画生成まで。設定画1枚からキ_



https://j.aicu.ai/SG26



はじめに



先日、イベントにて購入させていただいた「【キャラクターを創り動かす】画像・動画生成AI スタートガイド」



これからこの書籍の内容に沿って、AI超初心者の私が実際に手を動かしながら、基礎・基本を学んでいこうと思います。



一応、ComfyUIを触って自作LoRAまで作成できる段階ではありますが、正直基礎・基本は本当に理解していません。なぜなら、勢いだけで始めて何もわからないまま、全部ClaudeチャットやChatGPTに作業を投げまくっており…私が自分の手で作業したことがほとんどないからです…!



こちらの記事の中でも、記載したとおり「なぜそうなるのか?」「どうしてそうなるのか?」 という根底を知ることが大切だと感じているので、ただ画像生成ができるだけでなく、しっかり土台から学んでいこうと思います。



また、動画生成に関しては、ずっとやろうと思いながらできていなかったので、初挑戦します!!



私もまだ分からない側ですので、ぜひこの記事をご覧の方も一緒にやってみましょう☺️?



Chapter1:生成AIの基礎知識を身に付けよう



第1章は、生成AIを始める前に必要な基礎知識の部分です。 こちらは手を動かすというより、実際に書籍を読んで学んでいきます。



**・画像生成AIって、そもそも何?! ・どんな生成AIがあって、それぞれどんな役割を担っているの? ・どんな歴史があるの? ・この素材って自由に使ってもいいの?



**などなど…今更聞けない、生成AIの基本的な内容が書かれています。



そして、特に見ておいてほしい箇所が 「生成AIの歴史に関する事項」 と「ライセンスや利用規約に関する事項」



生成AIの歴史については、先日のイベントの際にも、著者の白井さんもお話しされていたのですが、2022年8月22日に「Stable Diffusion」が全世界にオープンに公開された ことによってAIの常識が大きく塗り替えられ、今の生成AIの進化に繋がっているんです。ChatGPTが開始したのは、その後の2022年11月。



これを知っておくことによって、より画像・動画生成AIに対する見方が変わってきます。



また、ライセンスや利用規約に関する事項については、今後自分の生成した作品を世に出すにあたって、守らなければいけない事項が詳しく記載されています。使うモデルごとに規約は異なるので、自分の目で確認してくださいね!



ルールを守ることは自分自身を守ることとなるので、しっかり押さえておくと良いです!



Chapter2:画像と動画を生成する準備を整えよう



第2章からは、画像と動画を生成する準備を整えるための環境構築に関する内容です。環境構築にあたり必要な用語と、構築方法が記載されています。使用するOSS(オープンソースソフトウェア)は、Forge WebUIとComfyUIです。



上記のOSS(オープンソースソフトウェア)のように、超初心者には見慣れない単語や英字が並んでくるのですが…最初はなんとなく「そんな言葉があるんだ〜」くらいに考えて、 簡単にメモを取ってみてください。作業をしながらメモを読み返して、単語を覚えていく流れが良いかなと思います。



また、作業に関しては著者のざすこさんのYouTube動画と一緒にやってみると、わかりやすいですよ♩



【ローカル環境ver.】



【クラウド環境ver.】



私は、既にある程度のローカル環境の構築は終わっているのですが、約1ヶ月前に野生の勘とClaudeに質問投げまくりながら、何も理解せずに設定しました(笑)



今、書籍と当時のClaudeとのチャット履歴を読みながらやっと意味を理解したところです!(本当に今更)



一応、本の内容どおりに進めてみたのですが、特にエラーや問題が起きることなくスムーズに進みました☺️



========= ⚠️注意ポイント ⚠️ 基本は全てWindows を使用する前提で、内容が書かれています。



もし今持っているPCがMacで、そのまま始めたい場合、ローカル環境では対応していないものが多いです。(書籍:P40〜P65の内容)



ご自身のPCスペックを確認の上、Macを使用する方は、クラウド環境での構築(書籍P66〜P77/78)を読んで環境構築をするのが、オススメです! =========


【あも🌙の独り言】 画像生成AIってWindowsを使うのが常識なのかな…!?(無知) それに私の持っているPCだとクラウド環境の方が明らかにスムーズに進むのに…「まだ初心者だからいいか〜」という気持ちで、今までずっとローカル環境で無課金のまま…信じられない低速で画像生成をやっていました…。 ローカル環境のままだと今後動画生成なんて100%無理そうなので、今回を機にクラウド環境に変えようと思います🫠


Chapter3:画像を生成してみよう



第3章から、お楽しみの画像生成です♩



ここからは技術的な内容になってくるので、内容が盛りだくさん! セクションごとに分けて、体験談を書いていこうと思います!



3-1:画像生成を始めよう



このセクションは、画像生成前の事前知識としてStable Diffusionで「できること」と「できないこと」を理解していく内容となっています。



最近は高度な画像生成AIがあるので、なんでもできると思いがちですが、意外とそんなことない です。



私は今までこの内容を知らなかったので… これまでComfyUIを触っている中で「なんでできるはずなのにうまく生成 してくれないの!?」「何度も修正しているのに、何が悪いのかわからないよ〜…」と嘆いていました(笑)



今この書籍を読んで、根本的に「出来ないことがある」ということを理解し、「出来ないなら、どうしようか?」と考えること ができました。本の内容にも「出来ないこと」を補う手法が載っているので、とても参考になります。



3-2:テキストから画像を生成してみよう



このセクションでは、Forge WebUIの配置確認と基本的な使い方の説明が書かれています。



配置確認の項目で「Sampling method」とか「CFG scale」とか「Seed」とか…超初心者には意味不明な単語が出て少し不安になると思うのですが、大丈夫です。安心してください。



この後のセクションで手を動かしながら、どのようなものか理解していく段階があります。見慣れない単語って怖いですが、これも「なんかそういうものがあるんだな〜?」 と気軽にみてください☺️🌸



それを踏まえて、私も画像生成をやってみました!



サンプルプロンプトを入力して、パラメーターを設定! そして、「Generate」ボタンを押すと…



やった〜!!!!可愛い女の子が、出てきた♩ 気になるところはありますが、一旦「できた!」という気持ちだけでヨシっ😉!



次は少量のプロンプトを追加して、もう一枚!!



おお〜〜!!!指定通りのイラストが爆誕 😭!! すごくテンション上がります!!!



これが自分で作り上げる画像生成の「はじめの一歩」になるんですね!



3-3:拡張機能を導入して、快適に生成しよう



このままでも使用可能なのですが、より快適に生成作業を行うために、様々な「拡張機能」が用意されているとのこと。



この本の中では、初心者のうちから入れておくと便利なおすすめの拡張機能3つ の導入手順が説明されています。



========= 🌸嬉しいポイント 🌸 クラウド環境を利用かつ、この本から提供されているNotebookを利用する場合 は、環境構築時に既におすすめの拡張機能3つとも組み込まれているので、このセクションでのインストール作業は不要 とのことです!(やったー!) =========



早速、この拡張機能を利用して、もう一枚画像生成をしてみました!



さっきよりも顔のパーツや目の描き込みが、綺麗になりましたね💫✨ 今回導入されている拡張機能を大まかに言うと…


・メジャーなプロンプトをタブやボタンで選択入力ができるよ! しかも日本語文章を入力して、英語への変換も可能! ・画像生成の縦横比や生成設定を保存して、1クリックで呼び出せちゃう! ・顔や指、その他の気になる部分の補正ができちゃうよ!


…というものです!



上のイラストもそれぞれのジャンルのタブから、生成したいイメージのプロンプトをボタンでポチっ!と、さらに補正の選択をしてサクッと作り上げる事ができました☺️!なんて、ありがたい機能なんでしょう…(感動の涙)



3-4:画像生成におけるプロンプト入力の基本



こちらはタイトルの通り、プロンプトについての基本的な内容が書かれています。



生成AIを少し触っている方なら、よく耳にする"プロンプト"ですが、普通のチャットと画像生成では書き方が全然違います。書き方が違えば、指示も変わってくるので、「どのように書く必要があるのか?」という基礎を具体的な例を用いて、説明がされています。



今までの私は、Claudeにチャットで生成したい内容を説明して、必要なプロンプトを出してもらい、そのまま何も考えずにコピペして作業していました…。



この基礎を読んで、「これってこういう意味だったの!?」「そしたら、もっとこうしたら良いのか!」と考える事ができて、本当に助かっています。



自分の好みや依頼のイラストを作るにあたり、一番重要な部分になるのではないかと思います。学習のテクニックや、他からの学びのコツも合わせて記載されているので、とても参考になりました!



3-5:パラメーター調整をしてみよう



こちらでは、各種パラメーターの詳しい説明がされています。



「3-2:テキストから画像を生成してみよう」の配置確認の項目で、「Sampling method」とか「CFG scale」とか「Seed」とか…ちょっと意味がわからない単語が出てきましたよね!



この詳しい説明も、このセクションに記載されています。



まだ理解が浅いと、内容が重く感じられるかもしれません。なので、一つずつ内容を読む→手を動かして確かめる→結果をメモして内容を理解する といった流れで、丁寧にやっていくと良いかなと思いました!



これをどこまで丁寧に行って理解をするかで、今後イラスト品質の向上と調整技術に大きく影響するかと…本当に丁寧に勉強してください、ここは。(自戒の意)



3-6:画像の崩れを修正しよう



ここでは、生成した画像の「崩れ」を見つけて修正する方法についての説明が書かれています。



「3-3:拡張機能を導入して、快適に生成しよう」の段階で、初めに生成した画像より顔のパーツや目の描き込みが、綺麗になっていましたよね。このように補正を行うことでも、イラストのクオリティに差をつける事ができます。



このセクションの中では、3つの段階に分けて対応する方法が紹介されています。



実際に、私が以前に生成したイラストで「崩れ」を修正していない場合と修正した場合で、違いを見比べてみましょう。(※以下のイラストは、ComfyUIのDetailerで修正しております、比較の参考として見てください)



【修正前】



【修正後】



顔まわりや目、小物などが、はっきりと描かれるようになりましたね!イラストの質がかなり違うことがわかります。



しかし、手(特に右側の下ろしている方)にはまだ若干の破綻があります。生成時に完全に破綻を防いだり、修正することは難しいです…このイラストはまだ許容範囲だと思っていますが、もし細かいところが気になる場合は、本に記載の方法で試してみると良いですよ♩



私は、この綺麗になる瞬間がめっちゃ好きです💖



ここまで体験した感想



一旦ここまで(第3章まで)が、画像生成の基本の流れでした。 このnote記事を書きながら作業して、かかった時間は半日程度です。



正直なところ、私はせっかちで効率厨で完璧主義のめんどくさがり屋なので、手間だなと感じたところは環境構築ですね(笑)



初めて画像生成するよ!という方や、クラウド環境で初めて画像生成やってみる!という方は、Google Colabを見ただけで「何これ〜〜〜😭!?」となるかもしれないです…!!!(実体験)



でも、しっかりと本の手順に沿ってやっていけば、何も怖いことはありません。エラーになった時も「どこか自分のやった手順が間違っているんだな」と冷静になって、戻ったり進んだりしていけば、必ずできます!



そして、第3章に入って実際に画像生成をしてみると、すごく楽しいです! 簡単に思いついたイメージがパッと出てくるので!



ですが、わたし的には手を動かすだけではなく、理解してくことがこの本の真髄 だと思います。



私は、今までなんとなくClaudeと繋いで「指示もらったから、こうやってみるか〜!ポイっ!」といった感覚で画像生成を行なっていたので、本当に理解不足な点が多くあり、悩んでいたところもありました。それを一つずつ紐解くように、基礎を学び、理解していくことで、今まで拭いきれなかった悩みやモヤモヤが少しずつ消えていきました。



「基礎の大切さ」 を身に染みて感じています。



第4章からはオリジナルキャラの作成に入ります。 前半と同様に一部内容は既に自分でも行なった事あるのですが、改めて学び直していきます!また、ずっとやってみたかった動画生成にも進んでいきます🌟



とりあえず、この段階でもとっても楽しいです♩



最後に



この記事を見て「画像・動画生成をやってみたい!」と思う方が増えて、はじめの一歩が踏み出せると良いなと思います!



参考になれば、嬉しいです☺️🌸 次回の体験記②もお楽しみに〜!!!



AICU編集部より 「AIを使える」と「なぜそうなるのかを理解して使える」は、似ているようで少し違います。今回の体験記は、すでに生成AIを触っている人にとっても、一度基礎へ戻ってみる面白さが伝わる内容になりました。



SG26は、このあとオリジナルキャラクター制作、LoRA、そして画像から動画へと進んでいきます。あも🌙さんの「体験記②」も、引き続きお楽しみに。



『【キャラクターを創り動かす】画像・動画生成AI スタートガイド』についてはこちら <https://j.aicu.ai/SG26>


 
 
 

コメント


bottom of page