
W ten weekend skończyło się moje darmowe korzystanie z Midjourney, mojej ulubionej AI do tworzenia obrazów.
Trzeba było więc poszukać alternatyw i sprawdzić, czy któraś jest warta uwagi, czy lepiej przejść na płatny plan narzędzia, którego używam teraz.
Miałem już Stable Diffusion zainstalowane lokalnie, bo to było pierwsze narzędzie, które testowałem, choć podobało mi się mniej niż Midjourney i dlatego prawie go nie używałem.
Była to wersja 1 aplikacji, więc skoro w tym tygodniu głośno zrobiło się o rozszerzeniu ControlNet które pozwala robić całkiem zaawansowane rzeczy, postanowiłem dać szansę wersji 2, żeby zobaczyć, jak pójdzie.
Chociaż jeśli poszukasz w Google przez chwilę, zobaczysz, że istnieją różne metody, ale większość z nich u mnie wysypywała się w którymś momencie.
Ostatecznie znalazłem dwie metody, które zadziałały u mnie bez błędów. Jedna prostsza i druga bardziej ręczna.
W tym artykule wyjaśnię obie: zacznę od łatwej metody (Easy Diffusion) a następnie opiszę metodę ręczną (stworzoną przez Automatic1111), z tą zaletą w drugim przypadku, że pokażę, jak dodać moduł Xformers, który przyspiesza tworzenie obrazu o 30–50%.
Ponadto, żeby domknąć temat instalacji narzędzia, chciałbym niedługo opublikować artykuł wyjaśniający instalację ControlNet.
W ten sposób będziesz mieć do dyspozycji naprawdę solidny arsenał do tworzenia obrazów na miarę, i to całkowicie za darmo.
Ale zanim zaczniemy, jedna ważna rzecz.
Índice de Contenidos del Artículo
- Wymagania PC do korzystania ze Stable Diffusion
- Zainstaluj Stable Diffusion na swoim PC za darmo i łatwo
- Zainstaluj Stable Diffusion na swoim PC ręcznie
- Krok 1: pobierz potrzebne rzeczy
- Krok 2: utwórz folder instalacyjny
- Krok 3: zainstaluj Pythona
- Krok 4: zainstaluj interfejs programu
- Krok 5: wklej pliki z korektorami twarzy
- Krok 6: wklej modele do odpowiedniego folderu
- Krok 7: zainstaluj Git
- Krok 8: wpisz ścieżkę do Pythona
- Krok 9: uruchom instalator programu
- Krok 10: konfiguracja dla PC o „niskich” zasobach
- Krok 11: zamknij program
- Krok 12: ponownie otwórz program
- Czas się pobawić
- Bonus track 1: jak zaktualizować modele do nowych wersji Stable Diffusion
- Bonus track 2: jak łatwo zainstalować moduł Xformers w Stable Diffusion
- Słuchaj, myślę, że to cię zainteresuje
Wymagania PC do korzystania ze Stable Diffusion
Choć do wygenerowania obrazu nie potrzebujesz procesora najnowszej generacji i przy 16 GB RAM można spokojnie działać, są jednak dwa istotne aspekty.
Miejsce na dysku
Modele danych, które pobrałem, ważą od 4 do 7 GB, a do tego trzeba doliczyć resztę kodu. Jeśli masz tylko jeden model, zarezerwuj 15 GB miejsca na dysku. Jeśli masz kilka, cóż, doliczaj kolejne.
To był ten łatwy wymóg.
Drugi wymóg jest bardziej skomplikowany.
Karta graficzna
Wyjaśnię: jeśli chcesz używać tej AI na swoim PC, będziesz potrzebować dobrej karty graficznej. Takiej z co najmniej 4 GB vRAM, a twórcy metod, które opisuję, zalecają, żeby była to NVIDIA.
Można używać kart AMD ze Stable Diffusion, ale aplikacja i system instalacji są inne, jeśli chcesz wycisnąć z nich wydajność.
Jeśli chodzi o modele NVIDIA, powiem ci, że GTX 1650 którą można znaleźć za 70–80 € na Wallapop (i coraz taniej), wystarczy, aleee…
Spełnia tylko minimalne wymagania, które zasadniczo pozwalają uzyskać obrazy w formacie 4:3 o rozdzielczości 512×384 px. Czyli dość małe obrazy.
Aby uzyskać większe obrazy, zalecane są karty z ponad 10 GB vRAM. RTX 3060 z 12 GB to idealny model pod względem ceny i możliwości, bo w marcu 2023 można go znaleźć nowego nieco powyżej 300 € i używanego za około 200 €.
No dobrze, są jednak sposoby, żeby obejść te ograniczenia:
- Jeśli twoja GPU ma te 4 GB vRAM, Easy Diffusion ma domyślnie silnik skalowania, który również działa dobrze.
- Jeśli wolisz użyć metody Automatic1111, możemy użyć Waifu, żeby powiększyć obrazy bez zbyt dużej utraty jakości i wykorzystywać je potem w social mediach lub bannerach, jak wspomniałem w moim poprzednim artykule
- Jeśli GPU w twoim PC nie ma nawet tych 4 GB vRAM, możesz skonfigurować Easy Diffusion tak, żeby używał CPU do generowania obrazu, ale od razu uprzedzam, że wyniki będzie dostarczać dużo wolniej. Spokojnie pół godziny, zależnie od mocy procesora.
Czy warto generować obrazy przez CPU? Osobiście rzuciłbym się na GTX 1650 bez zastanowienia. W zależności od liczby „przejść”, obraz może powstawać na tej karcie od jednej do pięciu minut.
Jeśli dodasz do tego, że rzadko udaje się trafić z promptem za pierwszym razem i że trzeba będzie przetestować kilka, zanim uzyskasz obraz, którego chcesz, policz sobie, ile czasu zajęłoby uzyskanie dobrego obrazu renderowanego przez CPU…
No dobrze, skoro wyjaśniliśmy już, czego potrzebujesz sprzętowo, zacznijmy od łatwej metody instalacji.
Zainstaluj Stable Diffusion na swoim PC za darmo i łatwo
W tej pierwszej metodzie, jak wspominałem wcześniej, skorzystamy z Easy Diffusion, konkretnie z wersji 2.5.
Oryginalny poradnik i jego pliki znajdziesz tutaj:
https://github.com/cmdr2/stable-diffusion-ui#installation
Proces jest dość prosty.
Krok 1: pobierasz instalator dla Windows
- Wejdź w link powyżej.
- Przewiń w dół, aż zobaczysz ten obraz:

- Kliknij przycisk Windows.
- Pobierze się plik „stable-diffusion-ui-windows.zip”:

Krok 2: rozpakuj plik w katalogu głównym dysku
- Wytnij lub skopiuj właśnie pobrany plik.
- Przejdź do katalogu głównego dysku. Zwykle będzie to „C:” albo „D:”
- Wklej plik zip.
- Kliknij go prawym przyciskiem i wybierz „Wyodrębnij wszystko”:

Zostanie utworzony folder o nazwie „stable-diffusion-ui”:

Krok 3: uruchom program
- Wejdź do folderu i znajdź plik „Start Stable Diffusion UI.cmd”:

- Kliknij go dwukrotnie
- Otworzy się konsola poleceń Windows i rozpocznie instalację programu. Nie zamykaj jej w żadnym momencie.
- Po zakończeniu instalacji w przeglądarce otworzy się karta:

- Możesz już zacząć tworzyć swoje obrazy. Później wyjaśnię w innym artykule wszystkie opcje, choć wystarczy wpisać tekst ( (prompt) i kliknąć przycisk „Make Image„:

- Otrzymasz coś takiego:

Krok 4: ustawienia dla PC o (relatywnie) niskich zasobach
Kilka uwag, jeśli twój PC spełnia wymagania tylko częściowo albo nie spełnia zalecanych wymagań.
Jeśli twój PC ma kartę graficzną 4 GB
Zasadniczo musisz zrobić dwie rzeczy:
- Przejdź do Settings i przełącz na tryb „Low”:

- Ustaw rozmiar obrazu. Jeśli nie chcesz obrazu kwadratowego, tylko poziomy lub pionowy, polecam wymiary 512×384 px dla formatu poziomego i 384×512 dla pionowego. Te ustawienia działają z GTX 1650 4 GB:

Jeśli twój PC ma kartę graficzną z mniej niż 4 GB
Będziesz musiał renderować przez CPU (i sporo czekać na każdy obraz). W tym celu:
- Wybierz tutaj renderowanie przez CPU:

Krok 5: zamknij program
- Po prostu upewnij się, że nie generujesz żadnego obrazu i zamknij konsolę Windows.
Krok 6: ponownie otwórz program
- Musisz tylko przejść do folderu, w którym go zainstalowałeś (najprawdopodobniej „C:stable-diffusion-ui”) i kliknąć dwukrotnie plik „Start Stable Diffusion UI.cmd” (tak jak w kroku 3):

- Ponownie otworzy się konsola Windows, a po zakończeniu inicjalizacji otworzy się karta przeglądarki.
- Jeśli z jakiegoś dziwnego powodu przeglądarka się nie otworzy albo sam przypadkiem ją zamkniesz, wejdź na http://localhost:9000/ i powinien pojawić się interfejs programu (o ile nie zamknąłeś konsoli poleceń; w takim przypadku trzeba powtórzyć krok 6 od początku):

Gotowe.
Masz już Stable Diffusion zainstalowane na swoim PC.
Nie było aż tak trudno, prawda?
Przejdźmy teraz do metody ręcznej, przy której jest trochę więcej roboty.
Zainstaluj Stable Diffusion na swoim PC ręcznie

Jeśli opcja powyżej jest prostsza, to po co ktokolwiek miałby robić to ręcznie?
Ano dlatego, że są osoby, które wolą zrozumieć co dokładnie robi aplikacja i czego wymaga.
Jeśli to rozumiesz, możesz zmienić to, co uznasz za stosowne, i dostosować program do swojego sposobu użycia oraz do swojej maszyny.
I dodawać rozszerzenia, jak w przypadku Xformers, które wyjaśniam niżej.
Z tego powodu dodaję ten drugi poradnik, w którym omawiam każdy element używany przez aplikację osobno.
A zobaczysz, że jest ich całkiem sporo.
Krok 1: pobierz potrzebne rzeczy
Do tej ręcznej instalacji będziemy potrzebować kilku rzeczy:
- Edytor tekstu: ja używam Sublime Text (kliknij, żeby przejść do pobierania), ale jeśli masz Notepad, też ci wystarczy.
- Python: język, w którym napisany jest program i który musimy zainstalować na naszym PC. https://www.python.org/downloads/release/python-3106/
- Git: repozytorium kodu, z którego zainstalujemy aplikację. https://git-scm.com/download/win

- Stable Diffusion Model 1.5: dwa modele, które będą generować obrazy. Pobierz jeden albo oba. https://huggingface.co/runwayml/stable-diffusion-v1-5

- Stable Diffusion Web UI: webowy interfejs programu, który pozwala nam wchodzić z nim w interakcję graficznie. https://github.com/AUTOMATIC1111/stable-diffusion-webui

- GFPGAN: algorytm, który pomaga modelowi „naprawiać twarze”. https://github.com/TencentARC/GFPGAN

Pobierz wszystko do jednego folderu, żeby mieć to pod ręką.
Gdy już wszystko masz, zaczynamy instalację.
Krok 2: utwórz folder instalacyjny
Dwie rzeczy, które warto wziąć pod uwagę:
- Możesz go utworzyć w dowolnym miejscu na swoim dysku. Ja zainstalowałem go w katalogu głównym, obok folderu utworzonego w poprzednim poradniku.
- Nie zostawiaj spacji w nazwie. Wpisz coś w rodzaju „stablediffusion”:

Krok 3: zainstaluj Pythona
- Otwórz „python-3.10.6-amd64.exe” dwukrotnym kliknięciem.
- Wybierz „Install Now” w pierwszej opcji, która się otworzy:

- Poczekaj, aż się zainstaluje, i zamknij okno po zakończeniu.
Krok 4: zainstaluj interfejs programu
- Wyodrębnij pobrany plik „stable-diffusion-webui-master.zip”.
- Zostanie utworzony folder „stable-diffusion-webui-master”.
- Skopiuj całą jego zawartość (wszystkie foldery i pliki):

- Wklej je do folderu instalacyjnego utworzonego w kroku 2.
Krok 5: wklej pliki z korektorami twarzy
- Skopiuj pobrane pliki „GFPGANv1.3.pth” i „GFPGANv1.4.pth”.
- Wklej je do folderu instalacyjnego:

Krok 6: wklej modele do odpowiedniego folderu
- Skopiuj pobrane pliki „v1-5-pruned.ckpt” i „v1-5-pruned-emaonly.ckpt”. Jeśli pobrałeś tylko jeden model, skopiuj ten, który pobrałeś.
- Wklej je do następującej ścieżki w folderze instalacyjnym:
„nazwa-mojego-folderumodelsStable-diffusion”.
W moim przypadku:
„C:stablediffusionmodelsStable-diffusion”:

Krok 7: zainstaluj Git
- Otwieramy pobrany plik „Git-2.39.2-64-bit.exe”
- Robimy zwykłą instalację Windows. Wiesz: „dalej”, „dalej”, „dalej” (kilka razy więcej niż zwykle):

- Zamykamy okno po zakończeniu.
Krok 8: wpisz ścieżkę do Pythona
Ten krok nie zawsze jest konieczny, ale nic się nie stanie, jeśli go wykonasz.
Jest to chyba najbardziej skomplikowany krok dla osób, które nie są przyzwyczajone do poruszania się po folderach Windows.
Idziemy krok po kroku:
- Najpierw trzeba ustalić ścieżkę, w której zainstalowaliśmy Pythona na naszym PC. W tym celu przechodzimy do wyszukiwarki Windows i wpisujemy „Python”.
- Znajdzie nam już zainstalowany program (nie mylić z plikiem pobranym na początku), a po prawej zobaczymy „Otwórz lokalizację pliku”. Klikamy tam:

- Otworzy się folder zawierający skrót do programu. Klikamy go prawym przyciskiem i wybieramy opcję „Otwórz lokalizację pliku”:

- Otworzy się nowy folder Windows. Kopiujemy ścieżkę tego folderu z górnego paska:

- Następnie przechodzimy do naszego folderu instalacyjnego programu i otwieramy plik „webui-user.bat” (uwaga, nie „webui-user.sh”) w Sublime Text albo w edytorze tekstu, którego używamy. Najprościej kliknąć plik prawym przyciskiem i wybrać „Open with Sublime Text”, ale każdy niech otworzy go jak chce.
- Po otwarciu pliku w edytorze patrzymy na linię 3:

- Wklejamy ścieżkę folderu Pythona, którą mamy skopiowaną w schowku, i dodajemy do niej „python.exe” (bez cudzysłowów) na końcu, żeby wyglądało to tak:

- Zapisujemy plik i zamykamy go.
Krok 9: uruchom instalator programu
- Mamy już wszystko przygotowane do zainstalowania programu, więc klikamy dwukrotnie ten sam plik, który przed chwilą edytowaliśmy („webui-user.bat”), żeby go uruchomić.
- Otworzy się konsola poleceń Windows, która zacznie wykonywać procesy:

- Potrwa to chwilę, zanim się zakończy. Momentami może nawet wyglądać, jakby się zatrzymało. Nie wolno nam jej nigdy zamykać. Gdy skończy, zobaczymy te linie:

- Na czerwono zaznaczam adres, który trzeba wpisać w dowolnej zainstalowanej przeglądarce, aby wejść do interfejsu aplikacji:

- W tym momencie Stable Diffusion jest gotowe do tworzenia obrazów na bazie promptów:

Krok 10: konfiguracja dla PC o „niskich” zasobach
- Jeśli twój PC nie ma bardzo mocnej karty graficznej, ale ma kartę z co najmniej 4 GB vRAM, możesz używać programu do tworzenia obrazów 512×384 px (poziomo lub pionowo):

- W przeciwieństwie do tego, co dzieje się przy łatwej instalacji, ta metoda ręczna nie zawiera domyślnie żadnego silnika skalowania. Więc już wiesz: trzeba sięgnąć po Waifu, żeby powiększyć obraz. To właśnie zrobiłem z obrazem nagłówkowym tego drugiego poradnika.
Krok 11: zamknij program
- Aby zamknąć aplikację, wystarczy zamknąć konsolę poleceń, która otwiera się, gdy uruchamiam plik „webui-user.bat”.
Krok 12: ponownie otwórz program
- Aby ponownie otworzyć program po zamknięciu (albo innego dnia), musisz uruchomić plik „webui-user.bat”, który znajduje się w folderze utworzonym w kroku 2 do instalacji programu.
Czas się pobawić
Mam nadzieję, że udało ci się przejść przez którykolwiek z dwóch poradników i możesz zacząć generować nieograniczoną liczbę darmowych obrazów ze swojego PC.
Masz mnóstwo opcji i kart do testowania, więc testuj. Uzyskanie dobrych wyników to bardziej kwestia praktyki niż szczęśliwego trafienia z promptem, jak ze wszystkim.
Inna opcja to odwiedzić strony takie jak te, które pokazują obrazy i prompty, które je wygenerowały:
- https://prompthero.com/stable-diffusion-prompts
- https://mpost.io/best-100-stable-diffusion-prompts-the-most-beautiful-ai-text-to-image-prompts/
Wydaje mi się to idealnym sposobem, żeby zacząć grzebać przy tej potężnej aplikacji.
I tworzyć wojownicze księżniczki takie jak ta:

Bonus track 1: jak zaktualizować modele do nowych wersji Stable Diffusion
Dobrze, właściwie skończyłbyś już instalację programu na swoim PC, ale jeśli zrobisz to dokładnie tak, jak opisałem, będziesz mógł używać tylko modelu 1.4 Stable Diffusion.
A kiedy piszę te linie, dostępna jest już wersja 1.5.
To ważne, bo każdy model poprawia wyniki. A przynajmniej generuje inne rezultaty.
Dlatego wyjaśnię ci, jak go zaktualizować, żeby móc używać nowej wersji.
Krok 1: pobierz nowe modele
- Ten krok jest prosty, odwiedzasz ten link: https://huggingface.co/runwayml/stable-diffusion-v1-5
- Przewijasz w dół, aż zobaczysz modele:

- Pobierasz wybrany model, jeden albo oba. Widzisz, o co mi chodziło wcześniej z rozmiarem? 4 i 7 GB, to nie jest drobiazg.
Krok 2: skopiuj modele do odpowiedniego folderu
- Bierzesz pobrane pliki w takiej postaci i kopiujesz je (albo lepiej, wycinasz).
- Przechodzisz do odpowiedniego folderu, w którym masz zainstalowany program, konkretnie do tego: „C:stable-diffusion-uimodelsstable-diffusion”.
- Wklejasz pliki. Zobaczysz, że miałeś już wersję 1.4 („sd-v1-4-ckpt”):

Krok 3: uruchom ponownie program
- Ten krok jest potrzebny tylko wtedy, gdy aplikacja była już uruchomiona. Jeśli działa, zamykasz konsolę poleceń Windows. Jeśli nie, pomijasz go.
Krok 4: wybierz model, którego chcesz użyć, zanim wygenerujesz obraz
- Po uruchomieniu programu z nowymi modelami wystarczy, że wybierzesz model, którego chcesz użyć do wygenerowania obrazu w tej liście rozwijanej, gdzie pojawią się modele, które masz zainstalowane:

W ten sposób możesz aktualizować model za każdym razem, gdy pojawi się nowa wersja.
Ponadto warto wiedzieć, że za pomocą tego systemu można dodać inne wytrenowane modele dostępne w sieci, nie tylko oficjalny Stable Diffusion. Robi się to analogicznie.
Bonus track 2: jak łatwo zainstalować moduł Xformers w Stable Diffusion
Na koniec tego megaporadnika instalacji Stable Diffusion zainstalujemy moduł Xformers.
Na razie nie odkryłem, jak zrobić to w Easy Diffusion, więc jeśli chcesz używać tego modułu, będziesz musiał skorzystać z ręcznej instalacji Automatic1111.
Jeśli kiedyś odkryję, jak zrobić to także z Easy Diffusion, dodam to tutaj.
Po wyjaśnieniu tej kwestii tłumaczę, co trzeba zrobić, a nie jest tego dużo.
Krok 1: otwórz plik webui-user.bat
Zakładamy, że mamy już Stable Diffusion zainstalowane i działające na naszej maszynie (powtarzam: przez system Automatic1111).
Po otwarciu go tak, jak go zainstalowaliśmy, moduł się nie ładuje:

- Pierwsze, co musisz zrobić, żeby moduł się załadował, to przejść do folderu instalacyjnego programu i otworzyć plik „webui-user.bat” w edytorze tekstu. Tak, to ten sam plik, który edytowałeś podczas instalacji, żeby dodać ścieżkę Pythona:

Krok 2: dodaj argument
- Następnie trzeba dodać ten argument: "–xformers" w linii 6 (argumenty dla wiersza poleceń):

Krok 3: otwieramy program i sprawdzamy, czy moduł się ładuje
- Po otwarciu programu jak zawsze wystarczy spojrzeć na konsolę poleceń i sprawdzić, czy moduł został poprawnie załadowany:

Jeśli widzimy te linie, wszystko poszło tak, jak powinno, i będziemy korzystać z jego zalet.
Zalety używania Xformers w Stable Diffusion
Najważniejsza jest taka, że generowanie obrazów zajmuje dużo mniej czasu. Benchmarki możesz zobaczyć pod tym linkiem.
Przy obecnych kartach graficznych, o ile nie masz takiej za ponad 1500 €, ten wzrost szybkości generowania wcale nie jest błahostką.
Ponadto ma też pozytywny wpływ na zużycie vRAM, pozwalając skromniejszym kartom graficznym tworzyć większe obrazy.
Wady Xformers
No dobrze, ale skoro ten moduł jest taki dobry, dlaczego nie jest wdrożony domyślnie?
Powód jest taki, że możesz stracić jakość przy generowaniu obrazów.
Ważny jest ten niuans, że może.
Bo nie dzieje się to zawsze. Właściwie zdarza się dość rzadko.
Więcej informacji masz tutaj.
Na tym zamykamy temat.
Tylko na razie.
Bo w następnym artykule wyjaśnię, jak zainstalować rozszerzenie ControlNet, które pozwala nam robić jeszcze fajniejsze rzeczy.
Więc jeśli nie chcesz ich przegapić, wiesz, co robić: zapisz się tuż poniżej a dam ci znać, gdy tylko go opublikuję.
Słuchaj, myślę, że to cię zainteresuje
Zarejestruj się i zgarnij mój 66-stronicowy przewodnik Najlepsze darmowe narzędzia cyfrowe do:
- Marketing
- Analityka
- UX
- Zarządzanie projektami…
Ponadto każdego dnia w skrzynce odbiorczej dostaniesz trik albo poradę (taką naprawdę dobrą), żeby ulepszyć swój biznes albo projekt cyfrowy.



Dodaj komentarz