# Prompty do generowania obrazow AI: pięcioblokowa formuła

URL: https://koroverse.app/pl/journal/prompty-do-generowania-obrazow-ai
Type: blog
Locale: pl
Published: 2026-08-07
Updated: 2026-08-11

---

> Prompty do generowania obrazow AI według pięcioblokowej formuły dają portrety postaci i lokacje spójne przez całą kampanię TTRPG. Kodeks promptów zapewnia spójność wizualną przez dziesiątki sesji.

Trzy sesje w nowy arc, gracze zjawili się z oczekiwaniem wizualnego ujawnienia przywódcy frakcji. Portret, nad którym spędziłem czterdzieści minut, wyglądał jak każdy inny kapturniony antagonista z galerii stockowej fantastyki: niewyrazisty, niezapamiętany, nijak nieprzylegający do postaci, którą zbudowałem. Problem nie leżał w narzędziu. Prompty do generowania obrazow AI, zbudowane według odpowiedniej struktury, dają portrety postaci gotowe na kampanię, wizualizacje lokacji i symbolikę frakcji, które zachowują spójność wizualną przez pięćdziesiąt sesji. Tu masz strukturę, która naprawdę działa.

## Co większość promptów robi źle

Naturalny odruch MJ, który przez lata pisał lore, to pisać prompty jak wpisy do kroniki. Wpisujesz historię postaci, jej motywacje, ukrytą ranę z dzieciństwa, jej filozoficzny stosunek do władzy. Nic z tego nie pojawia się na obrazie. Pojawia się to, co malarz zobaczyłby z drugiego końca sali: blizna na lewym policzku, wąska sylwetka, trzy noże widoczne u pasa.

Podejście "listy zakupów" ma dokładnie odwrotny problem. Prompt za promptem na forach kampaniowych wygląda tak: "elfi łotr ciemny kaptur sztylet 8k ultra detailed masterpiece". Narzędzie coś generuje. Rzadko kiedy generuje postać, którą rozpoznasz trzy sesje później. Żetony jakości w stylu "masterpiece" i "ultra detailed" zużywają przestrzeń, która mogłaby opisywać coś, co gracz faktycznie zapamięta.

Fundamentalny problem jest jeden: większość twórców światów opisuje to, co wie o postaci, a generatory obrazów AI renderują to, co jest widoczne. Im szybciej nauczysz się przekładać lore na widoczne kotwice wizualne, tym szybciej wizualna tożsamość twojej kampanii stanie się spójna.

## Pięcioblokowa formuła portretów postaci, które wytrzymują próbę stołu

Po sześciu miesiącach testów podczas przygotowań do kampanii, w tym homebrew Pathfinder 2e z ponad trzydziestoma NPCami, którzy musieli być od siebie odróżnialni przy stole, najbardziej konsekwentne wyniki daje pięć ułożonych bloków. Kolejność ma znaczenie, bo model nadaje większą wagę informacjom z początku promptu.

**Blok 1: Rola i rasa.** Jeden rzeczownik złożony. "Halfling kartograf", "krasnoludzki inżynier oblężniczy", "tiefling uczony dworski". Bez imienia, bez backstory, tylko archetyp i rasa.

**Blok 2: Trwałe kotwice wizualne.** Dwa lub trzy precyzyjne, widoczne szczegóły, które przeżyłyby opis postaci napisany z pamięci po sesji. "Wyszczerbiony przedni kieł", "srebrny sierpowaty kolczyk", "blizna z oparzenia na prawym przedramieniu". To są szczegóły, które czynią postać rozpoznawalną w wielu kolejnych generacjach tego samego promptu. Jeśli szczegół nie jest widoczny na obrazie, nie wpisuj go do promptu.

**Blok 3: Ekwipunek i sylwetka.** Co noszą lub trzymają, opisane wystarczająco precyzyjnie, żeby dało się to odczytać w portrecie. "Gruby skórzany fartuch na kolczudze" to inny obraz niż "skórzany fartuch". "Para wąskich sztyletów trzymanych nisko" to inna sylwetka niż "ze sztyletami". Konkretność tutaj nie jest dekoracją; to jedyny sposób, w jaki model odróżnia jeden zestaw ekwipunku od innego.

**Blok 4: Nastrój i poza.** Jedno słowo na wyraz twarzy, jedno na postawę ciała. "Czujny, ciężar przesunięty w tył". "Rozbawiony, broda uniesiona". Unikaj abstrakcyjnych stanów emocjonalnych; używaj fizycznego wyrazu emocji. Model nie potrafi wyrenderować "konflikt wewnętrzny", ale potrafi wyrenderować "napięta szczęka, lekko nieostry wzrok".

**Blok 5: Światło i format.** Tu mówisz narzędziu, jakiego wyjścia naprawdę potrzebujesz. "Portret, za nim kamienna ściana oświetlona świecą, styl malarstwa olejnego, stonowana paleta". Na tokeny VTT: "portret, białe tło, ilustracja cyfrowa". Na ujawnienie czarnego charakteru: "dramatyczne oświetlenie od dołu, ciemne tło, sztuka koncepcyjna". Blok formatu ustawia też rejestr wizualny dla całej kampanii, jeśli zachowujesz go identyczny we wszystkich portretach postaci.

Całkowita długość promptu powinna wynosić od czterdziestu do osiemdziesięciu słów. Powyżej osiemdziesięciu zaczynasz tracić sygnał. Poniżej trzydziestu dostajesz generyczny wynik.

![Wygenerowany przez AI portret fantastycznego elfiego łotra z wyraźnymi kotwicami wizualnymi -- blizna, sierpowaty kolczyk, podarta chusta](https://fdzlnqpwsaniezitwiuw.supabase.co/storage/v1/object/public/cms-media/koroverse/2026-08/f64b27-img1.webp)

## Prompty lokacji: jeden szczegół, który tworzy konkretną scenę

Portrety postaci mają formułę. Prompty lokacji mają inną pułapkę: generyczność. "Starożytna zrujnowana wieża nocą" daje dokładnie taki obraz, jaki widziałeś tysiące razy. Atmosferyczny i emocjonalnie pusty.

Rozwiązanie to precyzja w jednym elemencie. "Starożytna zrujnowana wieża nocą" jest generyczna. "Cytadela na klifie nad morzem z zawaloną wschodnią wieżą i pomarańczowym blaskiem pochodni sączącym się przez wąskie strzelnice" to konkretna lokacja. Precyzja nie musi być wszędzie w promptcie. Jeden konkretny detal architektoniczny, jeden niecodziennych warunek atmosferyczny, jeden ślad wcześniejszego zamieszkania wystarczą, żeby wypchnąć scenę poza generyczny wynik stockowy.

Dla MJ prowadzących długie kampanie, prompty lokacji zyskują na dodaniu drugiej kotwicy: śladów tego, co tu się wydarzyło. "Zawalona sala balowa, fortepian na wpół pogrzebany pod gruzem" umieszcza ruinę w konkretnej cywilizacji. "Pole bitwy trzy dni po walkach, wrony w linii drzew, porzucona machina oblężnicza w błocie" wkłada historię w krajobraz. Te szczegóły rzadko psują obraz, a często sprawiają, że scena wygląda na zamieszkałą, a nie wyrenderowaną.

Trzymaj prompty lokacji od czterdziestu do sześćdziesięciu słów i unikaj wymieniania zbyt wielu elementów architektonicznych. Jedna wyraźna struktura, warunki atmosferyczne, jeden narracyjny detal.

![Sztuka koncepcyjna walącego się zamku na klifie nad morzem o zmierzchu -- tego rodzaju obraz ujawnienia lokacji, który MJ generuje na sesje kampanii](https://fdzlnqpwsaniezitwiuw.supabase.co/storage/v1/object/public/cms-media/koroverse/2026-08/7c5962-img2.webp)

## Spójność wizualnego kanonu w długiej kampanii

Prawdziwy problem w kampanii, która trwa sześćdziesiąt lub osiemdziesiąt sesji, to nie generowanie dobrych obrazów. To generowanie spójnych obrazów. Przywódca frakcji, który pojawił się w czwartej sesji, musi wyglądać rozpoznawalnie jak ta sama osoba w czterdziestej siódmej, po tym jak jej okoliczności się zmieniły i potrzebujesz nowego portretu.

Praktyczna odpowiedź to Kodeks promptów: osobny dokument, w którym przechowujesz dokładne prompty, które dały każdy kanoniczny obraz, wraz z URL wyjścia i użytym narzędziem. Kiedy potrzebujesz nowego obrazu tej samej postaci, pobierasz kotwice z Bloku 2 dosłownie i aktualizujesz tylko bloki 3 do 5. "Wyszczerbiony przedni kieł, srebrny sierpowaty kolczyk" zostaje bez zmian. Ekwipunek, nastrój i format się zmieniają.

Spójność stylu przez całą kampanię jest trudniejsza niż spójność postaci. Najprostsze podejście to wybranie jednego ciągu stylistycznego i nigdy od niego nieodchodzenie. "Styl malarstwa olejnego, stonowana paleta, miękkie tło" jako stały sufiks na każdym portrecie postaci tworzy wizualną spójność szybciej niż próba dopasowania stylów per postać. Jeden rejestr wizualny dla kampanii, tak jak powieść ma jeden rejestr prozatorski.

Niektóre narzędzia radzą sobie z tym lepiej niż inne. Funkcja referencji postaci Leonardo AI pozwala zablokować obraz referencyjny i regenerować z nowymi pozami lub oświetleniem, co eliminuje potrzebę dosłownego powtarzania promptu, gdy masz już zatwierdzony portret. Dla MJ z dużymi obsadami jest to warte kosztów przepływu pracy.

## Który generator obrazów obsługuje co

Szczera odpowiedź jest taka, że żadne pojedyncze narzędzie nie robi wszystkiego, czego potrzebuje wizualna biblioteka kampanii.

Midjourney daje najlepsze wyniki dla końcowej jakości portretów. Renderuje twarze, tkaniny i atmosferę na poziomie, którego inne narzędzia nie osiągają konsekwentnie. Kompromis to zamknięty ekosystem: pracujesz wewnątrz ich interfejsu webowego, nie możesz uruchomić go lokalnie, a spójność stylu w dużej obsadzie wymaga starannej dokumentacji promptów.

Stable Diffusion to narzędzie dla MJ, którzy chcą kontroli nad procesem zamiast wygody. Uruchamiane lokalnie, obsługuje duże partie bez kosztu per obraz i pozwala na dostrajanie do konkretnych stylów artystycznych lub referencji postaci. Składnia promptów jest inna (negatywne prompty trafiają do osobnego pola, wagi modeli mają znaczenie), a koszt konfiguracji jest realny. Zysk to wizualny pipeline, który należy do kampanii, a nie do zewnętrznego serwisu.

Leonardo AI plasuje się między nimi pod względem jakości i elastyczności. Jego system referencji postaci jest najbardziej przyjazny dla MJ ze wszystkich trzech narzędzi pod kątem utrzymywania spójności wizualnej w długo prowadzonej kampanii. Jakość obrazów dla złożonych scen jest poniżej Midjourney, ale powyżej przeciętnego wyjścia Stable Diffusion bez dostrajania.

Ideogram warto znać w przypadku symboli frakcji, projektowania herbów i ilustracji kartograficznych. Obsługuje stylizowaną grafikę płaską znacznie czyściej niż modele zorientowane na fotorealizm, a czytelność form geometrycznych jest zauważalnie lepsza. Nie zastąpi narzędzia do portretów, ale jest przydatnym uzupełnieniem.

![Postarzana pergaminowa mapa fantasy z ręcznie rysowanym archipelagiem, pasmami górskimi i ruinami -- referencyjna mapa kampanii stworzona z pomocą AI](https://fdzlnqpwsaniezitwiuw.supabase.co/storage/v1/object/public/cms-media/koroverse/2026-08/12734a-img3.webp)

## Co Kuźnia generuje, a co nadal musisz napisać sam

Jest pewien wzorzec w przygotowaniach do kampanii: MJ zaczyna używać promptów do generowania obrazow AI, dostaje wyniki wystarczająco dobre i zaczyna traktować generowanie wizualne jako substytut leżącej u podstaw pracy projektowej. Portret istnieje, więc postać istnieje. Concept art lokacji jest gotowy, więc lokacja jest zbudowana.

Problem pojawia się przy stole. Gracz pyta o bliznę na twarzy przywódcy frakcji. Wiesz, że tam jest, bo opisałeś ją w promptcie. Ale nie wiesz, co oznacza w ramach lore. Kuźnia generuje widoczną powierzchnię. Historia za nią nadal potrzebuje ludzkiego przejścia.

Generowanie obrazów wspomagane AI jest najszybsze i najbardziej użyteczne, gdy leżący u podstaw projekt jest już solidny. Postać z wyraźnymi motywacjami, zdefiniowaną rolą w strukturze frakcji i co najmniej jedną relacją z inną postacią daje bardziej użyteczny prompt, bo wiesz, które trzy kotwice wizualne rzeczywiście mają znaczenie. Pusta postać, która istnieje tylko po to, żeby wypełnić rolę w czwartej sesji, daje generyczny portret, bo nie wiesz jeszcze, co czyni ją konkretną.

To nie jest krytyka narzędzi. To opis tego, jak z nich maksymalnie skorzystać. Lore albo zasługuje na wiarę, albo nie. Generuj obraz po tym, jak wiesz, kim jest postać. Nie po to, żeby odkryć, kim jest.

## Tu masz to, jak wygląda przy stole

Pięcioblokowa formuła daje portrety postaci, które wytrzymują sesje, gdy kotwice wizualne są wybierane celowo: fizyczne markery, nie cechy osobowości. Prompty lokacji z jednym konkretnym detalem architektonicznym lub narracyjnym wypychają scenę poza generyczny wynik stockowy. Spójność stylu przez kampanię pochodzi z wybrania jednego rejestru wizualnego i zachowania stałego sufiksu identycznego we wszystkich portretach postaci.

Obrazy, które narzędzia generują, są lepsze niż to, do czego większość MJ miałaby inaczej dostęp, i szybsze niż zamawianie indywidualnych prac dla każdego NPCa z rolą mówiącą. Luka, której nie zamykają, to praca projektowa, która sprawia, że postać warta jest wygenerowania w pierwszej kolejności. To nadal jest praca MJ, a narzędzia wspomagane AI działają lepiej, gdy jest już zrobiona.

## FAQ

### Ile słów powinien mieć dobry prompt do portretu postaci?

Optymalny zakres to czterdzieści do osiemdziesięciu słów. Powyżej osiemdziesięciu model zaczyna tracić sygnał na rzecz szumu. Poniżej trzydziestu dostajesz zbyt generyczny wynik -- brak wystarczających kotwic wizualnych, żeby wyróżnić postać spośród tysięcy podobnych.

### Czym różni się prompt do portretu postaci od promptu do lokacji?

Portret postaci wymaga stałych kotwic wizualnych (blizny, biżuteria, szczegóły ekwipunku), które zapewniają spójność między sesjami. Prompt lokacji działa najlepiej z jednym precyzyjnym detalem architektonicznym i jednym śladem narracyjnym -- historią widoczną w krajobrazie.

### Jak utrzymać spójność wizualną tej samej postaci przez wiele sesji?

Prowadź Kodeks promptów: dokument z dokładnymi promptami, URL wyjść i użytymi narzędziami. Przy każdym nowym obrazie tej samej postaci kotwice z Bloku 2 przepisujesz dosłownie, zmieniając tylko bloki 3 do 5 odpowiadające za ekwipunek, nastrój i format.

### Które narzędzie do generowania obrazów jest najlepsze dla Mistrza Gry?

Zależy od potrzeby. Midjourney daje najwyższą jakość portretów. Stable Diffusion daje kontrolę i brak kosztów per obraz przy lokalnym uruchomieniu. Leonardo AI oferuje najlepszy system referencji postaci dla długich kampanii. Ideogram sprawdza się najlepiej przy symbolach frakcji i kartografii.

### Czy mogę używać promptów do generowania obrazow AI bez wcześniej opracowanej postaci?

Technicznie tak, ale efekty są gorsze. Narzędzia generują najlepiej wtedy, gdy postać ma już jasne motywacje, rolę w strukturze frakcji i co najmniej jedną relację z inną postacią. Pusta postać, stworzona tylko na potrzeby jednej sesji, daje generyczny portret.

### Jaki format promptu działa najlepiej dla tokenów VTT?

Dodaj do Bloku 5 frazę "portret, białe tło, ilustracja cyfrowa". Białe tło ułatwia wycięcie tokenu w narzędziach VTT, takich jak Roll20 czy Foundry, i daje wyraźną sylwetkę bez zbędnego tła.

### Kiedy warto użyć Ideogram zamiast Midjourney?

Ideogram sprawdza się najlepiej przy stylizowanej grafice płaskiej: symbole frakcji, herby, mapy kampanii, projektowanie znaczków i odznak. Dla portretów postaci i ilustracji lokacji Midjourney lub Leonardo AI dadzą lepsze wyniki jakościowe.