# Jak pisać prompty do generatorów wideo AI

Praktyczny poradnik dla Seedance, Klinga, Veo, Runway, Hailuo, H3 Max i Wan — z przykładami oraz gotowymi instrukcjami do ChatGPT.

Wyobraź sobie proste ujęcie reklamowe: opakowanie kawy stoi na blacie, obok paruje filiżanka, a kamera powoli zbliża się do produktu. Zanim opiszesz taką scenę generatorowi, ustal, z czego zaczynasz. Czy masz już zdjęcie, które chcesz animować? Czy model ma stworzyć kuchnię na podstawie tekstu? Czy wygląd opakowania ma odtworzyć z osobnej fotografii? Czy w filmie potrzebny jest dźwięk?

Od tych decyzji zależy treść promptu, czyli instrukcji przekazywanej generatorowi. Znaczenie ma również wybrany model. W dokumentacji Runway Gen-4 zaleca się opisywanie oczekiwanego efektu zamiast dopisywania zakazów. Veo ma udokumentowane pole na instrukcje negatywne, a MiniMax opisuje specjalne komendy kamery dla Hailuo. Nie warto więc kopiować tego samego rozbudowanego szablonu do każdego narzędzia. [Źródła: Runway — poradnik Gen-4](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide), [Google — poradnik Veo](https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide), [MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

Poradnik obejmuje 19 rozdziałów poświęconych poszczególnym modelom i ich wariantom. Przykłady są propozycjami sposobu pisania, a nie wynikami testu porównawczego. Instrukcja może precyzyjnie określać oczekiwany efekt, ale nie gwarantuje, że generator odtworzy go bez błędów.

## Zanim wybierzesz instrukcję dla swojego modelu

### W jakim języku pisać?

Przykłady promptów w tym poradniku są po angielsku. Dzięki temu można korzystać z terminów używanych w dokumentacji i opisie pracy kamery. Nie oznacza to jednak, że angielski zawsze daje lepszy wynik niż polski lub inne języki.

Dokumentacja Google deklaruje pełne wsparcie angielskiego w Veo. Dla pozostałych rodzin potraktuj angielski jako przyjęty tutaj język roboczy, a nie potwierdzony w badaniach najlepszy wybór. [Źródło: Google — generowanie wideo w Gemini API](https://ai.google.dev/gemini-api/docs/veo).

Rozróżniaj trzy rzeczy:

| Element | Jak go opisać |
| --- | --- |
| Instrukcja dla generatora | Opis sceny, działania i pracy kamery możesz przygotować po angielsku. |
| Wypowiedź bohatera | Podaj jej dokładną treść i język. Sprawdź, czy model obsługuje generowanie mowy w tym języku. |
| Napis widoczny w filmie | Zachowaj oryginalną treść. Ważne hasło reklamowe lub cenę najlepiej zaplanować jako osobną warstwę dodawaną podczas montażu. |

Język promptu i język wypowiedzi to nie to samo. W instrukcjach Klinga 2.6 i 3.0 opisano automatyczne tłumaczenie wypowiedzi z nieobsługiwanych języków na angielski. Samo umieszczenie polskiego zdania w prompcie nie zapewnia więc polskiego dialogu. [Źródła: Kling 2.6 — audio](https://kling.ai/quickstart/klingai-video-26-audio-user-guide), [Kling 3.0 — instrukcja modelu](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

### Najpierw określ, do czego służą materiały

**Text-to-video — film na podstawie tekstu.** Model ma stworzyć zarówno wygląd sceny, jak i jej przebieg. Opisz więc miejsce, główny obiekt, działanie, światło i pracę kamery.

**Image-to-video — animacja obrazu początkowego.** Zdjęcie stanowi pierwszą klatkę filmu, czyli *start frame*. Określa wygląd początkowego kadru. W prompcie skup się przede wszystkim na ruchu oraz na tym, co ma pozostać niezmienne.

**Generowanie z materiałów referencyjnych.** Zdjęcie lub film służy jako wzór produktu, postaci, stylu albo ruchu. Taki materiał nie musi być pierwszą klatką. Napisz, które cechy model ma z niego przejąć.

**Edycja istniejącego filmu.** Punktem wyjścia jest gotowe nagranie. Wskaż element do zmiany, oczekiwany rezultat oraz to, co ma zostać zachowane.

Nie każda platforma udostępnia wszystkie tryby obsługiwane przez daną rodzinę modeli. Nazwa modelu i nazwa platformy to zatem dwie osobne informacje. [Źródła: Runway — image-to-video](https://help.runwayml.com/hc/en-us/articles/48324313115155), [Kling — Omni](https://kling.ai/quickstart/klingai-video-3-omni-model-user-guide).

### Jak korzystać z gotowych instrukcji do ChatGPT?

Bloki zatytułowane **„Prompt startowy do ChatGPT”** służą do przygotowania rozmowy z czatem. Nie wklejaj ich bezpośrednio do generatora wideo.

Najpierw wybierz instrukcję dla swojego modelu i prześlij ją do ChatGPT. Czat ma sprawdzić wskazane materiały, podsumować najważniejsze zasady i poprosić o brakujące dane. Następnie opisz ujęcie i dołącz zdjęcie lub inne materiały. Otrzymasz angielski prompt do generatora oraz osobno ustawienia, takie jak długość, proporcje obrazu i dźwięk.

Jeżeli opis ujęcia i wszystkie potrzebne dane podasz od razu, nie ma powodu, aby czekać na kolejną wiadomość. W dalszej pracy czat powinien też pamiętać wybrany model i platformę, zamiast pytać o nie przy każdym zdjęciu.

Instrukcje zakładają dostęp do wyszukiwania w internecie. Gdy czat nie może odczytać dokumentacji, powinien wyraźnie oddzielić to, co udało się sprawdzić, od informacji wymagających potwierdzenia. [Źródło: OpenAI — ChatGPT Search](https://help.openai.com/en/articles/9237897-chatgpt-search).

**Instrukcje służą wyłącznie do przygotowywania tekstu. Nie zlecają uruchamiania generacji obrazów ani filmów.**

---

## 1. Seedance 2.5

### Jak zbudować prompt

Opis do Seedance 2.5 można potraktować jak krótką instrukcję realizacji ujęcia. Określ rezultat, przypisz zadania dołączonym materiałom, a następnie opisz działanie i kamerę. Poradnik omawia również referencje, etapy czasowe, dźwięk oraz edycję istniejącego filmu. [Źródło: fal — przewodnik Seedance 2.5](https://fal.ai/learn/devs/how-to-use-seedance-2-5).

Pomocna kolejność to:

> Rodzaj ujęcia → rola materiałów → przebieg działania → ruch kamery → dźwięk → elementy do zachowania.

To sposób porządkowania informacji, nie obowiązkowa składnia. Jeżeli do animacji zdjęcia wystarczą trzy konkretne zdania, nie trzeba rozbudowywać ich do pełnego scenariusza.

#### Przypisz referencjom konkretne zadania

Gdy dwa zdjęcia przedstawiają to samo opakowanie z różnych stron, napisz to wprost. Przy dodatkowym zdjęciu wnętrza określ, czy ma ono wyznaczać całe otoczenie, czy jedynie kierunek światła.

```text
The first two reference images show the same coffee package from
different angles. Use them as references for the package's shape,
colors, and label design.

Use the third reference image for the kitchen setting and the
direction of the window light.
```

W poradniku dla integracji fal pojawiają się oznaczenia takie jak `@Image1`. Stosuj je tylko wtedy, gdy obsługuje je wybrany interfejs. Samo wpisanie nazwy pliku lub znacznika nie zastępuje dołączenia materiału do właściwego pola. [Źródło: fal — promptowanie Seedance 2.5](https://fal.ai/learn/devs/seedance-2-5-prompting-guide).

#### Opisuj czynności w logicznej kolejności

Ogólne „kobieta podnosi filiżankę, dynamiczna reklama” pozostawia wiele decyzji modelowi. Gdy zależy Ci na konkretnym przebiegu, opisz go dokładniej:

> Prawa dłoń wchodzi z prawej strony kadru, chwyta filiżankę za ucho i unosi ją nad blat. Po krótkiej chwili odstawia filiżankę w to samo miejsce, puszcza ucho i wychodzi z kadru.

Każda czynność powinna wynikać z poprzedniej. Filiżanka nie może jednocześnie stać na blacie i znajdować się w dłoni. Jeśli ma wrócić do pozycji początkowej, uwzględnij odstawienie i zwolnienie uchwytu.

#### Rozpisuj czas, gdy kolejność ma znaczenie

Poniższy przykład zakłada obraz początkowy z opakowaniem i filiżanką, której ucho jest dostępne od prawej strony. Wymaga również trybu pozwalającego uzyskać 12-sekundowy klip.

```text
One continuous shot based on the starting image. The coffee package
remains stationary throughout.

0–3 seconds: a right hand enters from the right edge of the frame
and gently grasps the cup by its handle.

3–8 seconds: the hand lifts the cup a few centimeters above the table
and holds it steady. The camera slowly moves forward toward the
package, keeping the front label fully in view.

8–12 seconds: the hand lowers the cup to its original position,
releases the handle, and leaves the frame. The camera gradually
slows to a stop, holding a close view of the package.

Audio: quiet room ambience and a soft tap as the cup is
set back on the table.
```

Znaczniki czasu określają zamierzony przebieg. Nie są gwarancją wykonania każdej czynności z dokładnością do klatki. Dopasuj liczbę działań do długości filmu. [Źródło: fal — przewodnik Seedance 2.5](https://fal.ai/learn/devs/how-to-use-seedance-2-5).

### Język, dźwięk i ograniczenia

Instrukcje w tym poradniku są po angielsku. Dialog zapisuj jednak w języku, w którym ma zostać wypowiedziany, i przypisuj go konkretnej postaci. Osobno sprawdź obsługę tego języka.

Dokumentacja opisuje także opcjonalne oznaczenia dźwięku i napisów: nawiasy okrągłe dla muzyki, ostre dla efektów, klamrowe dla dialogu oraz `〖〗` dla napisów. Nie trzeba używać ich w każdym prompcie. Zwykły opis, który wiąże dźwięk z widoczną czynnością, jest czytelnym punktem wyjścia. [Źródło: fal — przewodnik Seedance 2.5](https://fal.ai/learn/devs/how-to-use-seedance-2-5).

Wymaganie „zachowaj układ etykiety” nie jest tym samym co osobne pole `negative_prompt`. Dostępność takiego pola zależy od integracji. Przy edycji filmu wskaż jedno nagranie bazowe i opisz zakres zmiany, zamiast przypisywać kilku plikom jednocześnie rolę głównego materiału. [Źródło: Dreamina — poradnik Seedance 2.5](https://dreamina.capcut.com/seedance/seedance-2-5-prompt).

#### Prompt startowy do ChatGPT — Seedance 2.5

```text
Pomagaj mi przygotowywać prompty do Seedance 2.5. Odpowiadaj po polsku,
a gotowe prompty do generatora pisz po angielsku. Nie uruchamiaj
generowania obrazów ani filmów.

Na początku zapoznaj się z dostępną dokumentacją:
https://fal.ai/learn/devs/how-to-use-seedance-2-5
https://fal.ai/learn/devs/seedance-2-5-prompting-guide
https://dreamina.capcut.com/seedance/seedance-2-5-prompt

Krótko podsumuj zasady istotne dla pisania promptów. Jeśli któregoś
źródła nie możesz odczytać, zaznacz, czego nie udało się potwierdzić.
Gdy podam platformę, sprawdź również funkcje jej konkretnej integracji.

Jeżeli nie opisałem jeszcze ujęcia, poproś o jego opis, nazwę platformy,
długość, proporcje obrazu oraz materiały. Pytaj tylko o brakujące dane.
Jeżeli mam już przygotowany opis i załączniki, przejdź do pracy.
Nie twórz przykładowej sceny, zanim przedstawię własny pomysł.

Rozpoznaj, czy chodzi o film z tekstu, animację pierwszej klatki,
pracę z referencjami czy edycję nagrania. Każdemu dołączonemu plikowi
przypisz konkretną rolę. Używaj oznaczeń obsługiwanych przez platformę.

Zachowaj mój pomysł. Opisz działania w logicznej kolejności, rozdziel
ruch kamery od ruchu obiektów i określ zakończenie ujęcia. Przy animacji
zdjęcia skup się na zmianach, bez powtarzania całej zawartości obrazu.
Rozpisuj etapy czasowe tylko wtedy, gdy są potrzebne.

Dialog zachowaj w podanym przeze mnie języku. Jeśli model go nie
obsługuje, wyjaśnij ograniczenie zamiast samodzielnie tłumaczyć tekst.
Dźwięki przypisuj do konkretnych zdarzeń.

Zwróć jeden gotowy prompt w bloku kodu. Pod nim podaj po polsku
ustawienia dostępne na platformie. Osobny negative prompt przygotuj
tylko wtedy, gdy wybrany tryb go obsługuje. Wspomnij wyłącznie
o ograniczeniach istotnych dla tego ujęcia.

Przy kolejnych ujęciach korzystaj z wcześniej podanych ustawień,
chyba że je zmienię. Nie pytaj ponownie o informacje, które już masz.
```

---

## 2. Seedance 2.0 i nazwa „Seedance 2 Pro”

### Najpierw ustal, jaki model wybierasz

Nazwa widoczna na platformie nie zawsze wystarcza do rozpoznania wersji modelu. W zestawieniu Magnific występują Seedance 2.0, Seedance 2.0 Fast i Seedance 2.0 Mini. W materiałach wskazanych w poradniku nie opisano odrębnych zasad promptowania dla nazwy „Seedance 2 Pro”. Nie ma więc podstaw, aby przypisywać jej własną składnię. Najpierw powiąż nazwę z konkretnym wariantem w danej usłudze. [Źródło: Magnific — Seedance 2](https://www.magnific.com/seedance-2).

### Jak pisać do Seedance 2.0

Dokumentacja Runway opisuje generowanie z tekstu, pracę z referencjami oraz użycie pierwszej i ostatniej klatki. Prompt powinien odpowiadać wybranemu trybowi. [Źródło: Runway — Seedance 2.0](https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0).

W **text-to-video** opisz wygląd sceny, a następnie ruch:

```text
A simple product commercial in a bright kitchen. A matte coffee
package stands on a pale wooden table, with a white ceramic cup
slightly behind it.

The camera tracks slowly to the right, parallel to the edge of the
table. The package remains fully in frame, with its front label
visible. The camera movement creates gentle parallax between the
package and the kitchen background.

Steam rises slowly from the cup. Soft daylight enters from the left.
The package remains upright and stationary throughout the shot.
```

W **image-to-video** zdjęcie określa już wygląd początkowej sceny. Możesz więc skrócić opis:

```text
The camera tracks slowly to the right, parallel to the table edge.
The coffee package remains upright and stationary, with its front
label visible throughout. Steam rises gently from the cup.
The lighting remains consistent with the starting image.
```

Przy **referencjach** wskaż, co ma zostać przejęte z każdego pliku. Film może służyć wyłącznie jako wzór ruchu kamery, a nie scenografii. Zdjęcie produktu może określać jego wygląd, ale niekoniecznie położenie w nowym kadrze.

Przy **pierwszej i ostatniej klatce** opisz logiczne przejście między dostarczonymi obrazami. Jeżeli ostatnia klatka pokazuje szerszy plan niż pierwsza, polecenie ciągłego zbliżania się do produktu może być z nią sprzeczne. [Źródło: Runway — Seedance 2.0](https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0).

### Język i instrukcje negatywne

Angielski pozostaje przyjętym tutaj językiem roboczym. Nie przenoś jednak automatycznie specjalnych oznaczeń dźwięku z Seedance 2.5 do wersji 2.0. Zacznij od zwykłego opisu i sprawdź dokumentację wybranej integracji.

Podobnie postępuj z instrukcjami negatywnymi. Najpierw określ oczekiwany efekt, a osobny *negative prompt* — opis niepożądanych elementów — przygotuj tylko wtedy, gdy platforma udostępnia właściwe pole.

#### Prompt startowy do ChatGPT — Seedance 2.0

```text
Pomagaj mi pisać prompty do Seedance 2.0. Wyjaśnienia podawaj po polsku,
a gotowe prompty po angielsku. Nie uruchamiaj generowania filmów.

Najpierw sprawdź dostępną dokumentację:
https://seed.bytedance.com/en/seedance2_0
https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0
https://fal.ai/seedance-2.0

Podsumuj najważniejsze zasady. Oddziel funkcje modelu od możliwości
platformy. Nie przypisuj wersji 2.0 funkcji Seedance 2.5 bez potwierdzenia.
Jeżeli nie możesz odczytać źródła, zaznacz zakres niepewności.

Jeśli nie podałem jeszcze opisu ujęcia, poproś o niego oraz o nazwę
platformy, długość, proporcje obrazu i materiały. Pytaj tylko o dane,
których brakuje. Dokumentację platformy sprawdź, gdy poznasz jej nazwę.

Na podstawie mojego opisu przygotuj jeden spójny prompt. Przy filmie
z tekstu określ wygląd i przebieg sceny. Przy animacji zdjęcia skup się
na ruchu. Referencjom przypisz konkretne zadania. Dla pierwszej
i ostatniej klatki opisz przejście zgodne z oboma obrazami.

Pisz naturalnymi zdaniami. Rozróżniaj ruch kamery i ruch obiektów.
Nie dodawaj niezamówionych postaci, cięć ani efektów. Zachowaj nazwy
marek, treść napisów i język dialogu. Gdy język mowy nie jest
obsługiwany, wyjaśnij to zamiast samodzielnie tłumaczyć wypowiedź.

Zwróć prompt w bloku kodu i osobno ustawienia po polsku. Negative
prompt dodaj wyłącznie dla trybu, który go obsługuje. Przy kolejnych
ujęciach zachowuj ustalone ustawienia, dopóki ich nie zmienię.
```

#### Prompt startowy do ChatGPT — model opisany na platformie jako „Seedance 2 Pro”

```text
Na mojej platformie model jest opisany jako „Seedance 2 Pro”.
Pomóż mi ustalić, jaka wersja kryje się pod tą nazwą, a następnie
przygotowywać do niej prompty. Nie generuj obrazów ani filmów.

Jeśli nie podałem nazwy platformy, poproś o nią lub o zrzut ekranu
z ustawieniami. Na tej podstawie sprawdź dokumentację integracji.
Możesz zacząć od tych materiałów:
https://www.magnific.com/seedance/seedance-2
https://www.magnific.com/ai/docs/video-ai-models
https://seed.bytedance.com/en/seedance2_0

Nie traktuj nazw Pro, Standard, Fast i Mini jako zamienników.
Jeśli identyfikacja nadal będzie niepewna, napisz, czego nie udało się
ustalić. W takim przypadku korzystaj tylko z potwierdzonych zasad
rodziny Seedance 2.0 i nie podawaj niezweryfikowanych parametrów.

Gdy będziesz znać model, poproś o brakujące dane ujęcia: opis, długość,
proporcje obrazu i materiały. Jeżeli już je podałem, przygotuj prompt
bez dodatkowej rundy pytań.

Wyjaśnienia pisz po polsku, a prompt do generatora po angielsku.
Dopasuj go do generowania z tekstu, animacji pierwszej klatki lub
pracy z referencjami. Opisz działanie, ruch kamery i elementy,
które mają pozostać niezmienne.

Zachowaj język dialogu i treść napisów. Ich obsługę sprawdź dla
konkretnego wariantu. Negative prompt dodaj tylko wtedy, gdy istnieje
odpowiednie pole. Zwróć gotowy tekst w bloku kodu, a ustawienia pod nim.

Przy kolejnych ujęciach korzystaj z ustalonego modelu i platformy,
dopóki nie poproszę o zmianę.
```

---

## 3. Seedance 2.0 Fast

### Jak testować wariant Fast

Dokumentacja przedstawia Seedance 2.0 Fast jako wariant tej samej rodziny, z osobnymi ustawieniami. Nie wskazuje to na konieczność używania innego szyku zdań czy specjalnego języka. [Źródło: fal — Seedance 2.0](https://fal.ai/seedance-2.0).

W pierwszej próbie warto ograniczyć liczbę zmiennych. Sprawdź najpierw ruch kamery, potem dodaj animację otoczenia, a na końcu interakcję z przedmiotem. Jeżeli wynik pogorszy się po konkretnej zmianie, łatwiej będzie wskazać jej przyczynę. To metoda testowania, a nie stwierdzenie, że Fast nadaje się wyłącznie do prostych scen.

Przykład do zdjęcia produktu:

```text
One continuous shot based on the starting image. The camera slowly
moves forward toward the coffee package. The package stays fixed
on the table, with its front label visible throughout.

A small amount of steam rises from the cup behind it.
The soft window light remains constant.
```

W następnej próbie możesz dodać dłoń podnoszącą filiżankę. Nie zmieniaj wtedy jednocześnie oświetlenia, tła i kierunku ruchu kamery — inaczej trudno będzie ocenić, która modyfikacja wpłynęła na efekt.

### Język i ustawienia

W przykładach używamy angielskiego. Długość, proporcje obrazu i generowanie dźwięku ustawiaj osobno, zgodnie z możliwościami platformy.

Schemat API wskazany poniżej nie zawiera osobnego pola `negative_prompt` dla opisanego trybu Fast. Nie dodawaj takiego parametru na podstawie instrukcji do innego generatora. [Źródło: fal — Seedance 2.0 Fast, text-to-video](https://fal.ai/models/bytedance/seedance-2.0/fast/text-to-video/api).

#### Prompt startowy do ChatGPT — Seedance 2.0 Fast

```text
Pomagaj mi przygotowywać prompty do Seedance 2.0 Fast. Odpowiadaj
po polsku, a gotowe prompty pisz po angielsku. Nie generuj filmów.

Najpierw sprawdź dostępną dokumentację:
https://fal.ai/seedance-2.0
https://fal.ai/models/bytedance/seedance-2.0/fast/text-to-video/api
https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0

Krótko przedstaw najważniejsze zasady. Sprawdź funkcje mojej platformy,
gdy podam jej nazwę. Nie zakładaj, że Fast ma identyczne ustawienia
jak pozostałe warianty. Brak dostępu do źródła zaznacz wprost.

Jeśli nie opisałem ujęcia, poproś o jego opis, platformę, długość,
proporcje obrazu i materiały. Nie pytaj ponownie o znane informacje.
Gdy danych wystarcza, od razu przygotuj prompt.

Zachowaj główny pomysł i opisz zdarzenia w logicznej kolejności.
Rozdziel ruch kamery od ruchu obiektów. Przy animacji zdjęcia skup się
na zmianach. Materiałom referencyjnym przypisz konkretne zadania.
Nie rozbudowuj samodzielnie sceny o dodatkowe czynności i efekty.

Zachowaj nazwy marek, treść napisów i język dialogu. Sprawdź obsługę
mowy, jeżeli ujęcie jej wymaga. Negative prompt przygotuj tylko
wtedy, gdy obsługuje go wybrany tryb.

Zwróć jeden prompt w bloku kodu. Ustawienia długości, proporcji,
rozdzielczości i dźwięku podaj osobno, w zakresie dostępnym na platformie.
Przy następnych ujęciach korzystaj z wcześniej ustalonej konfiguracji.
```

---

## 4. Seedance 2.0 Mini

### Zacznij od ujęcia, które łatwo ocenić

Seedance 2.0 Mini pojawia się w katalogach Runway i Magnific. Materiały wskazane w poradniku nie zawierają jednak równie szczegółowej, osobnej instrukcji promptowania tego wariantu. Poniższe wskazówki są więc propozycją sposobu testowania, a nie opisem dodatkowych ograniczeń Mini. [Źródła: Runway — katalog modeli](https://docs.dev.runwayml.com/guides/models/), [Magnific — Seedance 2](https://www.magnific.com/seedance-2).

Zacznij od jednego zadania: kamera przesuwa się w bok, produkt stoi nieruchomo, a oświetlenie pozostaje stałe. Otwarcie opakowania, dialog i zmianę scenografii zostaw na osobne próby.

Porównując Mini z pełnym Seedance 2.0, użyj tego samego obrazu i możliwie identycznego promptu. W przeciwnym razie oceniasz jednocześnie model i różnice w opisie.

```text
The camera tracks slowly to the right, parallel to the table edge.
The coffee package remains stationary and fully in frame.
The camera movement creates gentle parallax between the package
and the background.

The package's shape, label design, and soft daylight remain
consistent with the starting image.
```

Angielski jest tutaj językiem roboczym. Nie przypisuj Mini automatycznie zasad starszych modeli z nazwą „Lite”. Dostępność referencji, dźwięku i ostatniej klatki sprawdzaj dla konkretnej integracji.

#### Prompt startowy do ChatGPT — Seedance 2.0 Mini

```text
Pomagaj mi pisać prompty do Seedance 2.0 Mini. Wyjaśnienia podawaj
po polsku, a gotowe prompty po angielsku. Nie generuj filmów.

Najpierw sprawdź dostępne informacje:
https://docs.dev.runwayml.com/guides/models/
https://www.magnific.com/seedance/seedance-2
https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0

Oddziel zasady wspólne dla Seedance 2.0 od informacji dotyczących
konkretnie Mini. Nie przenoś do niego funkcji wersji Lite ani 2.5.
Jeśli dokumentacja nie rozstrzyga danej kwestii, zaznacz to.

Jeśli nie podałem opisu ujęcia, poproś o opis, platformę, długość,
proporcje obrazu oraz materiały. Pytaj tylko o brakujące informacje.
Po poznaniu platformy sprawdź funkcje dostępne w tej integracji.

Przygotuj jeden prompt zgodny z moim pomysłem. Jasno określ działanie,
kierunek i tempo ruchu kamery oraz elementy nieruchome. Przy animacji
zdjęcia nie powtarzaj całego opisu jego wyglądu. Odwołuj się tylko
do materiałów, które rzeczywiście dołączyłem.

Jeśli działań jest zbyt wiele jak na długość klipu, wskaż problem
i zaproponuj ograniczenie ich liczby. Zachowaj treść napisów i język
dialogu, a obsługę mowy sprawdź osobno.

Zwróć gotowy prompt w bloku kodu i ustawienia po polsku. Negative
prompt oraz dodatkowe parametry podawaj wyłącznie po potwierdzeniu
ich dostępności. Przy kolejnych ujęciach zachowuj ustalone ustawienia.
```

---

## 5. Kling 2.5 / Kling 2.5 Turbo

### Opisuj osobno ruch kamery i ruch przedmiotów

W opisanej integracji fal pełna nazwa modelu zawiera „2.5 Turbo”, a dodatkowe oznaczenia określają wariant jakości. Sprawdź pełną nazwę przed doborem ustawień. [Źródło: fal — Kling 2.5 Turbo Standard](https://fal.ai/models/fal-ai/kling-video/v2.5-turbo/standard/image-to-video).

Poradnik Klinga dla text-to-video proponuje opis głównego obiektu lub postaci, działania i otoczenia, uzupełniony o kamerę i światło. W image-to-video ważniejszy jest ruch elementów, których wygląd określa już zdjęcie. [Źródło: Kling — poradnik text-to-video](https://kling.ai/quickstart/text-to-video-prompt-guide).

Jeżeli zdjęcie przedstawia opakowanie, filiżankę i zasłonę, możesz napisać:

```text
The camera tracks slowly to the right, parallel to the table edge.
The coffee package remains upright and stationary, with its front
label visible throughout.

Steam rises gently from the cup behind the package. The curtain
in the background sways slightly in a light breeze.
```

Każde zdanie dotyczy określonego elementu. Dzięki temu poprawka nie wymaga przepisywania całego promptu. Jeżeli na zdjęciu nie ma zasłony, nie dodawaj tego zdania tylko dlatego, że występuje w przykładzie.

Uważaj zwłaszcza na różnicę między „opakowanie obraca się” a „kamera porusza się po łuku wokół nieruchomego opakowania”. W pierwszym przypadku zmienia się położenie produktu. W drugim porusza się kamera. Gdy etykieta ma być widoczna przez cały czas, opisz niewielki łuk, a nie pełny obrót dookoła produktu.

### Instrukcje negatywne i język

W przykładach używamy angielskiego. Osobny *negative prompt* może zawierać krótką listę błędów istotnych dla ujęcia — pod warunkiem że wybrany tryb obsługuje takie pole.

W opisanym tutaj API Kling 2.5 Turbo Standard takie pole jest dostępne. Przykład:

```text
duplicate packages, distorted packaging, altered label design,
flickering lighting, sudden camera shake
```

Ten sam schemat opisuje parametr `cfg_scale`. Na początku pozostaw wartość domyślną. Jeżeli chcesz ocenić wpływ parametru, zmieniaj go przy zachowaniu tego samego promptu i materiału wejściowego. Maksymalna wartość nie powinna być traktowana jako ustawienie automatycznie najlepsze. [Źródło: fal — Kling 2.5 Turbo Standard, API](https://fal.ai/models/fal-ai/kling-video/v2.5-turbo/standard/image-to-video/api).

#### Prompt startowy do ChatGPT — Kling 2.5 Turbo

```text
Pomagaj mi przygotowywać prompty do Kling 2.5 Turbo. Odpowiadaj
po polsku, a prompty do generatora pisz po angielsku. Nie generuj wideo.

Najpierw sprawdź dostępną dokumentację:
https://kling.ai/quickstart/text-to-video-prompt-guide
https://kling.ai/quickstart/image-to-video-guide
https://fal.ai/models/fal-ai/kling-video/v2.5-turbo/standard/image-to-video/api

Krótko podsumuj zasady. Gdy podam platformę, sprawdź dostępny wariant
Standard lub Pro i jego ustawienia. Korzystaj z dokumentacji właściwej
dla tego wariantu. Zaznacz, jeśli nie uda się czegoś potwierdzić.

Jeśli nie podałem opisu ujęcia, poproś o opis, nazwę platformy,
długość, proporcje obrazu i materiały. Pytaj wyłącznie o brakujące dane.

Na podstawie mojego opisu przygotuj jeden prompt. W text-to-video
opisz główny obiekt, działanie, otoczenie i kamerę. W image-to-video
skup się na animacji widocznych elementów.

Jednoznacznie rozdziel ruch kamery od ruchu produktu. Określ kierunek,
tempo i zakres ruchu. Nie dodawaj niezamówionych cięć ani efektów.
Przy orbitowaniu dopasuj zakres ruchu do części produktu, która ma
pozostać widoczna.

Jeśli integracja obsługuje negative prompt, przygotuj osobno krótką
listę niepożądanych zmian. Nie wykluczaj napisów ani logotypów, które
mają pozostać w obrazie. Zachowaj nazwy marek i treść etykiet.

Zwróć prompt w bloku kodu, ewentualny negative prompt w drugim bloku
oraz ustawienia po polsku. Nie dodawaj nieudokumentowanych znaczników
ani wag słów. Przy następnych ujęciach korzystaj z ustalonej konfiguracji.
```

---

## 6. Kling 2.6 Pro

### Zaplanuj obraz i dźwięk jako jedną scenę

Poradnik Klinga 2.6 opisuje natywne generowanie dźwięku. Zaleca określenie sceny, działania i tego, co ma być słyszalne. Przy dialogu znaczenie mają osoba mówiąca, treść wypowiedzi oraz sposób jej wygłoszenia. [Źródło: Kling 2.6 — poradnik audio](https://kling.ai/quickstart/klingai-video-26-audio-user-guide).

Czytelny prompt może mieć osobne części dotyczące obrazu i dźwięku. Obie powinny jednak opisywać to samo zdarzenie. Jeżeli ma być słychać odstawienie filiżanki, uwzględnij tę czynność również w opisie obrazu.

```text
A barista stands behind a small café counter, holding a white cup.
The camera starts in a medium shot and slowly moves closer as the
barista places the cup beside the coffee package.

After setting down the cup, the barista looks toward the customer
and says in a relaxed tone, in English:
"Good morning. Your coffee is ready."

Audio: a soft tap as the cup touches the counter, followed by the
barista's voice. Quiet café ambience continues in the background.
```

Porusza się kamera, nie „plan średni”. Plan określa sposób kadrowania. W przykładzie wiadomo również, kiedy bohater odstawia filiżankę, kiedy zaczyna mówić i do kogo kieruje wypowiedź.

Przy dwóch rozmówcach używaj stałych określeń, np. „the barista” i „the customer”. Zaimek „she” może być niejednoznaczny, gdy w kadrze są dwie kobiety. W pierwszej próbie zaplanuj wypowiedzi kolejno, bez nakładania głosów.

### Uważaj na język dialogu

W dokumentacji producent wymienia mowę chińską i angielską oraz tłumaczenie innych języków na angielski. Nie planuj więc polskiej reklamy z natywnym polskim dialogiem bez sprawdzenia aktualnej integracji. Gdy język nie jest obsługiwany, osobno nagrany lub wygenerowany lektor jest alternatywnym sposobem realizacji. [Źródło: Kling 2.6 — poradnik audio](https://kling.ai/quickstart/klingai-video-26-audio-user-guide).

Angielski opis sceny nie wymaga zapisania angielskiej wypowiedzi wielkimi literami. Stosuj zwykłą pisownię, pozostawiając wielkie litery tam, gdzie są potrzebne, np. w nazwach i skrótach. [Źródło: fal — Kling 2.6 Pro, text-to-video](https://fal.ai/models/fal-ai/kling-video/v2.6/pro/text-to-video/api).

Jeżeli platforma pozwala przypisać zapisany głos do postaci, użyj rzeczywistego identyfikatora tego głosu. Przykładowy zapis `@VoiceName` nie tworzy nowego głosu i nie zadziała bez odpowiedniej konfiguracji.

#### Prompt startowy do ChatGPT — Kling 2.6 Pro

```text
Pomagaj mi pisać prompty do Kling 2.6 Pro. Wyjaśnienia podawaj po polsku,
a gotowe prompty po angielsku. Nie uruchamiaj generowania filmów.

Najpierw sprawdź dostępną dokumentację:
https://kling.ai/quickstart/klingai-video-26-audio-user-guide
https://fal.ai/models/fal-ai/kling-video/v2.6/pro/text-to-video/api

Podsumuj zasady dotyczące obrazu, dźwięku i języków mowy. Gdy podam
platformę, sprawdź możliwości konkretnego trybu, w tym obsługę audio
i negative promptu. Zaznacz informacje, których nie uda się potwierdzić.

Jeśli nie opisałem jeszcze ujęcia, poproś o opis, platformę, długość,
proporcje obrazu, materiały i ewentualny dialog. Pytaj tylko o brakujące
dane. Gdy mam już kompletny opis, od razu przygotuj prompt.

W prompcie oddziel opis obrazu od dźwięku, ale zachowaj ich zgodność.
Każdy efekt dźwiękowy przypisz do określonego zdarzenia. Każdą
wypowiedź przypisz do konkretnej postaci, z określeniem tonu i tempa.
Oceń, czy dialog i działania mieszczą się w długości klipu.

Przy animacji zdjęcia skup się na ruchu. Rozróżniaj sposób kadrowania
od ruchu kamery. Nie dodawaj postaci ani przedmiotów, o które nie proszę.

Zachowaj język i dokładną treść dialogu. Jeśli polska mowa nie jest
obsługiwana lub potwierdzona, wyjaśnij to i zaproponuj osobną ścieżkę
lektorską. Nie tłumacz samodzielnie wypowiedzi. Używaj wyłącznie
rzeczywistych identyfikatorów głosów dostępnych na mojej platformie.

Zwróć prompt w bloku kodu oraz ustawienia po polsku, w tym ustawienie
audio. Negative prompt dodaj tylko dla obsługującego go trybu.
Przy kolejnych ujęciach korzystaj z wcześniej ustalonych danych.
```

---

## 7. Kling 3.0 / Kling 3.0 Pro

### Zdecyduj: jedno ujęcie czy kilka ujęć

Instrukcja Klinga 3.0 opisuje tryb Multi-Shot, który pozwala planować sekwencję ze zmianami kadru. Wymienia też referencje elementów powiązane z obrazem początkowym. [Źródło: Kling 3.0 — instrukcja modelu](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

Przed pisaniem promptu określ, czy potrzebujesz jednego ciągłego ujęcia, czy krótkiej sekwencji. Gdy kamera ma wykonać płynny najazd bez cięć, możesz zacząć od:

```text
One continuous shot.
```

Nie dopisuj później „cut to a close-up”, bo oznacza to cięcie do innego ujęcia. Sprawdź również, czy ustawienia platformy odpowiadają zamierzonemu sposobowi realizacji.

Przykład sekwencji złożonej z trzech ujęć:

```text
Shot 1 — 4 seconds:
A medium shot of a coffee package and a cup on a kitchen table.
A hand enters from the right, gently turns the cup until its handle
points to the right, releases it, and leaves the frame.

Shot 2 — 4 seconds:
Cut to a close-up of the same package in the unchanged setting.
The camera slowly moves closer, keeping the front label in view.
The cup remains in the position established in the first shot.

Shot 3 — 4 seconds:
Cut to a wider, static view of the same tabletop arrangement.
Keep the package in the lower half of the frame, with clear space
above it for a title to be added during editing.
```

Rozpiska zakłada 12 sekund oraz tryb obsługujący taką sekwencję. Dłoń kończy działanie i wychodzi z kadru przed pierwszym cięciem, a filiżanka pozostaje w nowej pozycji. Dzięki temu przejścia nie wymagają od modelu samodzielnego rozstrzygania, co stało się z tymi elementami.

### Zachowuj te same referencje postaci i produktów

Jeżeli platforma pozwala zapisać produkt lub bohatera jako element referencyjny, odwołuj się do tego samego elementu we wszystkich ujęciach. Długi opis cech nie zastępuje prawidłowego podłączenia referencji.

Gdy do postaci przypisano już konkretny głos, nie definiuj w kolejnym ujęciu sprzecznej charakterystyki. Instrukcja Klinga zwraca uwagę na takie konflikty. [Źródło: Kling 3.0 — instrukcja modelu](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

### Język i wariant Pro

W przykładach stosujemy angielski. Dla generowanej mowy przewodnik wymienia chiński, angielski, japoński, koreański i hiszpański. Polski nie znajduje się na tej liście; dla innych języków opisano tłumaczenie na angielski. [Źródło: Kling 3.0 — instrukcja modelu](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

Oznaczenie Pro nie jest samo w sobie wskazaniem do używania innego stylu promptu. Sprawdź, jakie parametry i funkcje określa ono u danego dostawcy. [Źródło: Artlist — rodzina Kling 3](https://help.artlist.io/hc/en-us/articles/37026869403933-Kling-3-Model-Family).

#### Prompt startowy do ChatGPT — Kling 3.0 / Pro

```text
Pomagaj mi przygotowywać prompty do Kling 3.0 lub Kling 3.0 Pro.
Odpowiadaj po polsku, a tekst dla generatora pisz po angielsku.
Nie generuj obrazów ani filmów.

Najpierw sprawdź dostępną dokumentację:
https://kling.ai/quickstart/klingai-video-3-model-user-guide
https://help.artlist.io/hc/en-us/articles/37026869403933-Kling-3-Model-Family

Krótko przedstaw najważniejsze zasady. Po poznaniu mojej platformy
sprawdź wariant modelu, Multi-Shot, referencje elementów, audio
oraz negative prompt. Zaznacz, czego nie udało się potwierdzić.

Jeśli nie podałem opisu ujęcia, poproś o opis, platformę, długość,
proporcje obrazu i materiały. Pytaj tylko o brakujące informacje.

Ustal na podstawie mojego opisu, czy potrzebne jest jedno ciągłe ujęcie,
czy sekwencja. Nie łącz polecenia ujęcia bez cięć z instrukcjami cięcia.
Dla sekwencji przygotuj osobne opisy i czasy zgodne z wybranym trybem.
Dopilnuj ciągłości położenia przedmiotów i działań postaci między ujęciami.

Przy animacji pierwszej klatki skup się na ruchu. Używaj wyłącznie
rzeczywiście dołączonych referencji oraz istniejących nazw elementów.

Każdą wypowiedź przypisz do postaci. Zachowaj dokładną treść i język
dialogu, a ich obsługę sprawdź. Nie nadpisuj głosu przypisanego już
do referencji i nie tłumacz wypowiedzi bez mojej prośby.

Zwróć gotowy prompt lub opisy poszczególnych ujęć w blokach kodu.
Ustawienia podaj osobno po polsku. Dodatkowe pola uwzględniaj tylko,
gdy obsługuje je integracja. Przy kolejnych ujęciach korzystaj
z ustalonego modelu, platformy i referencji.
```

---

## 8. Kling 3.0 Turbo

### Najpierw sprawdź tryb i format wejścia

Schemat API Kling 3.0 Turbo Pro text-to-video opisuje pojedynczy `prompt` albo strukturę `multi_prompt` z osobnymi opisami i czasami ujęć. Są to alternatywne sposoby przekazania instrukcji, a nie dwa pola, które należy wypełniać jednocześnie. [Źródło: fal — Kling 3.0 Turbo Pro, API](https://fal.ai/models/fal-ai/kling-video/v3/turbo/pro/text-to-video/api).

W interfejsie graficznym wybierz najpierw właściwy tryb. Jeżeli platforma udostępnia osobne pola storyboardu, samo wpisanie „Shot 1, Shot 2” do zwykłego pola tekstowego nie zastępuje ich użycia.

Czytając dokumentację API, sprawdzaj sekcję **Input dotyczącą wybranego trybu**. Strona może zawierać również definicje typów danych wykorzystywanych gdzie indziej. Obecność nazwy `negative_prompt` lub `generate_audio` w dalszej części strony nie musi oznaczać, że dany tryb przyjmuje taki parametr. [Źródło: fal — Kling 3.0 Turbo Pro, API](https://fal.ai/models/fal-ai/kling-video/v3/turbo/pro/text-to-video/api).

### Opisz kierunek, tempo i zakres ruchu

Materiały wskazane w poradniku nie opisują odrębnej składni promptów dla Turbo. Możesz zacząć od takich samych konkretnych zdań jak w Klingu 3.0.

```text
One continuous product shot. The camera moves slowly to the right
along a small arc around the stationary coffee package, keeping
approximately the same distance from it.

The camera remains aimed at the package. Its front label stays
visible throughout, while the changing viewpoint creates gentle
parallax in the background.
```

Ten opis określa ruch po łuku. Nie należy go używać, gdy celem jest prostoliniowe przesunięcie w bok. Tempo ruchu podawaj w treści promptu; nazwa wariantu modelu go nie określa.

Angielski pozostaje językiem roboczym. Dostępność dialogu, referencji i dodatkowych parametrów sprawdzaj dla wybranego trybu, zamiast przenosić ustawienia z podstawowego Klinga 3.0.

#### Prompt startowy do ChatGPT — Kling 3.0 Turbo

```text
Pomagaj mi pisać prompty do Kling 3.0 Turbo. Wyjaśnienia podawaj
po polsku, a gotowe prompty po angielsku. Nie generuj filmów.

Najpierw sprawdź dostępną dokumentację:
https://fal.ai/models/fal-ai/kling-video/v3/turbo/pro/text-to-video/api
https://console.higgsfield.ai/models/kling-video/v3.0-turbo/text-to-video/playground
https://kling.ai/quickstart/klingai-video-3-model-user-guide

Podsumuj zasady istotne dla tego wariantu. Po poznaniu platformy
sprawdź funkcje konkretnego trybu i jego sekcję Input. Nie traktuj
parametrów innych modeli jako dostępnych w Turbo. Wątpliwości
wynikające z braku dokumentacji zaznacz wprost.

Jeśli nie opisałem ujęcia, poproś o opis, platformę, długość,
proporcje obrazu i materiały. Nie pytaj ponownie o znane informacje.

Dla pojedynczego ujęcia przygotuj jeden spójny prompt. Dla sekwencji
rozpisz osobne ujęcia i ich czasy, zgodnie z formatem wymaganym przez
platformę. Traktuj prompt i multi_prompt jako alternatywne sposoby
przekazania opisu, nie jako pola do równoczesnego wypełnienia.

Dokładnie określ kierunek, tempo i zakres ruchu kamery. Rozróżniaj
przesunięcie w bok, ruch po łuku, obrót kamery i zmianę ogniskowej.
Ruch produktu opisuj oddzielnie. Zachowaj mój pomysł bez dodatkowych
cięć, postaci i efektów.

Zachowaj język dialogu i sprawdź obsługę mowy dla wybranego trybu.
Audio, referencje i negative prompt uwzględniaj tylko wtedy, gdy są
dostępne w konkretnej integracji.

Zwróć gotowy tekst w bloku kodu oraz ustawienia po polsku.
Przy kolejnych ujęciach korzystaj z wcześniej ustalonej konfiguracji.
```

---

## 9. Kling O3 / Kling 3.0 Omni

### Przy edycji opisz zmianę, nie całą scenę od początku

Kling O3 należy odróżniać od podstawowego Klinga 3.0. Instrukcja Omni omawia referencje, elementy, głos i storyboard, a w zakresie edycji odsyła także do dokumentacji O1. [Źródło: Kling — instrukcja 3.0 Omni](https://kling.ai/quickstart/klingai-video-3-omni-model-user-guide).

Przy tworzeniu nowej sceny potrzebny jest opis tego, co ma powstać. Przy edycji gotowego nagrania ważniejsza jest instrukcja zmiany:

> Zastąp filiżankę z nagrania filiżanką ze zdjęcia referencyjnego. Zachowaj przebieg działania, pracę kamery i otoczenie.

Nie jest to ta sama sytuacja co opisywanie nowego ujęcia w Runway Gen-4. Bezpośrednie polecenie „zastąp” ma tu konkretny przedmiot i materiał bazowy.

Przykład edycji nagrania, w którym dłoń podnosi filiżankę i ponownie stawia ją na blacie:

```text
Replace the cup in the input video with the cup shown in the reference
image. Use the image only as a reference for the replacement cup,
not for the surrounding scene.

Keep the original hand movement, camera movement, tabletop, lighting,
and timing. Match the replacement cup to the original cup's position
and orientation throughout the shot.

Keep the fingers naturally wrapped around the handle, with correct
overlap between the hand and the cup. When the cup rests on the table,
maintain natural contact with the surface and a matching contact shadow.
```

Ostatni akapit określa relację dłoni, ucha filiżanki i blatu. Nie wymaga zachowania identycznego układu zasłaniania dla dwóch przedmiotów o potencjalnie różnych kształtach, lecz wskazuje oczekiwany naturalny kontakt.

### Wskaż zakres edycji i rolę każdego pliku

Wybierz jedno nagranie bazowe. Określ obiekt do zmiany, ewentualny fragment filmu oraz rezultat. Jeżeli wymieniasz tylko opakowanie, nie opisuj od nowa kuchni, ubrania postaci i charakteru światła.

Zdjęcie referencyjne może być wzorem wyłącznie dla produktu. Zaznacz to, aby opis nie sugerował przejęcia całego tła.

Instrukcja edycji opisuje m.in. wymianę elementów, zmianę otoczenia i stylu oraz wykorzystanie referencyjnego ruchu. Nie jest to jednak gwarancja zachowania każdego piksela poza zmienianym obiektem. [Źródło: Kling — instrukcja O1](https://kling.ai/quickstart/klingai-video-o1-user-guide).

Prompt przygotuj po angielsku. Obsługę audio sprawdzaj osobno dla generowania i edycji — obecność tej funkcji w jednym trybie nie potwierdza jej działania w drugim.

#### Prompt startowy do ChatGPT — Kling O3

```text
Pomagaj mi przygotowywać prompty do Kling O3 / Kling 3.0 Omni.
Odpowiadaj po polsku, a gotowy tekst dla generatora pisz po angielsku.
Nie uruchamiaj generowania obrazów ani filmów.

Najpierw sprawdź dostępną dokumentację:
https://kling.ai/quickstart/klingai-video-3-omni-model-user-guide
https://kling.ai/quickstart/klingai-video-o1-user-guide
https://help.artlist.io/hc/en-us/articles/37026869403933-Kling-3-Model-Family

Krótko podsumuj zasady. Gdy podam platformę, sprawdź możliwości
konkretnego trybu. Jeśli źródła są niedostępne lub nie rozstrzygają
danej kwestii, zaznacz zakres niepewności.

Jeżeli nie opisałem zadania, poproś o opis, platformę i materiały
oraz potrzebne ustawienia filmu. Pytaj tylko o brakujące dane.

Rozróżnij tworzenie nowej sceny, pracę z referencjami i edycję filmu.
Przy edycji wskaż nagranie bazowe, obiekt do zmiany, zakres zmiany
oraz elementy, które mają zostać zachowane. Nie przebudowuj całej
sceny, gdy proszę o wymianę jednego przedmiotu.

Każdej referencji przypisz konkretną rolę. Używaj tylko rzeczywistych
załączników i oznaczeń obsługiwanych przez platformę. Uwzględnij
położenie obiektu, kontakt z dłońmi i powierzchniami, wzajemne
zasłanianie elementów, cienie oraz ciągłość ruchu.

Opisuj zachowanie niezmienionych elementów jako wymaganie,
a nie gwarancję identyczności każdego piksela. Audio i negative
prompt sprawdź dla wybranego trybu, nie tylko dla całej rodziny modeli.
Zachowaj język dialogu i zweryfikuj jego obsługę.

Zwróć jeden prompt w bloku kodu oraz ustawienia po polsku.
Przy kolejnych zadaniach korzystaj z wcześniej ustalonych danych,
chyba że zmienię model, platformę lub sposób pracy.
```

---

## 10. Veo 3.1

### Oddziel opis obrazu od opisu dźwięku

Dla Veo angielski jest wyborem popartym dokumentacją Google, która deklaruje jego pełne wsparcie. Nie należy jednak utożsamiać języka instrukcji z obsługą każdego języka dialogu. [Źródło: Google — Veo w Gemini API](https://ai.google.dev/gemini-api/docs/veo).

Przy generowaniu z tekstu określ główny obiekt, otoczenie, działanie, kamerę i światło. Dźwięk opisz osobno, odnosząc go do tej samej sceny.

```text
A close-up product shot of a coffee package beside a white cup
and saucer on a pale wooden table in a quiet kitchen.

The camera slowly moves forward toward the package. Steam rises
gently from the cup. Soft morning light enters from the left.

A hand enters from the right, places a teaspoon on the saucer,
and leaves the frame. The package remains stationary.

Audio: quiet kitchen ambience, the faint sound of a kettle in the
background, and a light clink as the metal teaspoon touches the
ceramic saucer.
```

W tym przykładzie spodek i dłoń pojawiają się w opisie obrazu, a nie dopiero w instrukcji dotyczącej dźwięku. Odgłos jest przypisany do zetknięcia łyżeczki ze spodkiem.

Przy animacji zdjęcia skróć część dotyczącą wyglądu. Google zaleca dobrej jakości obraz wejściowy i unikanie zbędnego powtarzania jego zawartości. Użyj przykładu z łyżeczką tylko wtedy, gdy odpowiada on zdjęciu i zamierzonemu działaniu. [Źródło: Google Cloud — dobre praktyki generowania wideo](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/best-practice).

#### Dialogi

Podaj osobę mówiącą, dokładną treść wypowiedzi, język i ton. Długość tekstu musi odpowiadać długości klipu.

```text
The barista looks toward the customer and says warmly, in English:
"Take a moment. Your coffee is ready."
```

W przypadku polskiego dialogu sprawdź możliwości wybranej integracji i wykonaj próbę przed planowaniem większej produkcji. Deklarowane wsparcie angielskiego promptu nie jest potwierdzeniem niezawodnego generowania polskiej mowy.

### Negative prompt

Poradnik Google zaleca wymienianie niepożądanych elementów bez konstrukcji „no” i „don't”. Taka lista należy do osobnego pola, jeżeli platforma je udostępnia. [Źródło: Google Cloud — poradnik promptowania Veo](https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide).

```text
duplicate products, distorted packaging, altered label design,
flickering exposure, sudden camera shake
```

Nie wpisuj ogólnego „text”, jeśli etykieta produktu ma pozostać widoczna. Lista powinna wykluczać konkretne błędy, a nie elementy potrzebne w reklamie.

### Referencje oraz pierwsza i ostatnia klatka

Zdjęcie produktu użyte jako referencja nie musi być obrazem początkowym. W trybie referencyjnym określ cechy, które model ma przejąć. Przy pierwszej i ostatniej klatce opisz przebieg łączący oba obrazy.

Dokumentacja Google opisuje także rozszerzanie wideo, ale dostępność funkcji zależy od wariantu. Nie przenoś całego zestawu możliwości do Lite. [Źródło: Google — Veo w Gemini API](https://ai.google.dev/gemini-api/docs/veo).

#### Prompt startowy do ChatGPT — Veo 3.1

```text
Pomagaj mi pisać prompty do Veo 3.1. Odpowiadaj po polsku,
a gotowe prompty przygotowuj po angielsku. Nie generuj wideo.

Najpierw sprawdź dostępną dokumentację:
https://ai.google.dev/gemini-api/docs/veo
https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide
https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/best-practice

Krótko przedstaw zasady dotyczące obrazu, dźwięku i referencji.
Gdy podam platformę, sprawdź dostępne tryby i ustawienia. Zaznacz,
których informacji nie udało się potwierdzić.

Jeśli nie opisałem ujęcia, poproś o opis, platformę, długość,
proporcje obrazu, materiały i oczekiwany dźwięk. Pytaj tylko o dane,
których brakuje. Gdy opis jest kompletny, przygotuj prompt od razu.

W text-to-video określ wygląd, działanie, kamerę i światło.
W image-to-video skup się na ruchu. Rozróżniaj zdjęcie referencyjne,
pierwszą klatkę i ostatnią klatkę oraz przypisuj im właściwe role.

Dźwięk opisz osobno, ale zachowaj jego zgodność z obrazem. Jeżeli
ma być słychać konkretną czynność, uwzględnij ją w przebiegu sceny.
Każdy dialog przypisz do postaci, zachowując jego treść i język.
Sprawdź obsługę języka zamiast samodzielnie tłumaczyć wypowiedź.

Jeżeli integracja udostępnia negative prompt, przygotuj krótką listę
niepożądanych elementów bez konstrukcji „no” i „don't”. Nie wykluczaj
etykiet, napisów i logotypów, które mają zostać zachowane.

Zwróć prompt i ewentualny negative prompt w osobnych blokach kodu.
Ustawienia podaj po polsku, z uwzględnieniem dostępnej długości i trybu.
Przy kolejnych ujęciach korzystaj z wcześniej ustalonej konfiguracji.
```

---

## 11. Veo 3.1 Fast

### Korzystaj z tych samych zasad, ale sprawdzaj ustawienia wariantu

Dokumentacja Google nie wskazuje odrębnej składni dla Fast. Punktem wyjścia pozostają opis sceny, ruch kamery, dźwięk i ewentualny negative prompt. Dostępne ustawienia trzeba sprawdzić dla konkretnego wariantu. [Źródło: Google — Veo w Gemini API](https://ai.google.dev/gemini-api/docs/veo).

Do pierwszego testu wybierz jeden efekt, który łatwo ocenić. Na przykład: kamera ma się zbliżyć, a produkt pozostać nieruchomy.

```text
One continuous shot based on the starting image. The camera slowly
moves forward toward the coffee package, keeping its front label
fully in view. The package remains fixed on the table.
Steam rises gently from the cup.

Audio: quiet indoor ambience.
```

Przechodząc z Fast do innego wariantu, zachowaj prompt i materiały, jeżeli chcesz porównać wyniki. Nie traktuj jednak tej zmiany jak podniesienia rozdzielczości gotowego filmu. Powstaje nowa generacja, więc przebieg ujęcia może się różnić.

Instrukcję przygotuj po angielsku, zgodnie z wyborem języka przyjętym dla rodziny Veo. [Źródło: Google — Veo w Gemini API](https://ai.google.dev/gemini-api/docs/veo).

#### Prompt startowy do ChatGPT — Veo 3.1 Fast

```text
Pomagaj mi przygotowywać prompty do Veo 3.1 Fast. Wyjaśnienia pisz
po polsku, a tekst dla generatora po angielsku. Nie generuj filmów.

Najpierw sprawdź dostępną dokumentację:
https://ai.google.dev/gemini-api/docs/veo
https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide

Podsumuj najważniejsze zasady. Po poznaniu platformy sprawdź ustawienia
wariantu Fast. Nie przypisuj mu ograniczeń ani osobnej składni,
których dokumentacja nie potwierdza. Zaznacz ewentualne braki w źródłach.

Jeśli nie podałem opisu ujęcia, poproś o opis, platformę, czas,
proporcje obrazu, materiały i oczekiwany dźwięk. Pytaj tylko o brakujące
dane. Jeżeli informacji wystarcza, od razu przygotuj prompt.

Zachowaj mój pomysł. Przy animacji zdjęcia skup się na ruchu kamery,
obiektów i otoczenia. Dopasuj liczbę czynności do długości klipu.
Nie dodawaj samodzielnie cięć ani nowych elementów sceny.

Dźwięk opisz osobno, w zgodzie z obrazem. Dialog przypisz do konkretnej
postaci, zachowaj jego treść i język oraz sprawdź obsługę mowy.
Nie tłumacz wypowiedzi bez mojej prośby.

Negative prompt dodaj tylko w obsługującym go trybie, jako listę
niepożądanych elementów bez „no” i „don't”. Zmiany wariantu modelu
nie przedstawiaj jako sposobu na identyczne odtworzenie wcześniejszego
filmu w wyższej jakości.

Zwróć prompt w bloku kodu oraz ustawienia po polsku. Przy kolejnych
ujęciach korzystaj z wcześniej ustalonych danych.
```

---

## 12. Veo 3.1 Lite

### Dopasuj pomysł do dostępnych wejść

Według dokumentacji Gemini API wskazanej poniżej Lite obsługuje generowanie z tekstu i obrazu oraz pierwszą i ostatnią klatkę. Nie obsługuje natomiast wejścia `referenceImages`, rozszerzania wcześniejszego wideo ani generowania 4K. Przed realizacją sprawdź, czy informacje nadal odpowiadają wybranemu trybowi. [Źródło: Google — Veo w Gemini API](https://ai.google.dev/gemini-api/docs/veo).

Dopisanie w prompcie nazw kilku zdjęć nie zastąpi brakującego wejścia na referencje. Gdy chcesz animować konkretną kompozycję produktu, przygotuj odpowiedni obraz początkowy i opisz jego ruch.

Poniższy przykład zakłada fotografię produktu z kamery ustawionej nieco powyżej jego środka:

```text
The camera slowly lowers to the height of the package's front label,
keeping the same horizontal distance from the product. It adjusts
its tilt smoothly so that the package remains in frame, ending
with the label centered in the image.

The package and cup remain stationary. Steam rises gently from
the cup, and the lighting stays consistent with the starting image.
```

Opis rozdziela obniżenie położenia kamery od zmiany kierunku, w którym jest zwrócona. Ogólne „kamera porusza się w dół w stronę produktu” nie wyjaśnia, czy chodzi o zjazd, pochylenie kamery, czy najazd po skosie.

Ostatnią klatkę dołącz do właściwego pola, o ile platforma je udostępnia. Zdanie „end frame: attached image” nie przypisuje automatycznie zwykłego załącznika do funkcji klatki końcowej.

Angielski pozostaje językiem roboczym. Krótsze sceny są wygodne do testowania, ale nie stanowią same w sobie udokumentowanego wymogu Lite.

#### Prompt startowy do ChatGPT — Veo 3.1 Lite

```text
Pomagaj mi pisać prompty do Veo 3.1 Lite. Odpowiadaj po polsku,
a gotowe prompty po angielsku. Nie uruchamiaj generowania wideo.

Najpierw sprawdź dostępną dokumentację:
https://ai.google.dev/gemini-api/docs/veo
https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide

Sprawdź informacje dotyczące konkretnie Lite. Po poznaniu platformy
zweryfikuj również funkcje jej integracji. Nie przypisuj Lite
referencji, rozszerzania filmu ani rozdzielczości tylko dlatego,
że obsługuje je inny wariant Veo. Zaznacz niepotwierdzone informacje.

Jeśli nie opisałem ujęcia, poproś o opis, platformę, długość,
proporcje obrazu i materiały. Pytaj tylko o brakujące dane.

Na podstawie opisu przygotuj jeden prompt. Dopasuj go do generowania
z tekstu lub animacji obrazu. Pierwszej i ostatniej klatki używaj tylko,
gdy obsługuje je wybrany tryb. Nie traktuj zdjęcia jako przekazanego
modelowi, jeśli nie zostało dołączone do właściwego wejścia.

Jasno opisz działanie i ruch kamery. Rozróżniaj zmianę jej położenia
od obrotu lub pochylenia. Dźwięk powiąż z obrazem. Zachowaj język
dialogu i sprawdź jego obsługę. Negative prompt dodaj wyłącznie
po potwierdzeniu dostępności odpowiedniego pola.

Zwróć prompt w bloku kodu i ustawienia po polsku. Jeśli pomysł wymaga
niedostępnej funkcji, wskaż problem i zaproponuj najbliższy wykonalny
sposób realizacji. Przy następnych ujęciach zachowuj ustalone ustawienia.
```

---

## 13. Runway Gen-4.5

### Zacznij od konkretnego opisu, nie od długości promptu

Poradnik Runway podkreśla, że nie ma jednej obowiązkowej formuły ani idealnej liczby słów. Naturalne zdania pomagają opisywać relacje między elementami. Sama kolejność wymieniania cech nie jest udokumentowanym systemem przypisywania im wag. [Źródło: Runway — poradnik text-to-video](https://help.runwayml.com/hc/en-us/articles/42460036199443-Text-to-Video-Prompting-Guide).

W **text-to-video** opisz wygląd i ruch. W **image-to-video** zdjęcie określa kompozycję, światło i styl początkowego obrazu; prompt powinien skupiać się na tym, co ma się wydarzyć. [Źródło: Runway — Gen-4.5](https://help.runwayml.com/hc/en-us/articles/46974685288467-Creating-with-Gen-4-5).

Przykład do fotografii produktu:

```text
The camera moves slowly forward and slightly to the right along
a straight diagonal path. The coffee package stays fixed on the
table, with its front label visible throughout.

Steam rises gently from the cup. Near the end of the shot, the camera
gradually slows to a stop and holds a close-up of the package.
```

Z opisu wynika, że kamera przemieszcza się po linii prostej, a nie zatacza łuk. Zakończenie też jest określone: ruch stopniowo ustaje, po czym kamera utrzymuje kadr. Po pierwszej próbie możesz zmienić zakres przesunięcia lub wielkość produktu w ostatnim kadrze.

### Możesz opisywać kolejne etapy

Nie ma potrzeby sprowadzania każdej sceny do jednej czynności. Dokumentacja Gen-4.5 omawia zarówno naturalną kolejność działań, jak i przybliżone znaczniki czasu. [Źródło: Runway — poradnik image-to-video](https://help.runwayml.com/hc/en-us/articles/48324313115155).

Poniższy przykład zakłada filiżankę na pierwszym planie i opakowanie za nią:

```text
The camera remains stationary. The cup in the foreground is in focus,
while the coffee package behind it is softly out of focus.

A hand enters from the right, grasps the cup by its handle, and lifts
it out of the frame. As the cup leaves, focus shifts smoothly to the
coffee package, bringing its front label into sharp focus.
```

Zmiana ostrości nie jest tu połączona z nieokreślonym ruchem kamery. Najpierw wiadomo, co jest ostre, następnie co znika z pierwszego planu, a na końcu — na jaki obiekt przechodzi ostrość. Taki przebieg nadal musi mieścić się w długości klipu.

### Sprawdź zgodność ruchu ze zdjęciem

Rozmycie ruchowe, pochylona sylwetka albo układ przedmiotów mogą sugerować określony kierunek działania. Gdy prompt opisuje coś przeciwnego, obraz i instrukcja zaczynają sobie przeczyć. Runway zwraca uwagę na takie wizualne wskazówki. [Źródło: Runway — poradnik image-to-video](https://help.runwayml.com/hc/en-us/articles/48324313115155).

W przykładach używamy angielskiego i pozytywnych opisów oczekiwanego efektu. Nie dodawaj osobnego negative promptu bez potwierdzenia dostępności tego pola. Dźwięk zaplanuj oddzielnie, zamiast zakładać jego obsługę w samym modelu animacji.

#### Prompt startowy do ChatGPT — Runway Gen-4.5

```text
Pomagaj mi przygotowywać prompty do Runway Gen-4.5. Wyjaśnienia podawaj
po polsku, a gotowe prompty po angielsku. Nie generuj filmów.

Najpierw sprawdź dostępną dokumentację:
https://help.runwayml.com/hc/en-us/articles/46974685288467-Creating-with-Gen-4-5
https://help.runwayml.com/hc/en-us/articles/42460036199443-Text-to-Video-Prompting-Guide
https://help.runwayml.com/hc/en-us/articles/48324313115155-Image-to-Video-Prompting-Guide

Krótko podsumuj zasady. Po poznaniu platformy sprawdź obsługiwane
tryby i ustawienia. Zaznacz informacje, których nie uda się potwierdzić.

Jeśli nie podałem opisu ujęcia, poproś o opis, platformę, długość,
proporcje obrazu i ewentualne zdjęcie. Pytaj tylko o brakujące dane.

Przygotuj jeden prompt zgodny z moim pomysłem. W text-to-video opisz
wygląd i ruch. W image-to-video skup się na animacji, kamerze,
kierunku i tempie, bez powtarzania całej zawartości zdjęcia.

Pisz naturalnymi, konkretnymi zdaniami. Nie stosuj sztucznego limitu
słów ani nie traktuj kolejności określeń jako systemu wag. Opisuj
kolejne etapy i orientacyjne czasy tylko wtedy, gdy pomagają zrozumieć
przebieg sceny. Sprawdź, czy działania mieszczą się w długości klipu.

Rozróżniaj ruch kamery, zmianę ostrości i ruch obiektu. Sprawdź zgodność
instrukcji z obrazem wejściowym. Stosuj pozytywne opisy oczekiwanego
efektu zamiast długich list zakazów. Nie dodawaj niepotwierdzonego
negative promptu ani funkcji generowania dźwięku.

Zwróć prompt w bloku kodu i ustawienia po polsku. Jeśli zauważysz
sprzeczność, wyjaśnij ją krótko i zaproponuj poprawkę. Przy kolejnych
ujęciach korzystaj z wcześniej ustalonych ustawień.
```

---

## 14. Runway Gen-4 Turbo

### Zacznij od obrazu początkowego

W procesie opisanym w dokumentacji Runway Gen-4 Turbo wymaga obrazu wejściowego. Sam opis tekstowy nie zastępuje brakującej pierwszej klatki. [Źródło: Runway — katalog modeli](https://docs.dev.runwayml.com/guides/models/).

Poradnik Gen-4 zaleca zaczynać od prostego polecenia i stopniowo dodawać potrzebne szczegóły. Opisuj ruch obiektu, kamery i otoczenia. [Źródło: Runway — poradnik Gen-4](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide).

```text
The camera slowly moves forward toward the coffee package.
The package and cup remain stationary. Steam rises gently from
the cup, while the package's front label stays visible throughout.
```

Jeżeli taki najazd działa zgodnie z zamysłem, możesz dodać niewielkie przesunięcie w bok. Łączenie od razu orbity, zoomu, zmiany ostrości i ruchu produktu utrudni ocenę, która instrukcja spowodowała problem.

### Opisuj pożądany efekt zamiast zakazów

Runway wprost odradza negatywne sformułowania w promptach do Gen-4. Zamiast „no camera movement” użyj:

```text
The camera remains stationary.
```

Zamiast „the package must not move” napisz:

```text
The package remains stationary.
```

Oba zdania jednoznacznie określają pożądany stan. Długa lista „no blur, no deformation, no extra objects” nie jest zalecanym zamiennikiem konkretnego opisu ujęcia. [Źródło: Runway — poradnik Gen-4](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide).

Angielski pozostaje tutaj językiem roboczym. Gdy generacja się nie uda, sprawdź obraz początkowy i spójność ruchu, zanim zaczniesz wydłużać prompt.

#### Prompt startowy do ChatGPT — Runway Gen-4 Turbo

```text
Pomagaj mi pisać prompty do Runway Gen-4 Turbo. Odpowiadaj po polsku,
a gotowy tekst dla generatora pisz po angielsku. Nie generuj obrazów
ani filmów.

Najpierw sprawdź dostępną dokumentację:
https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide
https://docs.dev.runwayml.com/guides/models/

Podsumuj zasady istotne dla animacji zdjęcia. Gdy podam platformę,
sprawdź dostępne ustawienia. Zaznacz informacje, których nie udało się
potwierdzić.

Jeśli nie dołączyłem obrazu początkowego, poproś o niego. Uzupełnij
również brakujące dane: opis ruchu, nazwę platformy, długość i proporcje
obrazu. Nie pytaj ponownie o informacje, które już podałem.

Na podstawie zdjęcia i opisu przygotuj jeden prompt. Traktuj obraz
jako podstawę wyglądu sceny. Skup się na ruchu obiektów, kamery
i otoczenia, zamiast ponownie opisywać wszystkie szczegóły zdjęcia.

W gotowym prompcie stosuj pozytywne opisy oczekiwanego efektu.
Zamiast zakazu ruchu napisz, że kamera lub przedmiot pozostają
nieruchome. Nie dodawaj negative promptu, wag słów ani uprzejmych
wstępów takich jak „please add”.

Zachowaj mój pomysł i przygotuj jedno spójne ujęcie. Nie dodawaj cięć
ani niezależnych ruchów bez mojej prośby. Sprawdź, czy planowana
animacja nie przeczy temu, co widać na zdjęciu.

Zwróć prompt w bloku kodu oraz ustawienia po polsku. Przy kolejnych
zdjęciach korzystaj z wcześniej ustalonej konfiguracji.
```

---

## 15. MiniMax Hailuo 2.3 Fast

### Korzystaj z właściwych komend kamery

Dokumentacja MiniMax opisuje Hailuo 2.3 Fast jako wariant image-to-video, przyjmujący obraz początkowy i tekst animacji. Wymienia też komendy kamery zapisywane w nawiasach kwadratowych. [Źródło: MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

| Komenda | Zamierzony ruch |
| --- | --- |
| `[Push in]` | Najazd: kamera zbliża się do obiektu. |
| `[Truck right]` | Przesunięcie kamery w prawo, czyli zmiana jej położenia. |
| `[Pan right]` | Obrót kamery w prawo bez przesuwania jej w bok. |
| `[Tilt up]` | Pochylenie kamery ku górze, czyli zmiana kierunku patrzenia, a nie unoszenie kamery. |
| `[Static shot]` | Nieruchoma kamera i stałe kadrowanie. |

Komenda określa rodzaj ruchu. Zwykłym zdaniem doprecyzuj tempo i zachowanie obiektów:

```text
[Push in]
The camera moves slowly and smoothly toward the coffee package,
keeping its front label fully in view.

The package remains stationary on the table. Steam rises gently
from the cup. The shot ends on a close-up of the package.
```

Treść promptu przygotuj po angielsku, a nazwy komend zachowaj w oryginalnym zapisie. Nie tłumacz zawartości nawiasów na polski.

### Nie łącz ruchów bez potrzeby

Dokumentacja dopuszcza łączenie ruchów w jednym nawiasie i zaleca nie przekraczać trzech jednoczesnych komend. W pierwszym teście warto użyć jednej. Dzięki temu łatwiej ocenisz, czy model wykonuje właściwy rodzaj ruchu. [Źródło: MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

Sprawdź też ustawienie `prompt_optimizer`. Dokumentacja opisuje automatyczne przekształcanie promptu oraz możliwość wyłączenia tej funkcji. Gdy zależy Ci na porównaniu własnych, precyzyjnych opisów, sposób działania optymalizatora może wpływać na interpretację wyników. [Źródło: MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

### Nie przenoś funkcji z innych modeli MiniMax

W dokumentacji wskazanej poniżej osobny tryb pierwszej i ostatniej klatki dotyczy Hailuo-02. Nie stanowi to potwierdzenia obsługi ostatniej klatki w Hailuo 2.3 Fast. [Źródło: MiniMax — pierwsza i ostatnia klatka](https://platform.minimax.io/docs/api-reference/video-generation-fl2v).

Podobnie funkcja audio opisana dla H3 nie potwierdza jej dostępności w Hailuo 2.3 Fast. Dla omawianego sposobu pracy zaplanuj dźwięk oddzielnie, chyba że dokumentacja konkretnej integracji wskazuje inaczej.

#### Prompt startowy do ChatGPT — Hailuo 2.3 Fast

```text
Pomagaj mi przygotowywać prompty do MiniMax Hailuo 2.3 Fast.
Wyjaśnienia podawaj po polsku, a prompty do generatora po angielsku.
Nie generuj filmów.

Najpierw sprawdź dostępną dokumentację:
https://platform.minimax.io/docs/api-reference/video-generation-i2v
https://platform.minimax.io/docs/api-reference/video-generation-fl2v
https://hailuoai.video/tools/hailuo-2-3-model

Krótko podsumuj zasady animacji zdjęcia i komendy kamery. Po poznaniu
platformy sprawdź, które funkcje udostępnia jej integracja. Zaznacz,
czego nie udało się potwierdzić.

Jeśli nie dołączyłem obrazu początkowego, poproś o niego. Uzupełnij
brakujące dane: opis ujęcia, nazwę platformy, długość i proporcje obrazu.
Nie pytaj ponownie o informacje, które już podałem.

Przygotuj jeden prompt skupiony na animacji zdjęcia. Jeżeli integracja
obsługuje komendy MiniMax, dobierz właściwą komendę z dokumentacji
i zachowaj jej oryginalny zapis w nawiasach kwadratowych.

Rozróżniaj przesunięcie kamery, obrót, pochylenie i zoom. Określ tempo
oraz zakres ruchu. Nie łącz kilku ruchów, jeśli nie wynika to z mojego
opisu. Odwołuj się wyłącznie do rzeczywiście dołączonego obrazu.

Sprawdź dostępność prompt_optimizer. Omów to ustawienie osobno
od promptu i zaznacz, gdy jego włączenie oznacza automatyczne
przekształcenie opisu przed generowaniem.

Nie przypisuj temu modelowi funkcji Hailuo-02 ani H3. Ostatnią klatkę,
audio i negative prompt uwzględniaj tylko po potwierdzeniu ich obsługi
w wybranym trybie.

Zwróć prompt w bloku kodu i ustawienia po polsku. Przy kolejnych
zdjęciach korzystaj z wcześniej ustalonej konfiguracji.
```

---

## 16. MiniMax H3

### Rozdziel chmurę, otwarte wagi i tryb 2K

MiniMax H3 generuje wideo ze stereofonicznym dźwiękiem. Obsługuje tekst, pierwszą i ostatnią klatkę oraz materiały referencyjne, a oficjalny zakres długości wynosi 4–15 sekund. Publiczna wersja bazowa pracuje domyślnie w 768p przy 24 kl./s. [Źródło: MiniMax — generowanie wideo](https://platform.minimax.io/docs/guides/video-generation).

Otwarte wagi H3 można uruchomić w ComfyUI. Gotowe workflow obejmują text-to-video, FL2VA do animowania pierwszej i ostatniej klatki oraz Ref2VA do pracy z referencjami. W tych workflow odwołania mogą używać oznaczeń takich jak `<Picture 1>`, `<Video 1>` i `<Audio 1>`. Zawsze sprawdź składnię właściwą dla wybranej integracji. [Źródło: ComfyUI — workflow MiniMax H3](https://docs.comfy.org/tutorials/video/minimax/minimax-h3-native).

Turbo LoRA może zmniejszyć liczbę kroków lokalnej generacji, ale nie zmienia H3 w H3 Max ani H3 Max Turbo. Moduł H3-Regenerate-2K nie został udostępniony do lokalnej instalacji; producent oferuje ten proces przez API. Zwykły upscaler nie jest jego odpowiednikiem. [Źródło: Hugging Face — MiniMax H3](https://huggingface.co/MiniMaxAI/MiniMax-H3).

### Licencja i sprzęt w Polsce

**Licencja społecznościowa H3 wyłącza Unię Europejską, a więc również Polskę.** Przed pobraniem wag do lokalnej pracy trzeba potwierdzić odpowiednie uprawnienia. Licencja Professional oferowana przez Comfy zaczyna się od 5 000 USD miesięcznie. Generowanie w licencjonowanej usłudze chmurowej nie oznacza uzyskania licencji na własną instalację. [Źródło: Comfy — licencja MiniMax](https://comfy.org/minimax/license).

ComfyUI opisuje warianty ograniczające całkowite zapotrzebowanie na pamięć do około 42,5 GB oraz możliwość uruchomienia modelu z offloadingiem nawet na RTX 3060. Nie oznacza to potrzeby posiadania 42,5 GB VRAM. Poniższe wartości są ostrożnym punktem wyjścia, nie gwarantowanym minimum dla każdego workflow. [Źródło: ComfyUI — obsługa H3](https://blog.comfy.org/p/minimax-h3-day-0-support-in-comfyui).

| Element | Punkt wyjścia do testów | Częstsza praca |
| --- | --- | --- |
| Karta graficzna | NVIDIA 12 GB VRAM, oszczędna konfiguracja i offloading | NVIDIA 24 GB VRAM z właściwymi wagami |
| Pamięć RAM | 64 GB | 64–128 GB zależnie od workflow |
| Dysk | SSD NVMe i 100–150 GB wolnego miejsca | dodatkowy zapas na modele i pliki robocze |
| Pierwszy test | krótki klip, niższa rozdzielczość, jedna generacja | 768p i dłuższe ujęcia dopiero po pomiarze pamięci |

Nie podawaj jednej obietnicy czasu generowania. Uruchomienie modelu i wygodne wykonywanie wielu prób dziennie to różne wymagania.

#### Prompt startowy do ChatGPT — MiniMax H3

```text
Pomagaj mi przygotowywać prompty do MiniMax H3. Odpowiadaj po polsku,
a gotowe prompty do generatora pisz po angielsku. Nie generuj filmów.

Najpierw sprawdź dokumentację MiniMax H3 dla tekstu, pierwszej
i ostatniej klatki oraz materiałów referencyjnych. Rozróżnij oficjalne
API, lokalne workflow ComfyUI i funkcje platformy, z której korzystam.

Jeżeli nie opisałem ujęcia, poproś o platformę, tryb, długość,
proporcje obrazu, materiały i oczekiwany dźwięk. Pytaj tylko o brakujące
dane. Każdemu materiałowi referencyjnemu przypisz konkretną rolę.

Opisuj ruch kamery osobno od ruchu obiektów. Przy kilku czynnościach
ustal kolejność i zakończenie ujęcia. Nie przenoś komend Hailuo ani
ustawień H3 Max bez potwierdzenia ich obsługi.

Jeżeli chodzi o instalację lokalną w Polsce, najpierw sprawdź licencję,
sprzęt, wersję ComfyUI, kwantyzację i offloading. Nie utożsamiaj Turbo
LoRA z H3 Max Turbo i nie obiecuj lokalnego procesu Regenerate-2K.

Zwróć prompt w bloku kodu, a ustawienia i ograniczenia opisz po polsku.
```

#### Polecenie do Codex — przygotowanie lokalnego testu

```text
Przygotuj lokalną instalację MiniMax H3 w ComfyUI na tym komputerze.

Najpierw wykryj system, GPU, VRAM, RAM, sterownik i wolne miejsce.
Sprawdź aktualną dokumentację MiniMax oraz ComfyUI. Zweryfikuj warunki
licencji dla użytkownika w Polsce. Jeśli potrzebna jest osobna zgoda,
poinformuj mnie i nie pobieraj wag do czasu potwierdzenia uprawnień.

Po potwierdzeniu przygotuj odizolowaną instalację, dobierz zgodne
wersje PyTorch i bibliotek, pobierz tylko oficjalne pliki potrzebne
do jednego workflow image-to-video, ustaw kwantyzację i offloading
oraz wykonaj krótki test z pomiarem czasu i pamięci.

Nie utożsamiaj lokalnego H3 ani Turbo LoRA z H3 Max. Nie używaj
płatnego API, nie zmieniaj sterowników i nie wyłączaj zabezpieczeń
bez mojej zgody.
```

---

## 17. MiniMax H3 Max

### Traktuj H3 Max jako wariant chmurowy

H3 Max jest wariantem dostrojonym pod wykonywanie poleceń i szybsze generowanie. MiniMax udostępnia 480p i 768p, a integracja fal również 1080p. Zweryfikowane oferty dotyczą usług chmurowych i API. Nie przenoś na H3 Max instrukcji instalacji przeznaczonych dla otwartych wag zwykłego H3. [Źródła: MiniMax — generowanie wideo](https://platform.minimax.io/docs/guides/video-generation), [fal — MiniMax H3 Max](https://fal.ai/minimax-h3-max).

Przed generowaniem sprawdź wybraną rozdzielczość, długość, tryb wejścia i automatyczne rozwijanie promptu. Jeśli platforma nie dokumentuje osobnego pola negative prompt, wymagania dotyczące obrazu zapisz w głównym opisie.

#### Prompt startowy do ChatGPT — MiniMax H3 Max

```text
Pomagaj mi pisać prompty do MiniMax H3 Max. Odpowiadaj po polsku,
a gotowe prompty przygotowuj po angielsku. Nie generuj filmów.

Najpierw sprawdź aktualną dokumentację MiniMax i integracji, z której
korzystam. Rozróżnij H3, H3 Max, H3 Max Turbo i Hailuo. Nie zakładaj,
że funkcje oraz ustawienia tych wariantów są identyczne.

Jeśli brakuje danych, poproś o platformę, opis ujęcia, długość,
rozdzielczość, proporcje obrazu, materiały i dźwięk. Przygotuj jedno
spójne ujęcie, opisz kolejność działań i oddziel ruch kamery od ruchu
obiektów.

Sprawdź sposób automatycznego rozwijania promptu. Negative prompt,
dodatkowe referencje i audio uwzględniaj tylko po potwierdzeniu ich
obsługi w konkretnym trybie. Nie przedstawiaj H3 Max jako modelu
z publicznymi wagami do lokalnej instalacji.

Zwróć jeden prompt w bloku kodu i ustawienia po polsku.
```

---

## 18. MiniMax H3 Max Turbo

### Rozróżniaj H3, H3 Max i H3 Max Turbo

Według opisu fal H3 Max i H3 Max Turbo są wariantami rozwijanymi przez fal na bazie MiniMax H3. Nie należy utożsamiać ich z Hailuo 2.3 ani zakładać identycznych wejść i parametrów. [Źródło: fal — MiniMax H3 Max](https://fal.ai/minimax-h3-max).

**H3 Max Turbo jest jednym z najmocniejszych kandydatów do tanich prób reklamowych pod względem ceny generacji.** Nie oznacza to automatycznie najlepszego modelu jakościowo ani najniższej ceny na całym rynku. Ostatecznie porównuj koszt zaakceptowanego ujęcia, a nie sam koszt uruchomienia modelu.

| Model i miejsce generowania | Stawka bazowa | 5 sekund | 10 sekund | 30 sekund materiału |
| --- | ---: | ---: | ---: | ---: |
| H3 Max Turbo, 768p — fal, promocja | 0,02 USD/s | 0,38 zł | 0,76 zł | 2,28 zł |
| H3 Max Turbo, 1080p — fal, promocja | 0,04 USD/s | 0,76 zł | 1,52 zł | 4,56 zł |
| H3 Max Turbo, 768p — Magnific Premium+ rocznie | 200 kredytów / 5 s | 0,47 zł | 0,94 zł | 2,83 zł |

Stan danych: **18.09.2026**. Promocja fal kończy się 30.09.2026; zgodnie z opublikowanym cennikiem późniejsze stawki mają być dwukrotnie wyższe. Wartości Magnific zakładają wykorzystanie całej rocznej puli 600 000 kredytów.

Opis może łączyć obraz, kamerę i dźwięk, o ile wybrany tryb obsługuje te elementy. Przy kilku kolejnych czynnościach określ, co dzieje się najpierw, co potem i jak kończy się ujęcie.

Przykład zakłada obraz początkowy z opakowaniem i filiżanką stojącymi na blacie:

```text
One continuous shot based on the starting image. The camera is
initially stationary, and the coffee package stays fixed throughout.

A hand enters from the right and gently rotates the cup on the table
until its handle points toward the camera. The hand releases the cup
and leaves the frame.

The camera then slowly moves forward toward the package, keeping
the front label in view. It gradually slows to a stop and holds
a close-up for the end of the shot.

Audio: quiet indoor ambience and a soft scraping sound as the base
of the cup moves across the table.
```

Filiżanka pozostaje na blacie podczas obrotu, dłoń kończy czynność przed najazdem, a kamera zatrzymuje się na końcu. Nie trzeba ponownie opisywać wszystkich kolorów i przedmiotów widocznych na zdjęciu.

Angielski jest w tym poradniku językiem roboczym. Nie jest to wniosek z testu porównującego skuteczność poszczególnych języków w H3 Max Turbo.

### Sprawdź automatyczne rozwijanie promptu

Schemat API fal opisuje parametr `prompt_expansion_mode`, w tym ustawienia `balanced`, `quality` i `disabled`. Ostatnie wyłącza rozwijanie promptu. W odpowiedzi może być dostępny również tekst po przekształceniu. [Źródło: fal — H3 Max Turbo, text-to-video](https://fal.ai/models/minimax/h3-max-turbo/text-to-video/api).

Przy ogólnym pomyśle rozwijanie może być częścią przyjętego sposobu pracy. Przy dokładnym scenariuszu warto porównać wynik z wyłączonym przekształcaniem, jeśli platforma pozwala zmienić to ustawienie. Nie oceniaj wtedy wyłącznie wpisanego tekstu — sprawdź też, czy przed generacją nie został rozszerzony.

Nie przenoś do H3 Max komend Hailuo w nawiasach bez potwierdzenia ich obsługi. W opisanym tutaj podstawowym schemacie H3 Max Turbo nie wskazano też osobnego pola `negative_prompt`. [Źródło: fal — H3 Max Turbo, text-to-video](https://fal.ai/models/minimax/h3-max-turbo/text-to-video/api).

#### Prompt startowy do ChatGPT — H3 Max Turbo

```text
Pomagaj mi pisać prompty do MiniMax H3 Max Turbo. Odpowiadaj po polsku,
a gotowe prompty przygotowuj po angielsku. Nie generuj filmów.

Najpierw sprawdź dostępną dokumentację:
https://fal.ai/minimax-h3-max
https://fal.ai/models/minimax/h3-max-turbo/text-to-video/api
https://platform.minimax.io/docs/guides/video-generation

Rozróżnij H3, H3 Max, H3 Max Turbo i Hailuo. Podsumuj zasady dotyczące
wybranego modelu. Gdy podam platformę, sprawdź funkcje jej integracji.
Zaznacz informacje, których nie udało się potwierdzić.

Jeśli nie opisałem ujęcia, poproś o opis, platformę, długość,
proporcje obrazu, materiały i oczekiwany dźwięk. Pytaj tylko o brakujące
dane. Gdy opis jest kompletny, przygotuj prompt od razu.

Opisz działanie i ruch kamery naturalnymi zdaniami. Przy kilku
czynnościach ustal ich kolejność i zakończenie. Przy animacji pierwszej
klatki skup się na zmianach, bez powtarzania całego opisu zdjęcia.

Dźwięki przypisuj do konkretnych zdarzeń, a dialog do określonych
postaci. Zachowaj treść i język wypowiedzi oraz sprawdź obsługę mowy.
Nie dodawaj niezamówionych czynności, cięć ani efektów.

Sprawdź prompt_expansion_mode i omów dostępne ustawienia poza promptem.
Nie przenoś automatycznie komend kamery z Hailuo. Negative prompt
oraz dodatkowe wejścia referencyjne uwzględniaj wyłącznie wtedy,
gdy obsługuje je konkretny tryb.

Zwróć jeden prompt w bloku kodu i ustawienia po polsku. Oddziel
zalecenia z dokumentacji od własnych propozycji. Przy kolejnych
ujęciach korzystaj z wcześniej ustalonej konfiguracji.
```

---

## 19. Wan 3.0

### Korzystaj z instrukcji do właściwej wersji

Materiały fal wskazane poniżej opisują generowanie z tekstu, obrazu i referencji. Wymieniają też automatyczne rozwijanie promptu oraz dodatkowe planowanie przed generacją. [Źródło: fal — Wan 3](https://fal.ai/wan-3).

Nie oznacza to, że można bez sprawdzenia skopiować ustawienia i rozbudowane listy negatywne z lokalnych konfiguracji Wan 2.x. Wybierz dokumentację konkretnego trybu Wan 3.0.

Angielski jest przyjętym tutaj językiem roboczym. Przyjęcie takiej konwencji nie oznacza, że model zawsze działa lepiej po angielsku niż po chińsku lub w innym języku.

### Opisz scenę i jej przebieg

W text-to-video zacznij od miejsca i układu przedmiotów. Następnie określ ruch oraz końcowe kadrowanie.

```text
A close-up product shot in a small, sunlit kitchen. A coffee package
stands beside a ceramic cup on the counter.

The package is slightly to the right of center in the opening frame.
The camera tracks slowly to the right, parallel to the counter,
with a fixed viewing direction. The move ends with the package near
the center of the frame and its front label fully visible.

Steam rises gently from the cup while the package remains stationary.

Audio: quiet kitchen ambience and the faint sound of a kettle
in the background.
```

Początkowe położenie produktu i kierunek przesunięcia są ze sobą powiązane. Opis nie wymaga jednocześnie nieruchomego kierunku patrzenia i stałego wycentrowania produktu przez cały ruch.

Przy referencjach określ rolę każdego materiału. Schemat Wan 3.0 opisuje odwoływanie się do obrazów i filmów według ich pozycji na liście wejść. Stosuj oznaczenia właściwe dla tej integracji, a nie automatycznie znaczniki znane z Seedance. [Źródło: fal — Wan 3.0, reference-to-video](https://fal.ai/models/alibaba/wan-3.0/reference-to-video/api).

```text
Use the first reference image for the coffee package's shape,
colors, and label design.

Use the first reference video only for the camera movement.
Place the package in a new, bright kitchen setting rather than
recreating the background from the reference video.
```

### Parametry ustawiaj poza promptem

W opisanej integracji `enable_thinking` i `enable_prompt_expansion` są osobnymi ustawieniami. Wpisanie „think carefully” do opisu sceny nie jest równoważne zmianie ich wartości.

Przy zaplanowanym ujęciu reklamowym warto określić długość i proporcje obrazu, zamiast pozostawiać je automatyce. Ułatwia to porównywanie kolejnych prób.

W opisanym tutaj podstawowym schemacie text-to-video nie wskazano osobnego pola `negative_prompt`. Wymagania dotyczące wyglądu produktu zapisz więc w głównym opisie, bez dodawania nieobsługiwanego parametru. [Źródło: fal — Wan 3.0, text-to-video](https://fal.ai/models/alibaba/wan-3.0/text-to-video/api).

#### Prompt startowy do ChatGPT — Wan 3.0

```text
Pomagaj mi przygotowywać prompty do Wan 3.0. Wyjaśnienia podawaj
po polsku, a gotowe prompty po angielsku. Nie generuj filmów.

Najpierw sprawdź dostępną dokumentację:
https://fal.ai/wan-3
https://fal.ai/models/alibaba/wan-3.0/text-to-video/api
https://fal.ai/models/alibaba/wan-3.0/reference-to-video/api

Krótko podsumuj zasady dla wersji 3.0. Po poznaniu platformy sprawdź
funkcje wybranego trybu. Nie przenoś automatycznie parametrów Wan 2.x.
Zaznacz informacje, których nie udało się potwierdzić.

Jeśli nie podałem opisu sceny, poproś o opis, platformę, długość,
proporcje obrazu, materiały i oczekiwany dźwięk. Pytaj tylko o brakujące
dane. Gdy opis jest kompletny, od razu przygotuj prompt.

W text-to-video opisz wygląd sceny i ruch. W image-to-video skup się
na animacji. Referencjom przypisz konkretne zadania i stosuj oznaczenia
obsługiwane przez integrację. Nie kopiuj znaczników z innych modeli.

Rozdziel ruch kamery od ruchu obiektów. Sprawdź zgodność położenia
początkowego, kierunku ruchu i końcowego kadrowania. Kolejne działania
opisuj w logicznej kolejności.

Dźwięk opisz osobno, w zgodzie z obrazem. Dialog przypisz do postaci,
zachowaj jego treść i język oraz sprawdź obsługę mowy.

Ustawienia enable_thinking i enable_prompt_expansion omów po polsku
poza promptem. Nie zastępuj ich poleceniami wpisanymi do opisu sceny.
Negative prompt dodaj tylko po potwierdzeniu dostępności tego pola.

Zwróć gotowy prompt w bloku kodu oraz ustawienia po polsku.
Przy kolejnych ujęciach korzystaj z wcześniej ustalonej konfiguracji.
```

---

## Jak opisać ujęcie w kolejnej wiadomości do ChatGPT?

Nie musisz znać fachowych nazw ruchów kamery. Opisz zwykłym językiem, co ma się wydarzyć. Ważne, aby oddzielić ruch kamery od zachowania obiektów i wskazać, do czego służy załącznik.

Przykład wiadomości po wybraniu modelu:

```text
Platforma: Higgsfield.
Model: ten, który wybraliśmy wcześniej w tej rozmowie.
Długość: 10 sekund. Jeśli ten tryb nie obsługuje takiej długości,
wskaż dostępne możliwości.
Proporcje obrazu: pionowe 9:16.

Dołączone zdjęcie ma być pierwszą klatką filmu, a nie tylko
referencją wyglądu produktu.

Chcę spokojne ujęcie reklamowe. Kamera ma powoli przesuwać się
po prostej w prawo i jednocześnie nieznacznie zbliżać do produktu.
Nie chodzi mi o orbitę wokół niego ani o zoom.

Produkt ma przez cały czas stać w tym samym miejscu i się nie obracać.
Przód opakowania powinien pozostać widoczny. Na końcu potrzebuję trochę
wolnego miejsca nad produktem, ponieważ napis dodam później w Premiere.

Bez dialogu. Dźwięk dodam samodzielnie podczas montażu.
Zachowaj otoczenie i oświetlenie ze zdjęcia. Nie dodawaj nowych osób
ani przedmiotów.

Najważniejsze są niezmieniony wygląd produktu i płynny ruch kamery.
Jeżeli proponowane kadrowanie jest sprzeczne ze zdjęciem, wskaż problem
zamiast samodzielnie zmieniać koncepcję.
```

Proporcje obrazu, czyli *aspect ratio*, określają stosunek szerokości do wysokości. Zapis 9:16 oznacza pionowy kadr; nie jest informacją o liczbie pikseli. Rozdzielczość wybierz osobno wśród ustawień udostępnionych przez platformę.

W wiadomości do ChatGPT możesz używać polskich zakazów, takich jak „produkt ma się nie obracać”. To opis zadania, a nie gotowy prompt do generatora. Czat powinien przełożyć intencję na sformułowania odpowiednie dla modelu — np. „The package remains stationary” w Runway.

## Jak poprawiać prompt po nieudanej generacji?

Zamiast pisać jedynie „zrób lepiej”, wskaż różnicę między zamysłem a wynikiem. Najbardziej użyteczna uwaga określa obiekt, rodzaj błędu i moment, w którym problem się pojawia.

Ogólne:

> Wygląda sztucznie.

Konkretne:

> Kamera zatoczyła łuk, chociaż miała przesunąć się po prostej w bok. Od trzeciej sekundy opakowanie staje się szersze. Ruch pary wygląda dobrze — nie zmieniaj dotyczącej go instrukcji.

Poprawiaj jedną kategorię problemu naraz. Ułatwi to ocenę, czy zmiana promptu rzeczywiście pomogła.

| Problem | Co sprawdzić lub zmienić |
| --- | --- |
| Produkt obraca się zamiast kamery | Osobno opisz nieruchomy produkt i zamierzony ruch kamery. |
| Pojawiają się niechciane cięcia | Sprawdź tryb Multi-Shot oraz sformułowania sugerujące przejście do kolejnego ujęcia. |
| Zmienia się wygląd produktu | Sprawdź jakość materiału wejściowego, rolę referencji i zakres ruchu. Samo wydłużenie promptu nie rozwiązuje przyczyny. |
| Postać wykonuje czynności w złej kolejności | Uporządkuj działania i określ, w jakim stanie scena pozostaje po każdym z nich. |
| Dialog wypowiada niewłaściwa osoba | Używaj stałych określeń postaci i przypisz każdą wypowiedź oddzielnie. |
| Wynik odbiega od precyzyjnego opisu | Sprawdź, czy platforma automatycznie rozwija lub przepisuje prompt, i uwzględnij tę funkcję przy porównaniu prób. |

Stopniowe dopracowywanie instrukcji odpowiada podejściu opisanemu przez Runway. W opisanych integracjach MiniMax i Wan znaczenie mogą mieć również ustawienia przekształcające prompt przed generacją. [Źródła: Runway — poradnik Gen-4](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide), [MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v), [fal — Wan 3.0, text-to-video](https://fal.ai/models/alibaba/wan-3.0/text-to-video/api).

### Czego nie rozstrzyga dokumentacja?

W poradniku wskazano najwięcej szczegółowych materiałów dla Runway, Veo, Klinga i Seedance 2.5. Nie przedstawiono równie rozbudowanego, osobnego podręcznika promptowania Seedance 2.0 Mini. Nazwa „Seedance 2 Pro” wymaga rozpoznania na konkretnej platformie. Nie podano też porównywalnych badań, które pozwalałyby wybrać jeden najlepszy język promptów dla wszystkich omawianych modeli.

Zamiast zapamiętywać uniwersalny przepis „zawsze 150 słów, zawsze angielski, zawsze długa lista negatywna”, zapisuj konfigurację udanych prób: model, platformę, tryb, materiały, prompt i ustawienia. Przy kolejnym ujęciu będziesz mieć punkt odniesienia, a nie tylko ogólną zasadę, która może nie pasować do wybranego narzędzia.

---

*Nota redakcyjna: poprawiono język, składnię, spójność instrukcji i logikę przykładowych scen. Informacje o funkcjach modeli oraz odsyłacze zachowano na podstawie dostarczonego artykułu. Ta redakcja nie obejmuje ponownej weryfikacji dokumentacji ani testów generatorów.*
