Áttekintés
Kie.ai egyenleg
—
WaveSpeed egyenleg
—
Kérések (7 nap)
—
Használt modellek
—
Összes generálási idő eddig
—
Válassz egy eszközt a bal oldali "1. Válaszd ki a modellt" listából a kezdéshez — a korábban generált eredményeid lent, az "Eredmények" alatt mindig megtalálod (a "Legrégebbi elöl" gombbal időrendben is átnézheted őket).
🎨 Generátor
Válassz egy modellt — a lenti mezők automatikusan a kiválasztott modellhez igazodnak (kép/videó/audio referenciák, prompt, paraméterek).
🎞️ Videó Frame Extractor
Kinyer egyedi képkockákat egy videófájlból — minden a böngésződben történik, a videó soha nem hagyja el a gépedet, nincs feltöltés, nincs API kulcs.
🎬 Húzz ide egy videófájlt, vagy tallózás
A kinyerés innen kezdődik: 00:00:00.000 (a lejátszóval, a csúszkán állítható)
🧬 Modell-generátor
Új AI karakter a semmiből. Állítsd be a választókat (a „🎲 véletlen” opcióknál a Gemini dönt), kattints az Arcok generálása gombra, és válaszd ki a 4 arc közül a legjobbat. Ebből automatikusan elkészül 3 további kép ugyanarról az emberről (3/4-es nézet, félalak, egész alak). Bármelyiket újragenerálhatod. A végén egy kattintással karakterként (LoRA) mented, és rögtön használhatod az Automata videóban, a LoRA képcserében és az Insta-sztori generátorban.
② Karakterlap
③ Bővített képsor (opcionális)
További képek ugyanarról az emberről: más szögek, pózok, ruhák és helyszínek (közeli, profil, ülő, tükörszelfi, egész alak oldalról stb.). Minden kép a portrét, a 3/4-es nézetet és az egész alakos képet kapja referenciaként, a Gemini által rögzített testleírással együtt, így az arc és a testarányok (mellméret, derék, csípő, lábak) minden képen ugyanazok maradnak. A Gemini-ellenőrzés 1–10-ig pontozza az arc és a test egyezését.
④ Mentés karakterként
A karakterbe max. 10 kép kerül (ennyit fogadnak a modellek referenciaként, és így fér el a böngésző tárhelyén): a portré, a 3 karakterlap-kép és az extra képek közül a legjobb pontszámúak. Az összeset ZIP-ben is letöltheted.
📸 Insta-sztori generátor
Megadod, hány kép kell, és egy gombnyomással kész. A Gemini megnézi a karakter képeit (arc, haj, testalkat), és annyi különböző sztori-jelenetet ír, ahány képet kértél: más helyszín, más beállítás (szelfi, tükörszelfi, más fotózza közelről vagy távolabbról), más póz és napszak. Két kép nem lehet ugyanolyan helyszínen ugyanolyan beállítással. Utána pontosan annyi kép generálódik, ahányat kértél, próbakép és plusz generálás nélkül. Ha valamelyik nem sikerül, csak azt kérheted újra.
Ha feltöltesz egy hátteret (pl. a saját szobádat, egy kávézót, egy medencét), minden kép ezen a helyszínen készül: ugyanaz a hely, bútorok, színek és fények, de más-más ponton, szögből és pózban. Ha üresen hagyod, a Gemini változatos helyszíneket választ.
🧑🎤 LoRA képcsere
Válaszd ki a karaktert (LoRA), és töltsd fel a képet, amit újra akarsz generálni. Az app a kép helyére a karaktert teszi: az arcot és a testformát a karakter képeiből veszi, a testtartást és az arckifejezést a feltöltött képből. Ha a karakternek több képe van, mindet felhasználja. Promptot nem kell írnod, csak ha még valamit változtatnál.
🎬 Szöveg + LoRA videó
Írd le, mi történjen a videóban, és válaszd ki a karakter(eke)t. A karakterek képei referenciaként mennek a modellnek (arc, haj, testalkat), a jelenetet a leírásod adja — referencia videó nem kell. A leírásban a karaktereket a hívószavukkal említsd (pl.
anna), így a modell tudja, ki kicsoda. Kell hozzá Kie.ai kulcs, a prompt-íráshoz pedig (ajánlott) Gemini kulcs.Ha feltöltesz egy hátteret (pl. szoba, kávézó, utca), a karakterek erre a helyszínre kerülnek: ugyanaz a hely, bútorok, színek és fények. Ha üresen hagyod, a helyszín a leírásodból jön.
⚡ Automata videó
Egy gombnyomásra végigmegy az egész folyamaton: a videó egy kockájából és a kiválasztott karakterből (LoRA) elkészíti az Image 1-et, a Gemini megírja hozzá a Seedance 2.5 promptot a bevált @Image1/@Video1 sablon szerint, majd elindítja a videógenerálást. Kell hozzá: Kie.ai kulcs (videó), Gemini kulcs (prompt), és a kép lépéshez WaveSpeed vagy Kie.ai kulcs.
Legfeljebb 30 mp-es videó (a Seedance 2.5 ennyit fogad), max. kb. 150 MB. Nagyobb fájlnál (kb. 13 MB fölött) az app automatikusan a Gemini fájlfeltöltését használja, a Kie.ai-ra pedig stream-feltöltéssel küldi.
Koppints a karakterekre a kiválasztáshoz. A sorrend számít: az 1. a videó fő szereplőjét cseréli, a 2. a második személyt, a 3. a harmadikat (ha vannak a videóban). A Gemini mindegyikről külön elemzést és külön promptrészt ír. Újat bal oldalt, a Karakterek panelen tudsz felvenni.
A Wan 3.0 megkapja a karakter képét (Image 1: arc, haj, testarányok) és a referencia videót (Video 1: mozgás, kamera, időzítés). A prompt a lenti sablon. Ha a „Ruha” mezőben színt vagy új ruhát adsz meg, a Gemini csak a WARDROBE részt (és a ruhára utaló pár szót) írja át, minden más szó szerint marad. A „Rejtett amerikai zászló” pipával egy háttér-zászló szakasz is bekerül. A referencia videó max. 15 mp lehet.
Feltöltesz egy képet (vagy a kiválasztott karakter első képe lesz az). A Gemini a képből veszi az arcot, a ruhát és a helyszínt, a videóból csak a mozgást, a kamerát, az időzítést és a szöveget. A promptot „Global Instructions / CRITICAL REALISM & IDENTITY RULES / Second-by-Second Breakdown” szerkezetben írja meg. A Seedance a képet Image 1-ként, a videó eredeti hangját Audio 1-ként kapja, szájszinkronnal. Nano Banana képgenerálás nincs, így az a költség is elmarad.
A kiválasztott kockát kivágja, Nano Banana-val vagy Seedream-mel ráteszi a karakter(eke)t, és ha kéred, átszínezi vagy lecseréli a ruhát. A Gemini ezután megkapja az új képet és a videót, és kockáról kockára leír mindent: minden személy mozgását, a kamerát (csak ami tényleg történik, kitalált zoom és effekt nélkül), valamint szó szerint, hogy ki mit mond, a kamera mögötti hangot is. A Seedance ebből a képből (első kockaként) és a leírásból generálja a videót, a beszédet is ő mondja el, azonos nemű hangon. A kocka időpontja a videó kezdőpontja lesz.
„Eredeti hang” módban a videó hangsávja Audio 1-ként megy a Seedance-nek, és a szájmozgás ehhez igazodik. A kép ilyenkor Image 1 karakter- és ruha-referencia, nem kötelező első kocka. Ha a böngésző nem tudja kiolvasni a hangsávot, automatikusan a Seedance mondja el.
A megadott időpont ±0,2 mp-es környezetéből a legélesebb kockát veszi ki, veszteségmentes PNG-ként. Ha 2–4 változatot kérsz, ennyi kép generálódik egyszerre (mindegyik külön kerül pénzbe), a folyamat megáll, és te választod ki a legjobbat, vagy kérhetsz újakat.
Az app kivágja a videó hangsávját, és külön hangreferenciaként (@Audio1) küldi a Seedance-nek, hogy ugyanazt mondja ugyanazon a hangon, és a szájmozgás ehhez igazodjon. Ha a videóban nincs hang, automatikusan hang nélkül folytatja.
✏️ Mit mondanak? — írd át
Írd át a mondatokat, vagy töröld a ✕ gombbal. Az időzítés marad. Ha egy mondat jóval hosszabb lesz az eredetinél, sárga figyelmeztetést látsz, mert lehet, hogy nem fér bele az idejébe.
Koppints egy képre a teljes mérethez, a gombbal választod ki.
✨ Prompt Generátor
Geminikép/videó referencia alapján
GrokxAI, videóból kockakivágással
Írd le pár szóban / mondatban, mit szeretnél — a Gemini megírja belőle a részletes, a képgeneráló modelleknek megfelelő promptot. Ehhez a jobb oldalon add meg a Gemini API kulcsodat (ingyenesen igényelhető).
Ebben a módban a "Mit szeretnél generálni?" mezőbe írd le a jelenetet és a párbeszédet (kik beszélnek, mit mondanak — idézőjelben), a mellékszereplők kinézetét, a helyszínt. A Gemini a csatolt Kép 1 (fő karakter/outfit) és Videó 1 (kamera/jelenet-referencia) alapján egészíti ki, és a végén te magad adod hozzá az audio fájlt a generáláskor.
Videónál maradj rövid klipnél (pár másodperc) — nagy fájlnál a kérés elutasításra kerülhet.
Csatolj egy videót és/vagy egy képet, majd írd le, mit szeretnél kérni tőle — a Grok ez alapján megírja a generálási promptot. Ehhez a jobb oldalon add meg a Grok (xAI) API kulcsodat. Fontos: a Grok API videót közvetlenül nem tud megnézni — ha csatolsz egyet, az app automatikusan kivág belőle egy képkockát, és azt küldi el a képpel együtt.
Ebben a módban a Grok NEM ír le semmit magáról a személyről (arc, haj, bőrszín, testalkat/alkat) — csak a ruházatot, a testtartást cselekvésként (pl. "ül", "sétál"), a helyszínt/hátteret, a kompozíciót és a fényviszonyokat írja le. Az azonosságot és a testalkatot a karakter-referenciaképek (a "LoRA" megoldásod) adják hozzá automatikusan generáláskor.
Ez a funkció egy meglévő képet ("Kép 1") generál újra úgy, hogy közben egy karakter/identitás-képet ("Kép 2") vesz alapul — pl. lecseréli a jelenetben szereplő személyt egy másik karakterre, miközben a jelenetet/kompozíciót megtartja. Pontos modellnevet lásd: docs.kie.ai-n.
Te döntöd el, hány képet adsz hozzá — a hozzáadás sorrendje számít: az elsőként hozzáadott kép lesz a promptban "Kép 1" (amit újragenerálsz), a második "Kép 2" (a karakter/identitás), és így tovább. Ha kihagyod a karakterképet, de a promptba beleírsz egy mentett karakter hívószavát, az automatikusan pótolja a hiányzó képet.
Haladó paraméterek (nyers JSON, egyesítve az input mezővel)
Pontos modellneveket lásd: docs.kie.ai. Kling 3.0 választásakor az app automatikusan átalakítja a mezőket (
image_urls/image, mode, sound) a Kling saját sémájára.Legalább egy kép szükséges * — a hozzáadás sorrendje számít.
Haladó paraméterek (nyers JSON, egyesítve az input mezővel)
A Motion control a mozgást/kamerát egy referencia videóból veszi át, és arra "ülteti rá" a megadott karakter-képeket és a promptot. Csak olyan modellel működik, amely támogatja a
reference_video_urls mezőt (Seedance 2.0/2.5) vagy dedikált motion-control módot (Kling 3.0 — ennél az app automatikusan átalakítja a mezőket input_urls/video_urls-re, és a character_orientation-t "image"-re állítja, hogy a karakterkép arca domináljon a videó mozgása felett). Pontos modellneveket lásd: docs.kie.ai.💡 Tippek tiszta mozgás-másoláshoz
A referencia videó: legyen rövid (kb. 3–8 másodperc), egyetlen, vágás nélküli beállítás, és csak EGYFAJTA mozgást tartalmazzon — vagy a kamera mozog, vagy az alany, ne mindkettő egyszerre. Sima háttér és stabil fény segít, hogy a modell ne a zajt/textúrát kövesse.
A prompt: NE írd le újra a mozgást — azt úgyis átadja a referencia videó. Írd le inkább a stílust (pl. "puha nappali fény, semleges paletta"), a karakter stabil jellemzőit (haj, ruha színe), és erősítsd meg röviden a kamera-szándékot (pl. "finom közelítés"). Legfeljebb 4–5 stílusjelzőt használj, és ne írj ellentmondó igét (pl. ne írj "álló kamera"-t, ha a referencia mégis közelít).
Hibaelhárítás: ha remeg/ugrál az eredmény, vágd rövidebbre a referenciát és csökkentsd benne az apró rezdüléseket/zajt. Ha a kameramozgást figyelmen kívül hagyja a modell, hangsúlyozd ki jobban a mozgást a referenciában, és tartsd középen az alanyt.
A prompt: NE írd le újra a mozgást — azt úgyis átadja a referencia videó. Írd le inkább a stílust (pl. "puha nappali fény, semleges paletta"), a karakter stabil jellemzőit (haj, ruha színe), és erősítsd meg röviden a kamera-szándékot (pl. "finom közelítés"). Legfeljebb 4–5 stílusjelzőt használj, és ne írj ellentmondó igét (pl. ne írj "álló kamera"-t, ha a referencia mégis közelít).
Hibaelhárítás: ha remeg/ugrál az eredmény, vágd rövidebbre a referenciát és csökkentsd benne az apró rezdüléseket/zajt. Ha a kameramozgást figyelmen kívül hagyja a modell, hangsúlyozd ki jobban a mozgást a referenciában, és tartsd középen az alanyt.
Legalább egy videó szükséges * (ebből veszi a mozgást/kamerát) — kép(ek) és audio opcionális, hogy kit/mit tegyen a videóba.
Haladó paraméterek (nyers JSON, egyesítve az input mezővel)
Az audio-vezérelt (pl. szinkron / lipsync) generáláshoz a pontos bemeneti mezőnevet ellenőrizd a docs.kie.ai oldalon — ha a modell más mezőnevet vár, írd be lent a haladó JSON-be.
Legalább egy kép * és egy vezérlő audio * szükséges.
Haladó paraméterek (nyers JSON, egyesítve az input mezővel)
Ez a Wan 2.2 Animate modell — nem azonos a Wan 3.0-val. "Csere" módban a videóban szereplő embert lecseréli a megadott karakterképre, miközben a videó háttere/mozgása/kamerája megmarad. "Mozgás-átvitel" módban fordítva: a karakterkép saját identitása/háttere marad, csak a mozgást veszi át a videóból. Pontos modellneveket lásd: docs.kie.ai.
Legalább egy videó szükséges *. Karakterkép opcionális, ha a promptba beleírod egy mentett karakter hívószavát — akkor a karakter-referenciaképek automatikusan pótolják.
Haladó paraméterek (nyers JSON, egyesítve az input mezővel)
Ha "model not found" hibát kapsz, nézd meg a pontos nevet docs.kie.ai-n.
Opcionális — kép→kép szerkesztéshez adj hozzá bemeneti képe(ke)t. Ha üresen hagyod, tiszta szöveg→kép generálás történik.
Haladó paraméterek (nyers JSON, egyesítve az input mezővel)
A Kie.ai-nál a dedikált face-swap modell pontos azonosítóját ellenőrizd a docs.kie.ai oldalon, és írd be fent, ha eltér ettől. Fontos: a Seedream modellek elsősorban kép-generálásra készültek, nem dedikált arccsere-modellek — ha ilyet választasz, előfordulhat, hogy más bemeneti mezőneveket várnak (ezt az app a modell nevéből automatikusan igyekszik felismerni), és a két referenciakép a "kép szerkesztés" input-jaként kerül elküldésre a prompttal együtt.
A hozzáadás sorrendje számít: az elsőként hozzáadott kép lesz "Kép 1" (a forrás arc, akinek az identitását átvesszük), a második "Kép 2" (a cél kép, ahová az arc kerül) *. Ha kihagyod a forrás arcot, de a promptba beleírsz egy mentett karakter hívószavát, az automatikusan pótolja.