K-Pop Dance with VFX and Lip Sync
Full prompt
spoken_language: Japanese motion: Normal speed, high density, smooth temporal resolution equivalent to 60fps [Reference Material] R1@image1 = Sole reference for person + full-body outfit. Maintains face, skin, eyes, hair, hair ornaments, body proportions, gender expression, age impression, outfit, decorations, accessories, shoes, materials, colors, and length for 30 seconds. Automatically adapts gender, appearance, skeleton, physique, expressions, gestures, and voice quality from R1. Does not inherit background, lighting, composition, or still poses. R2@image2 = Reference for stage, architecture, floor, wall, ceiling, background, furniture, decorations, props, ambient light, time of day, color temperature, and spatial layout. Do not add non-existent structures or people. [Completed Video] High-density K-POP performance by R1 (adult) in R2 live-action space. Maintain choreography, speed, footwork, waacking, body isolation, shoulder hits, chest accents, pivots, turns, and traveling. VFX analyzes R1's primary colors and randomly switches between INK, PAINTERLY, and PIXEL for each action. VFX follows arms, wrists, fingertips, feet, etc., with a 0.15–0.7s delay. Do not originate VFX from the chest or torso front. [Music/Song/Voice] 128 BPM, bright rhythmic K-POP × hip-hop. Dance actions synced to specific sounds. Character's singing and speaking voices automatically adapt to R1's appearance and persona. Full lip-sync for the song from 0–30s, except for three specific spoken dialogue sections where singing lip-sync stops and spoken lines are delivered. No repetition, extra lines, or subtitles. [VFX] Extract 2-4 prominent colors from R1. INK = translucent liquid ink; PAINTERLY = dry-brush ribbons; PIXEL = color blocks/trails. Randomly switch between the three. VFX follows specific body parts (shoulders, arms, feet) during movement. No VFX for body waves or chest hits. Do not overlap with face or chest. [30-Second Timeline] 00.0–03.0 | 50mm medium close. Spoken line: "Hey... won't you play until the moon is hidden?" 03.0–06.0 | 35mm full body. Shoulder hits, waacking, turn. 06.0–09.0 | Footwork, pivot, shoulder isolation. 09.0–12.5 | Traveling left, vogue geometry, finger to lens. 12.5–15.5 | Lateral tracking. Spoken line: "Keep those eyes only on me for now." 15.5–19.0 | Back tap, chest contract, 180-degree turn. 19.0–22.5 | 28mm wide-medium. Shoulder groove, hip accents, spiral arms. 22.5–25.0 | 40mm medium-full. Hand near hair, body wave. 25.0–27.5 | Foot switch, 180-degree pivot turn. 27.5–29.0 | Forward groove. Spoken line: "Caught you. I won't let you go anymore." 29.0–30.0 | Final pose, trailing VFX, fading. [Camera/Human Lock] Focal length changes. Clear grounding. Hands must always have 5 fingers each. [Avoid] Fixed gender/voice, inconsistent voice, subtitles, extra people, simplified choreography, face distortion, VFX on chest. [Top Priority] 1. Consistent R1 identity, 2. Natural voice adapted to R1, 3. R2 stage consistency, 4. Strict timing, 5. Continuous song lip-sync, 6. Perfect dialogue lip-sync, 7. No repetition, 8. R1-color-based random VFX, 9. 5 fingers per hand, 10. Realistic physics. [Reference Adaptation Lock] Do not fix gender. Maintain consistency based on R1 features. Seamless transition between singing and speaking.
Original prompt
spoken_language: Japanese motion: 通常速度、高密度、60fps相当の滑らかな時間解像感 【参照素材】 R1@image1=人物+全身衣装の唯一参照。顔、肌、瞳、髪、髪飾り、身体比率、性別表現、年齢印象、衣装、装飾、アクセサリー、靴、素材、色、丈を取得し、30秒間同一人物・同一衣装を維持。R1が男性なら男性、女性なら女性として扱い、外見・骨格・体格・表情・所作・声質をR1へ自動適応する。性別を固定指定せず、R1から自然に判定する。背景、照明、構図、静止ポーズは継承しない。 R2@image2=舞台、建築、床、壁、天井、遠景、家具、装飾、小道具、環境光、時間帯、色温度、空間配置を参照。存在しない構造や人物を追加しない。 【完成映像】 R1の成人人物がR2の実写空間で行う高密度K-POP performance。振付、速度、footwork、waacking、body isolation、shoulder hit、chest accent、pivot、turn、travelingを維持。VFXはR1の主要色、髪色、衣装色を解析し、各動作ごとにINK、PAINTERLY、PIXELからランダムに1種だけ出現。黒固定にせず、腕、手首、指先、足、pivot、turn、travelingを0.15~0.7秒遅れて追う。胸部・胴体前面を発生源にしない。 【音楽・歌・声】 128 BPM、bright rhythmic K-POP × hip-hop。tight kick、punchy bass、crisp snare、closed hi-hat、funky synth、plucked synth、short brass、keyboard。shoulder hit=snare、heel-toe/cross=kick+hat、wrist snap=dry click、waacking=synth sweep、pivot=bass pickup、turn=高速hat roll+reverse synth、着地=kick+bass。00~03秒bass pulse+percussion motif、03秒full beat、15.5秒hat+bass増加、24秒final build。EDM drop、長いbreak、テンポ変更なし。 主人公の歌声と通常声はR1の人物像へ自動適応。R1が男性的なら自然な成人男性域、女性的なら自然な成人女性域、それ以外もR1の外見・年齢印象・キャラクター性に最も自然な声域、音色、話し方へ合わせる。別人の声にしない。 00.0~30.0秒、音楽の歌唱パートは主人公が最初から最後まで継続して正確にLip Syncする。歌詞の各音節、母音、子音、口・唇・顎の動きを歌唱音声へ同期し、ダンス中も歌の口パクを止めない。ただし三台詞の指定区間だけ歌唱Lip Syncを完全停止し、その区間では歌詞を発音せず、主人公の台詞だけを一度発話する。台詞終了直後から次の歌詞位置へ自然に復帰し、歌唱Lip Syncを再開。台詞中の音楽はinstrumentalのみで、歌声を重ねない。三台詞の復唱、追加台詞、英訳、字幕なし。 【VFX】 R1から目立つ2~4色を抽出。INK=半透明liquid ink、wet pigment、calligraphy streak。PAINTERLY=dry-brush、paint ribbon。PIXEL=小色ブロック、pixel trail、dither cluster。3種類を重ねず動作ごとにランダム切替。肩hit=肩外側、waacking/arm sweep=腕後方、heel-toe=床接地点、cross=足元間、pivot=支点足周囲、turn=身体外周、finger wave=指先後方。body wave、chest hit、contract、releaseにはVFXなし。顔、胸、胴体前面へ重ねない。 【30秒タイムライン】 00.0–03.0|50mm medium close、左寄り。00.8瞳だけカメラへ。01.1片手を顎下、手首を返す。01.35–02.70だけ歌唱Lip Syncを止め「ねえ……月が隠れるまで、遊ばない?」を一度だけ発話し日本語音素へ完全同期。02.70で口を閉じ、復唱せず直後から歌唱Lip Syncへ復帰。最後の「い?」で右踵を上げ02.8 kick着地、足元へ極小ランダムVFX。 03.0–06.0|35mm全身。03.0右踵着地+右肩hit、03.3左肩hit、03.6胸郭left→front→right isolation。04.0右足cross、左手を顔横、右腕低い対角線。04.4両手首反転→waacking circle。04.9半回転、顔を先にカメラへ。05.3左足横、右足引寄せ、05.7chest hit。肩、waacking、turnへランダムVFX。胴体動作には出さない。歌唱Lip Sync継続。 06.0–09.0|06.0 right step+left wrist snap、06.4 left step+right shoulder、06.8腕cross→解放。07.1 heel→toe→cross。0.4秒だけ膝高斜め正面で脚・靴・衣装下部と顔を同一構図。07.7 body wave、08.1右45度pivot、08.5肩right→left→both、08.8顎を2cm上げ瞳だけカメラへ。footwork、pivot、肩へランダムVFX。歌唱Lip Sync継続。 09.0–12.5|左へtraveling、カメラ右後方。09.0 cross、09.4胸郭右、09.8非対称vogue geometry、10.1解放。10.4 right-left高速前進、10.9左手頭上、右人差し指をレンズへ。11.2指先を約3cm前で停止、顔と瞳は明瞭。11.4口角を僅かに上げ、11.6指を横へ引き右腕→左腕→両腕waacking。12.2chest hit、12.5後退step。腕、前進、指先、waackingへランダムVFX。歌唱Lip Sync継続。 12.5–15.5|カメラ左側を横切りstep→cross→肩前後hit。13.35–14.65だけ歌唱Lip Syncを止め、顔をカメラへ向け「その目、まだ私だけにして。」を一度だけ発話し完全同期。14.65で終了し復唱せず歌唱Lip Syncへ即復帰。足とgrooveは止めない。14.7首を約7度傾け、15.0両腕内cross→外、15.2正面。台詞中VFXは足元のみ、15.0腕軌道へ1種。 15.5–19.0|15.5右足前+left shoulder、15.8左足横+right shoulder、16.1 back tap+chest contract、16.4release。16.6右腕上・左腕下、16.9対角反転、17.1両手首内→外、17.3 heel→toe→cross、17.6右90度、17.9胸郭左sharp isolation、18.1左arm sweep、18.3右follow、18.5両腕頭上経由で高速180度turn。18.8顔が先にカメラ再捕捉、19.0強いchest hit。肩、腕、footwork、turnへランダムVFX。胴体にはなし。歌唱Lip Sync継続。 19.0–22.5|28mm wide-medium。19.0前進shoulder groove、19.5右hip→左hip accent、20.0腕を上から外へ。20.4左pivot45度、20.8腕を低位置からspiral。21.2右足を強く踏み胸+肩hit。21.7左足前、両腕を顔横cross。22.1手の隙間からカメラを見る。腕後方、床面、腕先、足接地点へランダムVFX。胸には出さない。歌唱Lip Sync継続。 22.5–25.0|40mm medium-full。22.5右手がR1の髪または髪飾り付近を通過。髪飾りがある場合のみ自然に近づける。22.8 finger wave→手首→肘→肩→胸→腰、23.5全身body wave。23.9左足前+右肩、24.2右足前+左肩、24.5両腕cross、24.7頭上へ開き25.0beatで外へ弾く。22.8は指と腕だけVFX、身体へ波が移行した時点で終了。歌唱Lip Sync継続。 25.0–27.5|25.0 right step+chest、25.3 left step+shoulder roll、25.6 rapid foot switch、25.9腕を頭上から斜め下へ切る。26.2左45度turn、26.4右手横、26.6左手が半拍遅れて追従。26.8両腕回収、27.0右足支点で高速180度turn、27.3正面へ戻り両肩hit。肩、foot switch、arm cut、turnへランダムVFX。歌唱Lip Sync継続。 27.5–29.0|前進groove。27.5右足+left shoulder、27.8左足+right shoulder、27.9少し伏せ28.0瞳だけ上げる。28.00–28.82だけ歌唱Lip Syncを止め「捕まえた。もう、帰さないよ。」を一度だけ発話し完全同期。28.82で終了、復唱せず歌唱Lip Syncへ即復帰。28.9右手でカメラ方向の空気をそっと握り、腕外側VFXを手付近へ凝縮。 29.0–30.0|右足斜め前、左足を細く後方。身体は正面から約20度斜め。左手は腰付近、右腕は顔横の曲線。顎を少し下げ瞳だけカメラ固定。29.0凝縮VFXを背後へ一筆arcまたはpixel trailとして流す。29.5以降崩れ30.0までに透明化。髪、衣装、装飾だけ0.1~0.3秒遅れて静まる。29.0 final kick+bass+short brass。28.82以降30.0まで歌唱Lip Sync継続。 【カメラ・人体ロック】 00–03秒50mm push-in、03–09秒35mm全身backtracking、09–12.5秒28~35mm接近、12.5–15.5秒lateral tracking、15.5–19秒35mm追従、19–22.5秒28mm、22.5–25秒40mm、25–30秒35mm。03秒以降2秒以上停止しない。接地、支点、重心を明瞭化。VFXは動作後へ追従。左右の手は常に各5本指。6本指、欠損、融合なし。 【避ける】 性別・声の固定化、R1と異なる声、歌唱中の無表情な閉口、歌唱Lip Sync停止、台詞中の歌詞発音、同一台詞の複数発話、復唱、口パクずれ、追加台詞、字幕、別人、顔交換、R1にない髪・衣装・装飾、余分な人物、分身、簡略振付、反復、スロー、床滑り、顔崩れ、布貫通、ゲームCG、R2と異なる背景、胸・胴体前面VFX、身体貼付VFX、顔を覆うVFX、黒一色固定、同一VFX連続、巨大墨塊、文字・人物・生物生成。 最優先:1.R1人物・性別表現・衣装固定、2.R1に適応した自然な歌声・話声、3.R2舞台固定、4.振付・時刻固定、5.台詞区間以外は00~30秒の歌唱へ連続Lip Sync、6.三台詞中のみ歌唱を止め各1回だけ完全Lip Sync、7.台詞反復禁止、8.R1配色INK/PAINTERLY/PIXELランダムVFX、9.左右各5本指、10.実写人体・衣装物理。 【参照適応ロック】 R1の性別を男性・女性へ固定しない。顔立ち、骨格、体格、髪、衣装、化粧、年齢印象から人物表現を読み取り、その人物本人として一貫させる。歌声と台詞声同じ人物の声として統一し、声の高さだけで判定しない。女性参照を男性化、男性参照を女性化しない。中性的な参照は中性的特徴を保持。振付の力感や表情はR1へ適応するが、指定タイミング、手足の軌道、速度、カメラ、VFX発生条件は変えない。歌唱と台詞の切替点では声質を変化させず、同一人物のまま滑らかに接続する。
Generate this with Seedance 2 on VdoBloom.
Opens the image-to-video creator with this prompt and Seedance 2 pre-selected.