Aller au contenu

Prompt Hotel Lobby AI : celui qu’on envoie, plus 5 à copier

Un prompt Hotel Lobby AI doit verrouiller le décor orange, le micro unique partagé, qui se tient où et qui rappe. Beaucoup de prompts en ligne sont devinés ; les deux ci-dessous sont les vrais, ceux que notre studio envoie pour chaque prise. Le premier tourne sur Wan 3.0, notre modèle par défaut, et garde la piste Hotel Lobby. Le second est la version Seedance, qui écrit un rap neuf. Viennent ensuite cinq prompts que nous avons écrits pour les outils qui n’acceptent que deux photos, puis l’explication ligne par ligne et un tableau de dépannage. Ou saute tout ça : le studio ajoute le prompt pour toi.

Revu le

Un carnet de consignes, des portraits et une photo de scène.

PROMPT IA HOTEL LOBBY

Diriger la performance

  • Personnes
  • Mouvement
  • Son
AI · Illustration · Hotel Lobby Video

Le prompt Wan 3.0 qu’envoie notre studio

Cette version sert deux photos dans n’importe quel format ; le ratio part comme réglage du modèle, pas dans le texte. Avant la prise, GPT Image 2 redessine chaque photo en portrait studio en pied de la même personne ou du même animal. Le modèle reçoit ensuite quatre pièces jointes, toujours dans cet ordre : Image 1, le portrait de gauche ; Image 2, le portrait de droite ; Vidéo 1, le clip de référence Hotel Lobby sans son ; Audio 1, la piste Hotel Lobby coupée à la même durée.

Prompt Hotel Lobby AI (Wan 3.0)
Suis la Vidéo 1 du début à la fin : copie son cadrage, son rythme et chaque mouvement, geste, tour de tête, expression et forme de bouche, ainsi que le fond orange uni et le micro argenté suspendu au plafond entre les deux artistes. Garde le cadrage de la Vidéo 1 : pas de zoom avant, pas de zoom arrière, pas de panoramique. N’ajoute aucun mouvement ni élément de décor absent de la Vidéo 1.

Utilise l’Audio 1 comme musique de fond de toute la vidéo, tel quel : c’est tout le son de la vidéo. N’écris pas de nouvelles paroles, ne le rechante pas, n’ajoute ni autre musique ni autres voix.

L’artiste de gauche est le sujet de l’Image 1 ; l’artiste de droite est le sujet de l’Image 2. Ils remplacent complètement les deux personnes de la Vidéo 1 : visage, coiffure ou pelage, silhouette et vêtements viennent des photos, rien des personnes de la Vidéo 1. Aucun des deux ne porte de gants (sauf s’il en porte déjà sur la photo) : les personnes montrent leurs propres mains, les animaux gardent leurs propres pattes. Ignore le fond des photos.

L’artiste de gauche rappe au micro la voix de l’Audio 1, les lèvres parfaitement synchronisées sur l’Audio 1. Celui de droite suit les mouvements de la personne de droite dans la Vidéo 1 : il réagit et fait des gestes en rythme, et ne mime que de courts ad-libs.

L’orange remplit tout le cadre, sans zones noires ni coins sombres. Pas d’écran partagé, pas de personnes en trop, pas de sous-titres ni de texte à l’écran. Les visages restent les mêmes du début à la fin.

La variante rap IA sur Seedance

Sur Seedance, l’audio est toujours un rap IA que le modèle compose lui-même. Sur le décor orange Hotel Lobby, il écoute quand même la piste Hotel Lobby en composant : le clip de référence part muet, la piste est jointe à part comme audio de référence 1, et le prompt demande un nouveau beat qui suit son rythme, avec de nouvelles paroles, sans sa mélodie ni ses voix. Ici, les pièces jointes sont nommées en toutes lettres (« image de référence 1 »). L’exemple ci-dessous a été construit pour le thème indiqué dans son titre.

Prompt rap IA Hotel Lobby (Seedance, 9:16, 12 s)
Utilise la vidéo de référence 1 pour toute la performance : copie son cadrage, son rythme et chaque mouvement, geste, tour de tête, expression du visage et mouvement de bouche, le fond orange uni et l’unique micro argenté suspendu entre les artistes. Garde le cadrage de la vidéo de référence 1 : pas de zoom avant, pas de zoom arrière, pas de panoramique. N’ajoute aucun mouvement ni élément de décor absent de la vidéo de référence 1.

Artiste de gauche : la personne de l’image de référence 1. Artiste de droite : la personne de l’image de référence 2. Ils remplacent complètement les deux personnes de la vidéo de référence 1 : visage, cheveux, corps et vêtements viennent des photos, rien des personnes de la vidéo de référence 1. Si une photo ne montre aucun vêtement d’une personne (juste le visage ou les épaules nues), habille-la de vêtements simples du quotidien qui lui vont, comme un t-shirt uni et un jean ; jamais le costume, la cape, le manteau, les ceintures, les gants ou le bandeau sur les yeux des personnes de la vidéo de référence 1. Les animaux restent tels quels, sans vêtements. Ignore le fond des photos.

Bande-son : un morceau original de trap sombre d’Atlanta fait pour cette vidéo, qui suit l’audio de référence 1 pour le beat et le rythme : même tempo, même groove, même motif de batterie et même rebond, calés sur les mouvements de la vidéo de référence 1. Fais une nouvelle prod dans ce style avec de nouvelles paroles ; ne reprends ni les paroles, ni la mélodie, ni les voix de l’audio de référence 1. Épuré mais percutant : une 808 lourde et granuleuse qui glisse entre les notes, une caisse claire doublée d’un clap perçant avec des hi-hats secs, et une seule boucle de mélodie inquiétante aux accents orientaux. Ambiance sombre, menaçante et sûre d’elle. Le rap est un flow en triolets rapide et rebondissant qui file au-dessus du beat lent. Mix : la voix bien claire au-dessus, la prod juste derrière presque au même niveau, forte et percutante, jamais faible et sans jamais s’arrêter entre deux phrases. L’artiste de gauche rappe dans le micro suspendu un couplet original et propre sur : « les 30 ans de Maya et ses créneaux catastrophiques ». Rappe dans la langue de ce thème. Voix rap claire, lèvres synchronisées sur chaque mot, hochements de tête naturels et bouche expressive. L’artiste de droite est le pote qui ambiance : il pointe le rappeur du doigt, réagit, sourit et ajoute de courts ad-libs sur le beat. N’utilise ni chanson existante, ni paroles existantes, ni la voix d’un artiste réel.

9:16. L’orange remplit tout le cadre d’un bord à l’autre, sans zones noires ou sombres. Pas d’écran partagé, pas de personnes en trop, pas de sous-titres ni de texte à l’écran. Les visages restent les mêmes du début à la fin.
Pour un rap IA, indiquez un nom et un détail précis. C’est le thème, pas le prompt vidéo complet.
Pour un rap IA, indiquez un nom et un détail précis. C’est le thème, pas le prompt vidéo complet.Interface réelle, en anglais · 2026-10-02

Cinq prompts Hotel Lobby AI pour deux photos, sans clip

Beaucoup d’outils vidéo acceptent des photos de référence mais pas de clip de référence. Ces cinq prompts décrivent le décor et la performance avec des mots, pour se coller directement dans un outil image-vers-vidéo qui prend deux photos. Ils suivent les règles qui rendent le format lisible d’un coup d’œil : une photo par côté, un micro suspendu au-dessus, une voix sur le couplet pendant que l’autre réagit, et une caméra qui ne bouge pas. Nous les avons écrits pour cette page sans les tester, et chaque modèle lit un prompt à sa façon : prévois un ou deux essais. Ils restent en anglais, la langue que ces outils comprennent le mieux.

Prompt pour un couple

Couple (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, using two reference photos of a couple. Place the subject of photo 1 on the left side of the frame and the subject of photo 2 on the right side, head to toe, and keep every face, haircut, outfit and height true to its photo. The room is a bare studio painted orange on the wall and floor, lit softly and evenly. A single silver studio mic dangles on a thin cord from above, halfway between them. The partner on the left delivers the verse into that mic with sure, easy hand moves; the partner on the right grins, points at them, sways to the beat and leans toward the mic for the closing line. The camera sits at chest height and never moves: one unbroken shot with no cuts, zoom or pan. Nobody else in the room, no on-screen words, no logos.

Prompt pour deux meilleurs amis qui se passent le micro

Meilleurs amis (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference photos of two grown-up best friends. Photo 1 goes on the left, photo 2 on the right, both seen from head to feet, with faces, hair, clothing and build copied exactly. The set is an orange studio with a seamless orange wall and floor, and one silver mic hanging from the ceiling on a cable between the two friends. In the first six seconds the left friend raps into the mic while the right friend nods, laughs and hypes with big arm moves; in the last six seconds the right friend takes the mic and the left friend reacts. Each friend moves in their own way, never as mirror images. Locked-off camera, a single continuous take, gentle even lighting, both pairs of feet in frame. No other people, props, captions or logos.

Prompt pour un grand-parent et un petit-enfant adulte

Grand-parent et petit-enfant adulte (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference photos: photo 1 shows a grandparent, who stands on the left, and photo 2 shows their grown-up grandchild, who stands on the right. Show both from head to toe and keep each face, hairstyle, outfit and height as photographed. They share a rap duet in an empty orange studio, one silver mic hanging from the ceiling between them. The grandparent raps into the mic with calm, steady, self-assured gestures; the grandchild looks delighted, laughs, dances in time and joins the mic for the final line. Keep every movement relaxed and natural for both ages. A single fixed shot under soft studio light, with no cuts, zoom or pan, nobody else in the scene and no captions.

Prompt pour des personnages dessinés ou d’anime

Tiens-t’en aux personnages que tu as créés ou sur lesquels tu as des droits ; les personnages célèbres appartiennent à quelqu’un d’autre.

Personnages illustrés (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference images of original drawn characters. The character from image 1 stands on the left and the character from image 2 on the right, shown in full, each keeping its exact art style, palette, proportions and costume, with both drawn in that same style throughout. They perform a rap duet in a plain orange studio, a single silver mic hanging from the ceiling between them. The left character raps into the mic with lively hand gestures; the right character reacts, points and bounces on the beat. One locked camera, one continuous take, no cuts, zoom or pan. No additional characters, no lettering, no logos.

Prompt Hotel Lobby AI pour un chien, un chat ou les deux

Les animaux ont fait partie des premières vidéos Hotel Lobby devenues virales, faites avec d’autres outils (exemples crédités). Donne à chaque animal une photo nette où on voit tout son corps.

Animaux (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference photos of pets. The animal from photo 1 stands up on its back legs on the left and the animal from photo 2 stands on the right, each keeping its breed, face, eye color, coat markings, size and collar. The set is an empty orange studio with one silver mic hanging from the ceiling between them. The left animal opens and closes its mouth on the beat and waves its front paws as though rapping into the mic; the right animal bobs its head, glances at the camera and dances in time. Keep the anatomy real: four legs and one tail per animal, both visible from the tips of the ears to the paws. A single fixed, unbroken shot. No humans, no extra animals, no text.

Notre studio n’a besoin d’aucun de ces prompts, ni pour les gens ni pour les animaux, puisque le prompt est déjà intégré ; la page vidéo rap pour animaux l’ouvre réglé pour un animal et son partenaire. Nous avons testé un chien à côté d’une personne. Les chats, et deux animaux ensemble, ne sont pas encore testés.

Pourquoi chaque consigne est dans le prompt

  1. Performance. Le premier paragraphe confie à Vidéo 1 le cadrage, le rythme et chaque mouvement : gestes, tours de tête, expressions, formes de la bouche, plus le fond orange uni et le micro argenté suspendu entre les deux. Il fige la caméra (ni avancée, ni recul, ni panoramique) et interdit tout ce que le clip ne contient pas.
  2. Audio. Audio 1 est toute la bande-son et reste intact : pas de paroles réécrites, pas de lignes rechantées, ni musique ni voix ajoutées.
  3. Qui est qui. Chaque image est liée à un côté, et les deux sujets remplacent entièrement les deux interprètes du clip : visage, cheveux ou pelage, corps et vêtements viennent des images, et leurs arrière-plans sont écartés. La formule est « le sujet de l’Image 1 » plutôt qu’homme ou femme, pour convenir à une personne comme à un animal sans jamais contredire la photo. Elle interdit aussi les gants, parce que les deux danseurs de notre clip de référence en portent et que le modèle les peignait sur les mains et les pattes.
  4. Rôles. L’interprète de gauche rappe les voix d’Audio 1, lèvres synchronisées ; celui de droite copie l’acolyte du clip, réagit et gesticule sur le beat avec seulement de brefs ad-libs.
  5. Garde-fous. Orange jusqu’à chaque bord sans coins sombres, pas d’écran partagé, personne en plus, pas de sous-titres, et les mêmes visages de la première à la dernière image. Ces lignes évitent les ratés que nous voyions le plus.

Adapter le prompt à un autre modèle vidéo

  • Il te faut un modèle qui accepte des images de référence, une vidéo de référence et une piste audio de référence, et qui garde la piste. Wan 3.0 le fait. Seedance 2.x de ByteDance accepte les trois, mais dans nos tests il composait une nouvelle musique.
  • Désigne les pièces jointes comme le fait ton outil. Nous les numérotons dans l’ordre d’envoi (Image 1, Image 2, Vidéo 1, Audio 1) ; d’autres outils veulent @Image1 ou leurs propres balises. Garde l’ordre fixe : photo de gauche d’abord, photo de droite ensuite.
  • Ne nomme pas les interprètes. « Le sujet de l’Image 1 » convient à ce qu’il y a sur la photo, humain ou animal. Notre studio ne change que la disposition des photos (deux photos ou une des deux) et, quand tu envoies « Ton clip », les mouvements.
  • Le format n’est pas dans le texte ; choisis 9:16, 16:9 ou 1:1 dans les réglages de l’outil.
  • Pas de clip de référence ? Décris le décor et la performance avec des mots au lieu de renvoyer à Vidéo 1, comme dans les cinq prompts ci-dessus. Dreamina et des outils similaires publient leurs propres versions texte seul. Nous n’avons testé que les deux prompts du haut de cette page.

Tableau de dépannage : ce qui coince et pourquoi

Tu voisCause probableEssaie ceci
Un visage devient celui d’un inconnuLa photo est de profil, avec lunettes de soleil ou un visage minusculeMets une photo de face, lumineuse, cadrée à la taille
Gauche et droite s’inversentRien dans le prompt ne lie chaque photo à un côtéNomme l’interprète de gauche et de droite avec son image
Une personne en plus apparaîtDes gens du clip ou de l’arrière-plan d’une photo sont copiésGarde « personne en plus » et demande d’ignorer les arrière-plans des photos
Du texte surgit à l’écranLe modèle invente des sous-titresGarde la ligne qui interdit sous-titres et texte à l’écran
Les bouches décrochent de l’audioPas d’audio joint, ou la piste commence par un silenceJoins la piste et fais-la commencer sur un mot
Des bords noirs autour de l’orangeLe prompt demande un mouvement de caméra que le clip ne fait pasGarde le cadrage du clip et demande de l’orange d’un bord à l’autre
Une autre musique remplace la pisteLe modèle écrit sa propre bande-son (Seedance 2.x l’a fait chez nous)Choisis un modèle qui garde la piste de référence, comme Wan 3.0

Ou laisse le studio l’écrire

Dans Hotel Lobby Video, le prompt, le clip de référence et la piste de référence sont déjà branchés. Tu ajoutes deux photos et tu crées. Une prise de 12 secondes sur Wan 3.0 en 480p coûte 6 crédits.

Crée ta vidéo Hotel Lobby

FAQ

Qu’est-ce qui fait un bon prompt Hotel Lobby AI ?

Il fixe le décor orange, le micro unique suspendu, quelle photo va de quel côté et ce que fait chaque personne. Le prompt Wan 3.0 ci-dessus est celui que notre studio envoie pour chaque prise.

Avec quels modèles le prompt fonctionne-t-il ?

Nous faisons tourner le premier sur Wan 3.0, qui garde la piste de référence, et la version rap IA sur Seedance 2.x, qui écrit sa propre musique. Les deux acceptent images, vidéo et audio de référence. D’autres modèles demandent leurs propres balises et ne prennent pas forcément les trois.

Je peux coller le prompt couple dans Dreamina ou Kling avec deux photos de ma pellicule ?

C’est à ça que servent les cinq prompts photo seule : les outils image-vers-vidéo qui prennent deux photos de référence. Renomme les photos comme ton outil l’attend et garde gauche et droite fixes. Nous ne les avons pas testés hors de notre studio.

Je veux mon chien et moi dedans. Il me faut le prompt animaux ?

Pas sur Hotel Lobby Video : la [page vidéo rap pour animaux](/dog-and-cat-rap-video) est réglée pour un animal et son partenaire, sans prompt à écrire. Un chien à côté d’une personne est testé ; les chats et deux animaux ensemble pas encore.

Pourquoi mon prompt sort-il une nouvelle musique au lieu de la piste Hotel Lobby ?

Certains modèles composent leur propre bande-son quoi que tu demandes ; Seedance 2.x l’a fait dans nos tests. Utilise un modèle qui garde une piste de référence, comme Wan 3.0, et joins la piste en audio.

Est-ce que je dois écrire un prompt tout court ?

Non. Hotel Lobby Video intègre le prompt dans le studio : tu ajoutes seulement les photos.

Références

Hotel Lobby Video est une appli indépendante, sans lien avec Quavo, Takeoff, Migos, Quality Control Music, Motown ou COLORS.