Saltar al contenido

Prompt de Hotel Lobby AI: el que enviamos y 5 más

Un prompt de Hotel Lobby AI tiene que dejar claros el set naranja, el único micro compartido, quién se pone en cada lado y quién rapea. Muchos prompts que circulan por internet son suposiciones; los dos de abajo son los que nuestro estudio envía de verdad en cada toma. El primero funciona en Wan 3.0, nuestro modelo por defecto, y conserva la pista de Hotel Lobby. El segundo es la versión para Seedance, que compone un rap nuevo. Después vienen cinco prompts que escribimos para herramientas que solo aceptan dos fotos, una explicación línea a línea y una tabla de arreglos. O sáltatelo todo: el estudio pone el prompt por ti.

Revisado el

Un cuaderno de instrucciones junto a retratos y una foto de escenario.

PROMPT IA HOTEL LOBBY

Dirige la actuación

  • Personas
  • Movimiento
  • Sonido
AI · Ilustración · Hotel Lobby Video

El prompt de Wan 3.0 que usa Hotel Lobby Video

Esta versión vale para dos fotos en cualquier formato de imagen; la relación de aspecto viaja como ajuste del modelo, no como texto. Antes de empezar la toma, GPT Image 2 vuelve a dibujar cada foto como un retrato de estudio de cuerpo entero de la misma persona o mascota. Luego el modelo recibe cuatro adjuntos, siempre en este orden: Imagen 1, el retrato de la izquierda; Imagen 2, el de la derecha; Video 1, el clip de referencia de Hotel Lobby sin sonido; y Audio 1, la pista de Hotel Lobby recortada a la misma duración.

Prompt de Hotel Lobby AI (Wan 3.0)
Sigue Video 1 de principio a fin: copia su encuadre, su ritmo y cada movimiento, gesto, giro de cabeza, expresión facial y forma de la boca, además del fondo naranja liso y el micrófono plateado que cuelga del techo entre los dos intérpretes. Mantén el encuadre de cámara de Video 1: sin acercar, sin alejar, sin paneo. No añadas ningún movimiento ni elemento de escena que no esté en Video 1.

Usa Audio 1 como música de fondo de todo el video, tal cual: es todo el sonido del video. No escribas letras nuevas, no lo vuelvas a cantar, no añadas otra música ni otras voces.

El intérprete de la izquierda es el sujeto de Imagen 1; el de la derecha es el sujeto de Imagen 2. Reemplazan por completo a las dos personas de Video 1: cara, peinado o pelaje, complexión y ropa salen de las fotos, nada de las personas de Video 1. Ninguno de los dos lleva guantes (salvo que ya los lleve en la foto): las personas muestran sus propias manos y los animales conservan sus propias patas. Ignora el fondo de las fotos.

El intérprete de la izquierda rapea la voz de Audio 1 frente al micrófono, con los labios perfectamente sincronizados con Audio 1. El de la derecha sigue los movimientos de la persona de la derecha de Video 1: reacciona y gesticula al ritmo, y solo mueve los labios en ad-libs breves.

El naranja llena todo el cuadro, sin zonas negras ni esquinas oscuras. Sin pantalla dividida, sin personas de más, sin subtítulos ni texto en pantalla. Las caras se mantienen iguales de principio a fin.

La variante de rap con IA en Seedance

En Seedance el audio siempre es un rap con IA que compone el propio modelo. En el set naranja de Hotel Lobby, aun así, escucha la pista de Hotel Lobby mientras compone: el clip de referencia se envía mudo, la pista va aparte como audio de referencia 1 y el prompt pide un beat nuevo que siga su ritmo, con letra nueva y sin su melodía ni sus voces. Aquí los adjuntos se nombran con palabras (“reference image 1”). El ejemplo de abajo se preparó para el tema que aparece en su etiqueta.

Prompt de rap con IA de Hotel Lobby (Seedance, 9:16, 12 s)
Usa el video de referencia 1 para toda la actuación: copia su encuadre, su ritmo y cada movimiento, gesto, giro de cabeza, expresión facial y movimiento de la boca, el fondo naranja liso y el único micrófono plateado que cuelga entre los intérpretes. Mantén el encuadre de cámara del video de referencia 1: sin acercar, sin alejar, sin paneo. No añadas ningún movimiento ni elemento de escena que no esté en el video de referencia 1.

Intérprete de la izquierda: la persona de la imagen de referencia 1. Intérprete de la derecha: la persona de la imagen de referencia 2. Reemplazan por completo a las dos personas del video de referencia 1: cara, cabello, cuerpo y ropa salen de las fotos, nada de las personas del video de referencia 1. Si una foto no muestra nada de la ropa de una persona (solo la cara o los hombros descubiertos), vístela con ropa cotidiana sencilla que le quede bien, como una camiseta lisa y unos jeans; nunca el disfraz, la capa, el abrigo, los cinturones, los guantes ni la venda de los ojos de las personas del video de referencia 1. Los animales se quedan como están, sin ropa. Ignora el fondo de las fotos.

Banda sonora: una canción original de trap oscuro de Atlanta hecha para este video que sigue el audio de referencia 1 en su beat y su ritmo: el mismo tempo, groove, patrón de batería y rebote, sincronizado con los movimientos del video de referencia 1. Haz un beat nuevo en ese estilo con letra nueva; no reutilices la letra, la melodía ni las voces del audio de referencia 1. Escaso pero contundente: un 808 retumbante y áspero que se desliza entre notas, una caja con palmas penetrante con hi-hats secos, y un único loop de melodía inquietante con aire oriental. Ambiente oscuro, amenazante y seguro. El rap es un flow en tresillos rápido y con rebote que corre por encima del beat lento. Mezcla: la voz clara arriba, el beat justo detrás casi al mismo nivel, fuerte y contundente, nunca bajo y sin cortarse nunca entre frase y frase. El intérprete de la izquierda rapea frente al micrófono colgante una estrofa original y limpia sobre: "el 30 cumpleaños de Maya y lo mal que aparca en paralelo". Rapea en el idioma de ese tema. Voz de rap clara, labios sincronizados con cada palabra, movimientos naturales de cabeza y una boca expresiva. El intérprete de la derecha es el compañero que pone el hype: señala al rapero, reacciona, sonríe y suelta ad-libs cortos al ritmo. No uses ninguna canción existente, ninguna letra existente ni la voz de ningún artista real.

9:16. El naranja llena todo el cuadro de borde a borde, sin zonas negras ni oscuras. Sin pantalla dividida, sin personas de más, sin subtítulos ni texto en pantalla. Las caras se mantienen iguales de principio a fin.
Para un rap IA, escribe un nombre y un detalle concreto. Este es el tema, no el prompt completo.
Para un rap IA, escribe un nombre y un detalle concreto. Este es el tema, no el prompt completo.Interfaz real, en inglés · 2026-10-02

Cinco prompts de Hotel Lobby AI para dos fotos y sin clip

Muchas herramientas de video aceptan fotos de referencia, pero no un clip de referencia. Estos cinco prompts describen con palabras el set y la actuación, así que se pegan directamente en una herramienta de imagen a video que admita dos fotos. Siguen las reglas que hacen que el formato se reconozca al instante: una foto por lado, un micro colgando desde arriba, una voz con la estrofa mientras la otra reacciona y una cámara quieta. Los escribimos para esta página y no los hemos probado; cada modelo interpreta el prompt a su manera, así que cuenta con repetir una o dos veces.

Prompt para una pareja

Pareja (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, using two reference photos of a couple. Place the subject of photo 1 on the left side of the frame and the subject of photo 2 on the right side, head to toe, and keep every face, haircut, outfit and height true to its photo. The room is a bare studio painted orange on the wall and floor, lit softly and evenly. A single silver studio mic dangles on a thin cord from above, halfway between them. The partner on the left delivers the verse into that mic with sure, easy hand moves; the partner on the right grins, points at them, sways to the beat and leans toward the mic for the closing line. The camera sits at chest height and never moves: one unbroken shot with no cuts, zoom or pan. Nobody else in the room, no on-screen words, no logos.

Prompt para dos mejores amigos que se pasan el micro

Mejores amigos (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference photos of two grown-up best friends. Photo 1 goes on the left, photo 2 on the right, both seen from head to feet, with faces, hair, clothing and build copied exactly. The set is an orange studio with a seamless orange wall and floor, and one silver mic hanging from the ceiling on a cable between the two friends. In the first six seconds the left friend raps into the mic while the right friend nods, laughs and hypes with big arm moves; in the last six seconds the right friend takes the mic and the left friend reacts. Each friend moves in their own way, never as mirror images. Locked-off camera, a single continuous take, gentle even lighting, both pairs of feet in frame. No other people, props, captions or logos.

Prompt para un abuelo y su nieto adulto

Abuelo y nieto adulto (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference photos: photo 1 shows a grandparent, who stands on the left, and photo 2 shows their grown-up grandchild, who stands on the right. Show both from head to toe and keep each face, hairstyle, outfit and height as photographed. They share a rap duet in an empty orange studio, one silver mic hanging from the ceiling between them. The grandparent raps into the mic with calm, steady, self-assured gestures; the grandchild looks delighted, laughs, dances in time and joins the mic for the final line. Keep every movement relaxed and natural for both ages. A single fixed shot under soft studio light, with no cuts, zoom or pan, nobody else in the scene and no captions.

Prompt para personajes dibujados o de anime

Usa personajes que hayas creado tú o sobre los que tengas derechos; los personajes famosos tienen dueño.

Personajes ilustrados (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference images of original drawn characters. The character from image 1 stands on the left and the character from image 2 on the right, shown in full, each keeping its exact art style, palette, proportions and costume, with both drawn in that same style throughout. They perform a rap duet in a plain orange studio, a single silver mic hanging from the ceiling between them. The left character raps into the mic with lively hand gestures; the right character reacts, points and bounces on the beat. One locked camera, one continuous take, no cuts, zoom or pan. No additional characters, no lettering, no logos.

Prompt de Hotel Lobby AI para un perro, un gato o los dos

Las mascotas estuvieron entre los primeros clips de Hotel Lobby en hacerse virales, hechos con otras herramientas (ejemplos, con crédito). Dale a cada animal una foto nítida con todo el cuerpo dentro del encuadre.

Mascotas (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference photos of pets. The animal from photo 1 stands up on its back legs on the left and the animal from photo 2 stands on the right, each keeping its breed, face, eye color, coat markings, size and collar. The set is an empty orange studio with one silver mic hanging from the ceiling between them. The left animal opens and closes its mouth on the beat and waves its front paws as though rapping into the mic; the right animal bobs its head, glances at the camera and dances in time. Keep the anatomy real: four legs and one tail per animal, both visible from the tips of the ears to the paws. A single fixed, unbroken shot. No humans, no extra animals, no text.

Nuestro estudio no necesita ninguno de estos, ni para personas ni para mascotas, porque el prompt ya viene dentro; la página de video de mascotas rapeando lo abre preparado para una mascota y su compañero. Hemos probado un perro al lado de una persona. Los gatos, y dos mascotas juntas, siguen sin probar.

Por qué está cada instrucción en el prompt

  1. Actuación. El primer párrafo deja en manos de Video 1 el encuadre, el ritmo y cada movimiento: gestos, giros de cabeza, caras, forma de la boca, además del fondo naranja liso y el único micro plateado que cuelga entre los dos. Congela la cámara (sin acercar, alejar ni panear) y prohíbe cualquier cosa que el clip no tenga.
  2. Audio. Audio 1 es toda la banda sonora y no se toca: ni letra reescrita, ni versos cantados de nuevo, ni música o voces añadidas.
  3. Quién es quién. Cada imagen queda atada a un lado y los dos sujetos sustituyen por completo a los dos intérpretes del clip: cara, pelo o pelaje, cuerpo y ropa salen de las imágenes, y sus fondos se descartan. Se dice “el sujeto de la Imagen 1” en lugar de hombre o mujer, para que valga para una persona o una mascota y nunca contradiga la foto. También prohíbe los guantes, porque los dos bailarines de nuestro clip de referencia los llevan y el modelo solía pintarlos en manos y patas.
  4. Papeles. El intérprete de la izquierda rapea las voces de Audio 1 con los labios sincronizados; el de la derecha imita al compañero del clip, reaccionando y gesticulando al ritmo con apenas algún coro suelto.
  5. Barandillas. Naranja hasta todos los bordes sin esquinas oscuras, sin pantalla partida, sin gente de más, sin subtítulos y con las mismas caras del primer al último fotograma. Estas líneas evitan los fallos que más vimos.

Llevar el prompt a otro modelo de video

  • Necesitas un modelo que acepte imágenes de referencia, un video de referencia y una pista de audio de referencia, y que conserve esa pista. Wan 3.0 lo hace. ByteDance Seedance 2.x acepta las tres cosas, pero en nuestras pruebas compuso música nueva.
  • Nombra los adjuntos como lo haga tu herramienta. Nosotros los numeramos por orden de subida (Imagen 1, Imagen 2, Video 1, Audio 1); otras piden @Image1 o sus propias etiquetas. Mantén el orden fijo: primero la foto de la izquierda, luego la de la derecha.
  • No pongas nombre a los intérpretes. “El sujeto de la Imagen 1” encaja con lo que haya en la foto, persona o animal. Nuestro estudio solo cambia la disposición de las fotos (dos fotos o una de los dos) y, cuando subes Tu clip, los movimientos.
  • El formato de imagen no va en el texto; elige 9:16, 16:9 o 1:1 en los ajustes de la herramienta.
  • ¿Sin clip de referencia? Describe con palabras el set y la actuación en vez de remitir a Video 1, como en los cinco prompts de arriba. Dreamina y herramientas parecidas publican sus propias versiones solo de texto. Nosotros solo hemos probado los dos prompts del principio de esta página.

Tabla de arreglos: qué falla y por qué

Lo que vesCausa probablePrueba esto
Una cara se vuelve la de un desconocidoLa foto es de perfil, con gafas de sol o con la cara diminutaCámbiala por una foto de frente y luminosa, de cintura para arriba
Izquierda y derecha se intercambianNada en el prompt ata cada foto a un ladoNombra al intérprete de la izquierda y al de la derecha con su imagen
Aparece una persona de másSe copia gente del clip o del fondo de una fotoDeja “sin gente de más” y pide que ignore los fondos de las fotos
Sale texto en pantallaEl modelo se inventa subtítulosDeja la línea que prohíbe subtítulos y texto en pantalla
Las bocas se desfasan del audioNo hay audio adjunto, o la pista empieza en silencioAdjunta la pista y que arranque en una palabra
Bordes negros alrededor del naranjaEl prompt pide un movimiento de cámara que el clip nunca haceRespeta el encuadre del clip y pide naranja de borde a borde
Otra música sustituye la pistaEl modelo compone su propia banda sonora (a nosotros nos pasó con Seedance 2.x)Elige un modelo que conserve la pista de referencia, como Wan 3.0

O deja que lo escriba el estudio

En Hotel Lobby Video el prompt, el clip de referencia y la pista de referencia ya están conectados. Tú añades un par de fotos y pulsas crear. Una toma de 12 segundos con Wan 3.0 en 480p cuesta 6 créditos.

Crea tu video Hotel Lobby

Preguntas frecuentes

¿Qué hace bueno a un prompt de Hotel Lobby AI?

Que fije el set naranja, el único micro colgante, qué foto va en qué lado y qué hace cada persona. El prompt de Wan 3.0 de arriba es el que nuestro estudio envía en cada toma.

¿Con qué modelos funciona el prompt?

Ejecutamos el primero con Wan 3.0, que conserva la pista de referencia, y la versión de rap con IA con Seedance 2.x, que compone su propia música. Los dos aceptan imágenes, video y audio de referencia. Otros modelos piden su propio etiquetado y puede que no admitan las tres cosas.

¿Puedo pegar el prompt de pareja en Dreamina o Kling con dos fotos del carrete?

Para eso están los cinco prompts solo con fotos: herramientas de imagen a video que admiten dos fotos de referencia. Renombra las fotos como espere tu herramienta y mantén fijos izquierda y derecha. No los hemos probado fuera de nuestro estudio.

Quiero salir con mi perro. ¿Necesito el prompt de mascotas?

En Hotel Lobby Video no: la [página de video de mascotas rapeando](/dog-and-cat-rap-video) viene preparada para una mascota y su compañero, sin prompt que escribir. Un perro junto a una persona está probado; gatos y dos mascotas juntas, todavía no.

¿Por qué mi prompt saca música nueva en vez de la pista de Hotel Lobby?

Algunos modelos componen su propia banda sonora pidas lo que pidas; Seedance 2.x lo hizo en nuestras pruebas. Usa un modelo que conserve una pista de referencia, como Wan 3.0, y adjunta la pista como audio.

¿Tengo que escribir algún prompt?

No. Hotel Lobby Video incluye el prompt en el estudio, así que solo tienes que añadir las fotos.

Referencias

Hotel Lobby Video es una app independiente, sin vínculo con Quavo, Takeoff, Migos, Quality Control Music, Motown ni COLORS.