Pular para o conteúdo

Prompt Hotel Lobby AI: o que usamos e mais 5 para copiar

Um prompt Hotel Lobby AI precisa fixar o cenário laranja, o microfone único dos dois, quem fica onde e quem canta. Muito prompt que circula por aí é palpite; os dois abaixo são os de verdade, enviados pelo nosso estúdio em todo take. O primeiro roda no Wan 3.0, o nosso padrão, e mantém a faixa do Hotel Lobby. O segundo é a versão Seedance, que escreve um rap novo. Depois vêm cinco prompts que escrevemos para ferramentas que aceitam só duas fotos, uma explicação linha por linha e uma tabela de consertos. Ou pule tudo isso: o estúdio coloca o prompt por você.

Revisado em

Um caderno de instruções ao lado de retratos e uma foto de palco.

PROMPT IA HOTEL LOBBY

Oriente a performance

  • Pessoas
  • Movimento
  • Som
AI · Ilustração · Hotel Lobby Video

O prompt Wan 3.0 por trás do Hotel Lobby Video

Esta versão atende duas fotos em qualquer formato de quadro; a proporção viaja como configuração do modelo, não como texto. Antes do take começar, o GPT Image 2 redesenha cada foto como um retrato de estúdio de corpo inteiro da mesma pessoa ou do mesmo pet. Aí o modelo recebe quatro anexos, sempre nesta ordem: Imagem 1, o retrato da esquerda; Imagem 2, o retrato da direita; Vídeo 1, o clipe de referência do Hotel Lobby sem som; e Áudio 1, a faixa do Hotel Lobby cortada na mesma duração.

Prompt Hotel Lobby AI (Wan 3.0)
Siga o Vídeo 1 do começo ao fim: copie o enquadramento, o ritmo e cada movimento, gesto, virada de cabeça, expressão facial e formato da boca, além do fundo laranja liso e do microfone prateado pendurado no teto entre os dois artistas. Mantenha o enquadramento de câmera do Vídeo 1: sem aproximar, sem afastar, sem panorâmica. Não acrescente nenhum movimento ou elemento de cena que não esteja no Vídeo 1.

Use o Áudio 1 como música de fundo do vídeo inteiro, exatamente como está: ele é todo o som do vídeo. Não escreva letra nova, não cante de novo, não acrescente outra música nem outras vozes.

O artista da esquerda é quem aparece na Imagem 1; o artista da direita é quem aparece na Imagem 2. Eles substituem por completo as duas pessoas do Vídeo 1: rosto, cabelo ou pelo, corpo e roupa vêm das fotos, nada das pessoas do Vídeo 1. Nenhum dos dois usa luvas (a não ser que já esteja de luvas na foto): pessoas mostram as próprias mãos e animais mantêm as próprias patas. Ignore o fundo das fotos.

O artista da esquerda faz o rap da voz do Áudio 1 no microfone, com a boca perfeitamente sincronizada com o Áudio 1. O da direita segue os movimentos da pessoa da direita no Vídeo 1: reage e gesticula no ritmo, mexendo a boca só em ad-libs curtos.

O laranja preenche o quadro inteiro, sem áreas pretas nem cantos escuros. Sem tela dividida, sem pessoas a mais, sem legendas nem texto na tela. Os rostos ficam iguais do começo ao fim.

A variante de rap com IA no Seedance

No Seedance o áudio é sempre um rap com IA que o próprio modelo compõe. No cenário laranja do Hotel Lobby ele continua ouvindo a faixa do Hotel Lobby enquanto compõe: o clipe de referência vai sem som, a faixa vai anexada à parte como áudio de referência 1, e o prompt pede uma batida nova que siga o ritmo dela, com palavras novas e sem a melodia nem as vozes dela. Aqui os anexos são chamados por extenso (“imagem de referência 1”). O exemplo abaixo foi montado para o tema que aparece no rótulo. O prompt pede o rap no idioma do tema, então um tema escrito em português gera rap em português.

Prompt de rap com IA Hotel Lobby AI (Seedance, 9:16, 12 s)
Use o vídeo de referência 1 para a apresentação inteira: copie o enquadramento, o ritmo e cada movimento, gesto, virada de cabeça, expressão facial e movimento da boca, o fundo laranja liso e o único microfone prateado pendurado entre os artistas. Mantenha o enquadramento de câmera do vídeo de referência 1: sem aproximar, sem afastar, sem panorâmica. Não acrescente nenhum movimento ou elemento de cena que não esteja no vídeo de referência 1.

Artista da esquerda: a pessoa da imagem de referência 1. Artista da direita: a pessoa da imagem de referência 2. Eles substituem por completo as duas pessoas do vídeo de referência 1: rosto, cabelo, corpo e roupa vêm das fotos, nada das pessoas do vídeo de referência 1. Se uma foto não mostrar nenhuma roupa de uma pessoa (só o rosto ou os ombros nus), vista essa pessoa com roupas simples do dia a dia que combinem com ela, como uma camiseta lisa e jeans; nunca o figurino, a capa, o casaco, os cintos, as luvas ou a venda nos olhos das pessoas do vídeo de referência 1. Os animais ficam como estão, sem roupa. Ignore o fundo das fotos.

Trilha sonora: uma música original de trap sombrio de Atlanta feita para este vídeo que segue o áudio de referência 1 na batida e no ritmo: o mesmo andamento, groove, padrão de bateria e balanço, no tempo dos movimentos do vídeo de referência 1. Faça uma batida nova nesse estilo com letra nova; não reutilize a letra, a melodia nem as vozes do áudio de referência 1. Enxuto mas pesado: um 808 retumbante e áspero que desliza entre as notas, uma caixa com palmas cortante com hi-hats secos, e um único loop de melodia sinistra com toque oriental. Clima sombrio, ameaçador e confiante. O rap é um flow em tercinas rápido e com balanço por cima da batida lenta. Mixagem: a voz clara por cima, a batida logo atrás quase no mesmo volume, alta e marcante, nunca baixa e sem nunca parar entre uma frase e outra. O artista da esquerda faz no microfone pendurado um verso original e limpo sobre: "os 30 anos da Maya e a baliza terrível dela". Faça o rap no idioma desse tema. Voz de rap clara, boca sincronizada com cada palavra, movimentos naturais de cabeça e boca expressiva. O artista da direita é o parceiro que anima: aponta para quem está rimando, reage, sorri e solta ad-libs curtos no ritmo. Não use nenhuma música existente, nenhuma letra existente nem a voz de nenhum artista real.

9:16. O laranja preenche o quadro inteiro de ponta a ponta, sem áreas pretas ou escuras. Sem tela dividida, sem pessoas a mais, sem legendas nem texto na tela. Os rostos ficam iguais do começo ao fim.
Para um rap IA, escreva um nome e um detalhe específico. Este é o tema, não o prompt completo.
Para um rap IA, escreva um nome e um detalhe específico. Este é o tema, não o prompt completo.Interface real, em inglês · 2026-10-02

Cinco prompts Hotel Lobby AI para duas fotos e nenhum clipe

Muitas ferramentas de vídeo aceitam fotos de referência, mas não um clipe de referência. Estes cinco prompts descrevem o cenário e a atuação em palavras, então dá para colar direto numa ferramenta de imagem para vídeo que receba duas fotos. Eles seguem as regras que fazem o formato ser reconhecido de cara: uma foto por lado, um microfone pendurado do alto, uma voz no verso enquanto a outra reage, e uma câmera que não sai do lugar. Escrevemos os cinco para esta página e não os testamos, e cada modelo lê um prompt do seu jeito, então conte com uma ou duas novas tentativas. Eles ficam em inglês porque as ferramentas de vídeo seguem prompts em inglês com mais segurança; se a sua preferir português, traduza.

Prompt para um casal

Casal (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, using two reference photos of a couple. Place the subject of photo 1 on the left side of the frame and the subject of photo 2 on the right side, head to toe, and keep every face, haircut, outfit and height true to its photo. The room is a bare studio painted orange on the wall and floor, lit softly and evenly. A single silver studio mic dangles on a thin cord from above, halfway between them. The partner on the left delivers the verse into that mic with sure, easy hand moves; the partner on the right grins, points at them, sways to the beat and leans toward the mic for the closing line. The camera sits at chest height and never moves: one unbroken shot with no cuts, zoom or pan. Nobody else in the room, no on-screen words, no logos.

Prompt para dois melhores amigos que trocam o microfone

Melhores amigos (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference photos of two grown-up best friends. Photo 1 goes on the left, photo 2 on the right, both seen from head to feet, with faces, hair, clothing and build copied exactly. The set is an orange studio with a seamless orange wall and floor, and one silver mic hanging from the ceiling on a cable between the two friends. In the first six seconds the left friend raps into the mic while the right friend nods, laughs and hypes with big arm moves; in the last six seconds the right friend takes the mic and the left friend reacts. Each friend moves in their own way, never as mirror images. Locked-off camera, a single continuous take, gentle even lighting, both pairs of feet in frame. No other people, props, captions or logos.

Prompt para avô ou avó com o neto adulto

Avô ou avó e neto adulto (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference photos: photo 1 shows a grandparent, who stands on the left, and photo 2 shows their grown-up grandchild, who stands on the right. Show both from head to toe and keep each face, hairstyle, outfit and height as photographed. They share a rap duet in an empty orange studio, one silver mic hanging from the ceiling between them. The grandparent raps into the mic with calm, steady, self-assured gestures; the grandchild looks delighted, laughs, dances in time and joins the mic for the final line. Keep every movement relaxed and natural for both ages. A single fixed shot under soft studio light, with no cuts, zoom or pan, nobody else in the scene and no captions.

Prompt para personagens desenhados ou de anime

Fique com personagens que você criou ou cujos direitos você tem; personagens famosos pertencem a outra pessoa.

Personagens ilustrados (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference images of original drawn characters. The character from image 1 stands on the left and the character from image 2 on the right, shown in full, each keeping its exact art style, palette, proportions and costume, with both drawn in that same style throughout. They perform a rap duet in a plain orange studio, a single silver mic hanging from the ceiling between them. The left character raps into the mic with lively hand gestures; the right character reacts, points and bounces on the beat. One locked camera, one continuous take, no cuts, zoom or pan. No additional characters, no lettering, no logos.

Prompt Hotel Lobby AI para cachorro, gato ou os dois

Os pets estiveram entre os primeiros clipes de Hotel Lobby a viralizar, feitos com outras ferramentas (exemplos, com crédito). Dê a cada animal uma foto nítida com o corpo inteiro no quadro.

Pets (9:16, 12 s)
Make a vertical 9:16 clip, 12 seconds long, from two reference photos of pets. The animal from photo 1 stands up on its back legs on the left and the animal from photo 2 stands on the right, each keeping its breed, face, eye color, coat markings, size and collar. The set is an empty orange studio with one silver mic hanging from the ceiling between them. The left animal opens and closes its mouth on the beat and waves its front paws as though rapping into the mic; the right animal bobs its head, glances at the camera and dances in time. Keep the anatomy real: four legs and one tail per animal, both visible from the tips of the ears to the paws. A single fixed, unbroken shot. No humans, no extra animals, no text.

O nosso estúdio não precisa de nenhum destes, nem para gente nem para pets, porque o prompt já vem embutido; a página de vídeo de rap com pets abre o estúdio preparado para um pet e o parceiro dele. Já testamos um cachorro ao lado de uma pessoa. Gatos, e dois pets juntos, ainda não foram testados.

Por que cada instrução está no prompt

  1. Atuação. O primeiro parágrafo dá ao Vídeo 1 o controle do enquadramento, do tempo e de cada movimento: gestos, viradas de cabeça, expressões, formato da boca, além do fundo laranja liso e do único microfone prateado pendurado entre os dois. Ele congela a câmera (sem aproximar, afastar nem girar) e proíbe qualquer coisa que o clipe não tenha.
  2. Áudio. O Áudio 1 é a trilha inteira e fica intocado: nada de letra reescrita, versos cantados de novo, música ou vozes extras.
  3. Quem é quem. Cada imagem fica presa a um lado, e os dois sujeitos substituem por completo os dois artistas do clipe: rosto, cabelo ou pelo, corpo e roupa vêm das imagens, e o fundo delas é descartado. O texto diz “o sujeito da Imagem 1”, e não homem ou mulher, para servir a uma pessoa ou a um pet sem nunca brigar com a foto. Ele também proíbe luvas, porque os dois dançarinos do nosso clipe de referência usam luvas e o modelo costumava pintá-las em mãos e patas.
  4. Papéis. Quem está à esquerda canta a voz do Áudio 1 com os lábios sincronizados; quem está à direita copia o parceiro do clipe, reagindo e gesticulando no beat, só com ad-libs curtos.
  5. Grades de proteção. Laranja até a última borda sem cantos escuros, sem tela dividida, sem gente a mais, sem legendas e com os mesmos rostos do primeiro ao último quadro. Essas linhas evitam as falhas que mais vimos.

Levando o prompt para outro modelo de vídeo

  • Você precisa de um modelo que aceite imagens de referência, um vídeo de referência e uma faixa de áudio de referência, e que mantenha a faixa. O Wan 3.0 mantém. O ByteDance Seedance 2.x aceita os três, mas nos nossos testes compôs uma música nova.
  • Chame os anexos do jeito da sua ferramenta. Nós numeramos na ordem de envio (Imagem 1, Imagem 2, Vídeo 1, Áudio 1); outras ferramentas pedem @Image1 ou tags próprias. Mantenha a ordem fixa: foto da esquerda primeiro, foto da direita depois.
  • Não dê nome aos artistas. “O sujeito da Imagem 1” serve para o que estiver na foto, gente ou bicho. O nosso estúdio só muda a disposição das fotos (duas fotos ou uma dos dois) e, quando você envia Seu clipe, os movimentos.
  • O formato do quadro não vai no texto; escolha 9:16, 16:9 ou 1:1 nas configurações da ferramenta.
  • Sem clipe de referência? Descreva o cenário e a atuação em palavras em vez de apontar para o Vídeo 1, como nos cinco prompts acima. O Dreamina e ferramentas parecidas publicam as próprias versões só de texto. Nós testamos apenas os dois prompts do topo desta página.

Tabela de consertos: o que dá errado e por quê

Você vêCausa provávelTente isto
Um rosto vira o de um desconhecidoA foto está de perfil, com óculos escuros ou com o rosto minúsculoTroque por uma foto de frente, clara, da cintura para cima
Esquerda e direita trocam de lugarNada no prompt prende cada foto a um ladoNomeie o artista da esquerda e o da direita com a respectiva imagem
Entra uma pessoa a maisGente do clipe ou do fundo de uma foto é copiadaMantenha “sem pessoas extras” e mande ignorar o fundo das fotos
Aparece texto na telaO modelo inventa legendasMantenha a linha que proíbe legendas e texto na tela
A boca escapa do áudioNenhum áudio anexado, ou a faixa começa em silêncioAnexe a faixa e comece numa palavra
Bordas pretas em volta do laranjaO prompt pede um movimento de câmera que o clipe nunca fazMantenha o enquadramento do clipe e peça laranja de ponta a ponta
Outra música toma o lugar da faixaO modelo escreve a própria trilha (o Seedance 2.x fez isso com a gente)Escolha um modelo que mantenha a faixa de referência, como o Wan 3.0

Ou deixe o estúdio escrever

No Hotel Lobby Video o prompt, o clipe de referência e a faixa de referência já estão ligados. Você envia um par de fotos e toca em criar. Um take de 12 segundos no Wan 3.0 em 480p custa 6 créditos.

Crie seu vídeo Hotel Lobby

Perguntas frequentes

O que faz um bom prompt Hotel Lobby AI?

Ele fixa o cenário laranja, o único microfone pendurado, qual foto vai de qual lado e o que cada pessoa faz. O prompt Wan 3.0 acima é o que o nosso estúdio envia em todo take.

Com quais modelos o prompt funciona?

Rodamos o primeiro com o Wan 3.0, que mantém a faixa de referência, e a versão de rap com IA com o Seedance 2.x, que escreve a própria música. Os dois aceitam imagens, vídeo e áudio de referência. Outros modelos pedem a própria marcação e talvez não aceitem os três.

Posso colar o prompt de casal no Dreamina ou no Kling com duas fotos da minha galeria?

É para isso que servem os cinco prompts só com fotos: ferramentas de imagem para vídeo que recebem duas fotos de referência. Renomeie as fotos como a sua ferramenta espera e mantenha esquerda e direita fixas. Não os testamos fora do nosso estúdio.

Quero eu e o meu cachorro no vídeo. Preciso do prompt de pets?

Não no Hotel Lobby Video: a [página de vídeo de rap com pets](/dog-and-cat-rap-video) já vem preparada para um pet e o parceiro dele, sem prompt para escrever. Um cachorro ao lado de uma pessoa está testado; gatos e dois pets juntos ainda não.

Por que o meu prompt sempre gera uma música nova em vez da faixa do Hotel Lobby?

Alguns modelos compõem a própria trilha não importa o que você peça; o Seedance 2.x fez isso nos nossos testes. Use um modelo que mantenha uma faixa de referência, como o Wan 3.0, e anexe a faixa como áudio.

Eu preciso escrever algum prompt?

Não. O Hotel Lobby Video já traz o prompt embutido no estúdio, então você só envia as fotos.

Referências

O Hotel Lobby Video é um app independente, sem ligação com Quavo, Takeoff, Migos, Quality Control Music, Motown ou COLORS.