Put two faces into the orange-booth duet. The moves, framing and sound stay exactly as in the template.
Left performer
Right performer
Best results: a sharp, front-facing photo with the whole face visible and no sunglasses. Only upload people who agreed to it.
15s with the original sound. Wan 3.0 bills the 15s template plus the 15s it renders.
Hotel Lobby AI
Coloque dois rostos no viral dueto da cabine laranja. Envie uma foto por pessoa e o Wan 3.0 as insere no modelo: cada gesto, cada ângulo de câmera e cada batida do som original continuam iguais.
Uma execução real do efeito. Nada foi editado à mão.


Uma foto nítida e de frente para cada performer. Image 1 fica no lado esquerdo do microfone e Image 2 no direito. Use o botão de troca para inverter.
O modelo, o prompt e as configurações já estão prontos. O Wan 3.0 mantém a cabine, os movimentos e o áudio, e troca apenas os dois rostos.
O clipe de 15 segundos com o som original aparece na prévia e em Meus vídeos, pronto para TikTok, Reels ou Shorts.
Ele edita a performance real em vez de inventar uma nova.
O Wan 3.0 lê o clipe do modelo como referência de vídeo, então os gestos das mãos, os movimentos da cabeça, os lábios e o tempo vêm direto da fonte.
Cada foto fica ligada a um performer. Os rostos não se misturam nem trocam de lugar no meio do clipe.
O dueto mantém o áudio original, então o resultado está pronto para compartilhar sem adicionar música em um editor.
As instruções da troca de rostos são ajustadas para este modelo. Você só escolhe quem está na cabine.
De frente ou levemente virado, com os olhos visíveis. Óculos escuros, máscaras e mãos na frente do rosto reduzem a semelhança.
Corte os amigos que aparecem ao fundo para o modelo saber exatamente qual rosto usar.
Luz natural ou iluminação interna uniforme funciona melhor. Selfies borradas ou com muitos filtros ficam mais suaves.
Melhores amigos, um casal, você e seu pai, a mesma pessoa duas vezes com roupas diferentes: combinações inesperadas são as mais compartilhadas.
O Wan 3.0 cobra o modelo de 15 segundos que ele lê mais os 15 segundos que renderiza, a 18 créditos por segundo em 720P. O 480P padrão custa 270 créditos. Execuções com falha são reembolsadas automaticamente.
Quer a sua própria cena? Experimente o Wan 3.0Have a different question and can't find the answer you're looking for? Reach out to our support team by sending us an email and we'll get back to you as soon as we can.
É um formato viral baseado em um dueto de rap em uma cabine laranja com um microfone pendurado. Os criadores trocam os dois performers por amigos, parceiros, família ou por eles mesmos e postam o resultado no TikTok, Reels e Shorts.
O efeito envia o clipe do modelo ao Wan 3.0 como referência de vídeo, junto com as suas duas fotos. O modelo mantém o movimento, o enquadramento e o som do clipe e redesenha apenas os dois rostos.
540 créditos por um vídeo de 15 segundos em 720P com som, ou 270 créditos em 480P. Como em toda referência de vídeo do Wan 3.0, o modelo de 15 segundos é cobrado junto com os 15 segundos renderizados. Execuções com falha são reembolsadas automaticamente.
Image 1 substitui o performer da esquerda e Image 2 o da direita. Use o botão de troca entre os espaços de foto para inverter antes de gerar.
Sim. Envie duas fotos diferentes da mesma pessoa e ela aparecerá nos dois lados do microfone.
Normalmente de 15 a 20 minutos, porque o Wan 3.0 redesenha os 15 segundos do modelo. Você pode sair da página; o vídeo pronto fica salvo em Meus vídeos.
Apenas fotos suas ou de pessoas que concordaram. Não envie fotos de menores e não use o efeito para se passar por alguém ou enganar ninguém.