Put two faces into the orange-booth duet. The moves, framing and sound stay exactly as in the template.
Left performer
Right performer
Best results: a sharp, front-facing photo with the whole face visible and no sunglasses. Only upload people who agreed to it.
15s with the original sound. Wan 3.0 bills the 15s template plus the 15s it renders.
Hotel Lobby AI
Pon dos caras en el viral dúo de la cabina naranja. Sube una foto por persona y Wan 3.0 las coloca en la plantilla: cada gesto, cada ángulo de cámara y cada beat del sonido original se mantienen.
Una ejecución real del efecto. Nada se editó a mano.


Una foto clara y de frente para cada intérprete. Image 1 va a la izquierda del micrófono e Image 2 a la derecha. Usa el botón de intercambio para cambiarlas.
La plantilla, el prompt y los ajustes ya están listos. Wan 3.0 conserva la cabina, los movimientos y el audio, y solo reemplaza las dos caras.
El clip de 15 segundos con su sonido original aparece en la vista previa y en Mis videos, listo para TikTok, Reels o Shorts.
Edita la actuación real en lugar de inventar una nueva.
Wan 3.0 lee el clip de la plantilla como referencia de video, así que los gestos de las manos, los movimientos de cabeza, los labios y el ritmo vienen directamente del original.
Cada foto se asigna a un intérprete. Las caras no se mezclan ni se cambian de lugar a mitad del clip.
El dúo conserva su audio original, así que el resultado está listo para compartir sin añadir música en un editor.
Las instrucciones del intercambio de caras están ajustadas a esta plantilla. Tú solo eliges quién está en la cabina.
De frente o ligeramente girada, con los ojos visibles. Las gafas de sol, las mascarillas y las manos sobre la cara reducen el parecido.
Recorta a los amigos del fondo para que el modelo sepa exactamente qué cara usar.
La luz natural o una iluminación interior uniforme funciona mejor. Los selfis borrosos o con muchos filtros salen más suaves.
Mejores amigos, una pareja, tú y tu padre, la misma persona dos veces con distinta ropa: las parejas inesperadas son las que más se comparten.
Wan 3.0 cobra la plantilla de 15 segundos que lee más los 15 segundos que renderiza, a 18 créditos por segundo en 720P. El 480P estándar cuesta 270 créditos. Las ejecuciones fallidas se reembolsan automáticamente.
¿Quieres tu propia escena? Prueba Wan 3.0Have a different question and can't find the answer you're looking for? Reach out to our support team by sending us an email and we'll get back to you as soon as we can.
Es un formato viral basado en un dúo de rap en una cabina naranja con un micrófono colgante. Los creadores sustituyen a los dos intérpretes por amigos, parejas, familia o ellos mismos y publican el resultado en TikTok, Reels y Shorts.
El efecto envía el clip de la plantilla a Wan 3.0 como referencia de video junto con tus dos fotos. El modelo mantiene el movimiento, el encuadre y el sonido del clip y solo vuelve a dibujar las dos caras.
540 créditos por un video de 15 segundos en 720P con sonido, o 270 créditos en 480P. Como con cualquier referencia de video de Wan 3.0, la plantilla de 15 segundos se cobra junto con los 15 segundos renderizados. Las ejecuciones fallidas se reembolsan automáticamente.
Image 1 reemplaza al intérprete de la izquierda e Image 2 al de la derecha. Usa el botón de intercambio entre los espacios de foto para cambiarlas antes de generar.
Sí. Sube dos fotos distintas de la misma persona y aparecerá a ambos lados del micrófono.
Normalmente de 15 a 20 minutos, porque Wan 3.0 vuelve a dibujar los 15 segundos de la plantilla. Puedes salir de la página; el video terminado se guarda en Mis videos.
Solo fotos tuyas o de personas que hayan dado su permiso. No subas fotos de menores y no uses el efecto para suplantar o engañar a nadie.