Para qué sirve
- Hacer hablar a tu avatar IA (mismo personaje, distintos voiceovers).
- Reels donde quieres mostrar a alguien hablando sin grabar a una persona real cada vez.
- Anuncios cortos con un testimonio o frase impactante.
- Convertir un retrato en un vídeo de presentación.
Qué necesitas
Una foto
Retrato bien iluminado, cara visible y bien enfocada. JPG/PNG.
El audio o el texto
Sube un MP3/WAV con la voz, o escribe el texto y elige una voz IA
(TTS).
Cómo funciona
1
Sube la foto
Una sola imagen, vertical o cuadrada funciona bien para 9:16.
2
Pon la voz
Dos vías:
- Audio propio: graba o sube tu MP3/WAV. La voz es tuya, perfecta cuando quieres un voiceover concreto.
- TTS: escribes el texto y eliges una de las voces IA. Más rápido cuando no tienes audio listo.
3
Genera y descarga
La generación dura entre 1 y 3 minutos según la duración del audio.
El resultado es un MP4 con la cara hablando y el audio sincronizado.
Coste
Coste por segundo real de habla (4 cr/s). Si pasas texto en TTS,
el sistema calcula la duración de la voz y cobra exactamente eso (los
excesos se reembolsan tras la generación).
Buenas prácticas
- Foto frontal o ¾: la sincronización de labios funciona mejor cuando la cara mira a cámara. Perfil pierde detalle.
- Audio limpio: si la voz tiene ruido de fondo, los labios pueden moverse a destiempo. Graba en un sitio silencioso o usa TTS.
- Texto corto y natural cuando uses TTS. Frases largas suenan más artificiales que dos frases cortas seguidas.
- Combina con Personajes para reutilizar siempre la misma cara IA en todos tus vídeos hablados.
Limitaciones
- Una sola persona en la foto. Si hay varias, la IA elige una.
- Sin idiomas raros: cualquier idioma con TTS habitual funciona.
Prueba: zevor.ai/foto-que-habla.
