Preparar el texto para la locución y describir la presentación. Devuelve JSON {"script":"...","voice_style":"...","emphasis_notes":"..."}: texto corto “para el oído” (hasta 80 palabras), estilo de voz (tono, tempo, emoción) y notas sobre pausas/énfasis y palabras complejas.
La síntesis de voz lee el texto con tu voz y suena exactamente como lo escribiste: el modelo lo lee literalmente. Esto significa que debes escribir “para el oído” y no para el ojo. Mecánica: el motor toma texto, signos de puntuación y signos de estilo y los utiliza para crear entonación, pausas y tempo. Palancas. La primera es que la puntuación controla el ritmo: un punto da una pausa, una elipsis da consideración, las frases cortas suenan seguras, las largas suenan pesadas. En segundo lugar, establezca no sólo el texto, sino también la presentación: voz (locutor tranquilo, amigable, enérgico), emoción y tempo. “Lea esto” y “léalo con calidez, lentamente, como para un amigo” dan resultados diferentes. Truco profesional: escriba palabras complejas, nombres y abreviaturas como suenan o divídalos; de lo contrario, el motor los leerá a su manera. La segunda técnica: colocar pausas intencionalmente (con comas, puntos, dividir en líneas) donde el significado requiere un respiro; la naturalidad del habla se basa en las pausas y no en la voz. Un error típico es presentar a doblaje un “texto para leer con los ojos” con largos puntos y notas a pie de página; suena como si se estuviera desmoronando. Escriba brevemente, diga el borrador en voz alta con anticipación.
Desbloquee el acceso para enviar soluciones para una revisión instantánea de la IA.