Dicte un mensaje corto (3-5 oraciones), pronunciando signos de puntuación y estructura en su voz, y luego dé la orden de limpiar. JSON de retorno {"raw_dictation":"...","cleanup_instruction":"...","result":"..."}: dictado sin formato con comandos de voz, instrucciones para peinarse y texto limpio final.
El dictado es la traducción de voz a texto en tiempo real. El modelo escucha el sonido, predice palabras basándose en el sonido y el significado de las palabras vecinas, por lo que el habla coherente se reconoce con mayor precisión que los fragmentos irregulares. Ella misma no siempre pone signos de puntuación; se pueden pronunciar en voz alta: "coma", "punto", "nueva línea", "párrafo". Esta es la primera palanca: dicte la estructura en voz alta y el resultado será un texto terminado, no uno continuo. La segunda palanca es más importante: no intentes imponer puramente. Es más rápido decir el pensamiento tal como está, con reservas y repeticiones, y luego con un comando preguntarle a la IA: “quita las repeticiones, peina tu cabello, deja el significado”. La voz da volumen y velocidad, el modelo da pureza. Información privilegiada: dicte en fragmentos largos en lugar de una palabra a la vez: el contexto ayuda al reconocimiento y aumenta la precisión. Un error típico es dictar en un lugar ruidoso con el volumen saltando y luego sorprenderse con los errores; Incluso el volumen y un micrófono cercano hacen más que cualquier configuración. Y siempre verifique los números y los nombres: el modelo los confunde con mayor frecuencia.
Desbloquee el acceso para enviar soluciones para una revisión instantánea de la IA.