Cómo funciona

De la grabación al texto, paso a paso

El proceso tiene tres pasos. Aquí te explicamos cada uno en detalle: qué garantizamos y qué debes tener en cuenta.

Los tres pasos

  1. 01

    Subes el archivo

    Arrástralo a la página o selecciónalo desde tu equipo. Se sube directamente a nuestro almacenamiento, sin pasar por la aplicación, así que una grabación de dos horas no se interrumpe a medias.

    • La barra de progreso muestra los datos reales que se han subido.
    • Puedes cerrar la pestaña: la subida continúa y el texto te esperará.
    • El proceso no empieza hasta que el archivo se ha subido por completo.
  2. 02

    Analizamos el audio

    Medimos la duración real, detectamos el idioma, separamos las voces y generamos el texto con la marca de tiempo exacta de cada palabra.

    • Los hablantes aparecen primero como «Hablante A», «Hablante B»; al renombrarlos, se actualiza todo el texto.
    • La marca de tiempo es por palabra, no por párrafo, por eso el reproductor va sincronizado.
    • El progreso que ves refleja el avance real del trabajo.
  3. 03

    Revisas y descargas

    Corrige cualquier línea directamente sobre el texto. Las versiones anteriores se conservan, y el buscador indexa tus cambios.

    • Busca por contenido, no solo por el nombre del archivo.
    • Descarga en DOCX, PDF, SRT, CSV o JSON, con los subtítulos listos para usar.
    • Si era una reunión, genera el resumen con los acuerdos y las tareas pendientes.

En detalle

Decisiones técnicas que marcan la diferencia

Tres criterios que explican la diferencia entre una transcripción útil y un bloque de texto sin estructura.

Medimos la duración nosotros mismos

Los minutos que se descuentan salen de medir tu archivo directamente, no de la cifra que indique el proveedor. Si hay diferencia, prevalece la de tu archivo.

Guardamos el resultado original

Conservamos la respuesta del modelo antes de cualquier procesado adicional. Si mejoramos el sistema, podemos regenerar transcripciones antiguas sin coste extra.

Cada hablante tiene una ficha única

El nombre se guarda en un solo lugar, no repetido en cada línea. Por eso renombrar es instantáneo y no hay inconsistencias entre líneas.

Formatos y límites

Qué archivos admitimos

Audio

MP3, WAV, M4A, AAC, FLAC, OGG, OPUS

Vídeo

MP4, MOV, WEBM, MKV, AVI

Tamaño máximo
50 GB por archivo
Duración máxima
10 horas por grabación
Idiomas
Más de 90, detección automática
Hablantes
Hasta 32 por grabación

Puedes subir vídeo sin problema: solo extraemos el audio, y no supone coste adicional.

Precisión

Qué nivel de precisión puedes esperar

Con audio limpio en español o inglés, la precisión ronda el 98 % palabra por palabra. Con ruido de fondo, voces solapadas o acentos marcados, suele situarse entre el 92 % y el 96 %.

Qué mejora el resultado

  • Tener el micrófono cerca de quien habla.
  • Evitar que las personas hablen a la vez.
  • Indicar el idioma manualmente si ya lo conoces.

Qué lo empeora

  • Grabar con el teléfono lejos de las voces.
  • Tener música o televisión de fondo.
  • Grabar en un lugar con mucho ruido ambiente.

Tus grabaciones

Dónde se almacenan tus datos

Dentro de la Unión Europea

La grabación y la transcripción se procesan y almacenan en servidores europeos.

El audio se elimina automáticamente

A los 14 días sin plan de pago, o a los 90 con plan activo. El texto se conserva mientras tengas la cuenta.

Tu contenido sigue siendo tuyo

No usamos tus grabaciones para entrenar modelos. Si borras una transcripción, su audio se elimina ese mismo día.

Pruébalo con una grabación tuya

Obtén una muestra transcrita sin necesidad de tarjeta.