Sem precisar de conta

Transforme qualquer áudio em texto

Envie sua gravação e receba ela transcrita: com marcas de tempo, cada voz identificada e um resumo. Sem conta, sem instalar nada.

Arraste seu arquivo para cá

MP3, WAV, M4A, MP4, MOV… e qualquer outro áudio ou vídeo, do tamanho que for

  • Cada voz identificada, e com nome quando der
  • Uma marca de tempo em cada linha: clique e ouça aquele momento
  • Um resumo com os acordos, as tarefas pendentes e os pontos principais
  • MP3
  • WAV
  • M4A
  • AAC
  • OGG
  • FLAC
  • WMA
  • AIFF

Sobre esta ferramenta

Transcrever uma hora de áudio na mão pode levar várias horas de trabalho. Com esta ferramenta leva uns três minutos, e o resultado não é um bloco de texto sem forma: vem organizado por falante, com uma marca de tempo em cada frase, uma busca embutida, e dá para editar ali mesmo no navegador.

Aceita qualquer formato comum (MP3, WAV, M4A, AAC, OGG, FLAC), com limite de 50 GB por arquivo. O idioma é detectado sozinho.

Recursos

  • Detecta o idioma sozinho, entre mais de 90 disponíveis.
  • Identifica as vozes e consegue dar nome a elas pelo contexto.
  • Uma busca que alcança todas as suas transcrições, não só esta.
  • Seus arquivos ficam em servidores da União Europeia e são excluídos sozinhos.

Como funciona

  1. 1

    Envie o áudio

    Arraste ele ou escolha no seu computador. Um arquivo de cada vez, do tamanho que for.

  2. 2

    A gente transcreve

    O processo leva cerca de 5% da duração do arquivo: uma reunião de sessenta minutos fica pronta em uns três.

  3. 3

    Revise e baixe

    Conserte qualquer coisa clicando nela e baixe em DOCX, PDF, SRT, CSV ou JSON.

Casos de uso

Entrevistas

Perguntas e respostas separadas por falante, com uma marca de tempo para conferir cada citação.

Reuniões

O resumo pega as decisões e as tarefas, então ninguém precisa escrever a ata.

Podcasts

Receba as notas do episódio, o artigo e as legendas numa passada só.

Em detalhe

O que determina a qualidade de uma transcrição

Três fatores, e sotaque não é um deles. O primeiro é a distância do microfone: um celular no meio da mesa pega muito mais barulho de sala que o mesmo celular perto de quem está falando, e esse barulho acaba virando palavra errada. O segundo é a fala sobreposta: quando duas pessoas falam ao mesmo tempo, nenhum sistema distingue as duas com precisão.

O terceiro é o vocabulário próprio da gravação. Os erros mais comuns são nomes de empresa, sobrenomes e siglas do setor, justamente porque não aparecem em lugar nenhum. Eles se corrigem em dois minutos editando o texto, e é aí que se ganha precisão de verdade.

O que fazer depois de ter o texto

O recurso mais usado é buscar dentro do texto: achar o momento em que um assunto foi tratado sem ouvir a gravação de novo. Se as vozes estão identificadas, também dá para filtrar por falante, o que reduz muito o tempo de revisão de uma entrevista de uma hora.

O passo seguinte é exportar o resultado: um documento para compartilhar, um SRT para o vídeo, uma planilha para analisar o tempo de fala de cada participante. Nenhuma dessas exportações exige transcrever de novo: exporte no formato que precisar, quantas vezes precisar.

Perguntas frequentes

Precisa transcrever um vídeo?

Envie ele e receba o texto com marcas de tempo, cada voz identificada e um resumo. Sem conta para começar.