使い方

録音からテキストまで、順を追って

工程は3つです。それぞれを詳しく——お約束できることと、覚えておいていただきたいこと。

3つの工程

  1. 01

    ファイルをアップロードする

    ページに置くか、端末から選んでください。アプリを経由せず保管庫へ直接上がるので、2時間の録音が途中で止まることはありません。

    • 進捗バーは、実際に上がったデータ量を示します。
    • タブは閉じて構いません。アップロードは続き、テキストが待っています。
    • 処理はファイルが上がりきってから始まります。
  2. 02

    音声を処理する

    本当の長さを測り、言語を判定し、声を分けて、単語ごとに正確な時間の付いたテキストを作ります。

    • 話者ははじめ「話者A」「話者B」です。名前を変えれば全文に反映されます。
    • タイムスタンプは段落単位ではなく単語単位で、だからプレーヤーがずれません。
    • 表示される進捗は、実際に進んでいる作業そのものです。
  3. 03

    見直してダウンロードする

    どの行でも本文の上で直せます。前の版は残り、検索の索引にも直した内容が反映されます。

    • ファイル名だけでなく、中身で検索できます。
    • DOCX、PDF、SRT、CSV、JSONでダウンロード。字幕はそのまま使えます。
    • 会議なら、決まったことと宿題をまとめた要約を作れます。

舞台裏

効いている技術的な判断

使える文字起こしと、ただの文章の塊との差を生んでいる3つの選択です。

長さはこちらで測ります

差し引く分数は、提供元が申告する数字ではなく、お客さまのファイルを直接測って出しています。食い違ったときは、ファイルのほうが正しいものとします。

最初の結果を残します

後段の処理を加える前の、モデルが出したそのものを保管しています。あとで仕組みを良くしたとき、古い文字起こしを追加費用なしで作り直せます。

話者は1つの記録にまとまっています

名前は各行に繰り返さず、一度だけ保存されます。だから改名が一瞬で済み、行どうしが食い違うこともありません。

形式と上限

受け付けるもの

音声

MP3、WAV、M4A、AAC、FLAC、OGG、OPUS

動画

MP4、MOV、WEBM、MKV、AVI

最大サイズ
1ファイル50GB
最長
1録音10時間
言語
90以上、自動判定
話者
1録音あたり32人まで

動画でも構いません。取り出すのは音声だけで、追加費用はかかりません。

精度

どのくらいの精度を見込めるか

スペイン語か英語のきれいな音声なら、単語単位でおよそ98%です。背景に雑音があったり、声が重なったり、なまりが強かったりする場合は、だいたい92%から96%のあいだになります。

効くこと

  • 話している人の近くにマイクを置く。
  • 同時に話すのを避ける。
  • 言語が分かっているなら、手で指定する。

精度を落とすこと

  • 声から遠いところにスマートフォンを置いて録る。
  • 音楽やテレビが後ろで鳴っている。
  • 騒がしい場所で録る。

あなたの録音

データが置かれる場所

処理も保管も欧州連合のなかで

録音も文字起こしも、欧州のサーバーで処理・保管されます。

音声は自動で削除

有料プランなしなら14日後、プランありなら90日後です。文章はアカウントがあるあいだ残ります。

内容はあなたのものです

録音をモデルの学習に使うことは決してありません。文字起こしを削除すれば、その音声も同じ日に消えます。

ご自分の録音で試す

カードなしで、文字起こしのサンプルが手に入ります。