こんな方に
録音があって、打ち込む気のないすべての方。議事録にしなければならない議会。教会のサイトに載せる説教。正確に引用しなければならないインタビュー。見直すより検索したい講義。
仕組み
- 1
ファイルをアップロードします。ふつうの形式なら何でも——wav、mp3、m4a、ogg——動画も可、音はこちらで取り出します。
- 2
まず話し声のある箇所を探し、それが何分で、いくらになるかをお伝えします。待ち行列に入る前に価格がわかります。
- 3
ライブの部屋がカードを必要としないときに動くので、録音が誰かの催しを遅らせることはありません。
- 4
終わったらメールでお知らせし、結果はアカウントでお待ちしています。
得られるもの
- 全文を、話された言語で。
- SRT と VTT の字幕を、それぞれのタイムコードつきで。
- 生の発言を JSON で、開始と終了つき。ほかのものに流し込めます。
- 話し声だけ:沈黙も拍手も空白も入っていませんし、課金もされません。
- お送りいただいたファイルは、仕事が終わった時点で削除します。
- 結果はアカウントに15日間残ります。
限界はここ: 録音1件につき音声は 4 時間、動画は 1 時間、800 MBまで、同時に3件。それより長い会議は分割して送ります。録音はそれ自身の長さの約10分の1かかります——マシンが空いていれば、1時間の音声で6分ほどの待ちです。
よくある質問
- どれくらいの精度が期待できますか?
- ほぼ完全に録音次第です。静かな部屋のピンマイクならほぼ完璧に文字になります。反響する会場でテーブルに置いた携帯は語を落としますし、それは後からどんなエンジンでも直せません。
- 句読点はつきますか?
- つきます——句点、読点、大文字。読まれるために書かれており、小文字の壁ではありません。
- 動画を送れますか?
- 送れます。mp4、mov、mkv、avi、webm。そこから音声を取り出して作業します。動画は保存しません。
- 私の録音は何かの学習に使われますか?
- 使いません。仕事が終わると削除され、アカウントにある文字起こし以外は何も残りません。
- 音声に複数の言語が入っていたら?
- エンジンが何が話されているかを判定します。途中で言語が切り替わる場合はお知らせください——そのケースは、頼りにする前にご自身の音声で試しておく価値があります。
ファイルにできる、ほかのこと
同じファイル、同じエンジン、そして同じクレジットの財布。この中のひとつだけで足りる人はほとんどいません——セッションを文字起こしすれば、結局は誰が話したのかを知りたくなります。
そこでしか使われない言葉
組織固有の名前——人名、通りの名、型番、役職——は、汎用モデルが一度も聞いたことのないものであり、まさにそこで間違えます。似た響きのありふれた言葉に置き換えてしまうのです。一度書いておけば、間違えなくなります。 ジョブに書いておけば、その録音に効きます。
- 学習ではなくリストです。書けば最初の一文から効きます。
- 何も収集しません。音声も、テキストも、一秒たりとも。
- そして込みです。追加プランでも請求項目でもありません。