長いオーディオファイルをトランスクライブします。最大10時間、タイムアウトなし。

長いオーディオファイルをドロップ — Business最大10時間、5 GB対応。並列でチャンキングし、スピーカーIDを一貫性保ちながら処理し、番号付きフォルダではなく1つのトランスクリプトを返します。

音声または動画をドロップ

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

ブラウザから直接録音

サインアップは30秒 — その後すぐにダッシュボードで録音が開始されます。

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTファイルは24時間後に自動削除

↓ 5時間ファイルの途中

何時間でも。 1つのきれいなファイルで完了。

ほとんどのツールは90分前後でタイムアウトするか、長い音声を番号付きの部分に分割し、手動で接合する必要があります。12分の重複するウィンドウでチャンキングし、並列処理し、グローバルスピーカーパスで再構成します。

戦略会議REC 3スピーカー · 5:14:22 · 3.1 GB
自動検出 en-GB44.1 kHz ステレオ · 192 kbps
~90s
トランスクリプト · 単一ファイル92% 精度 · 処理時間 3:14:08
S1

3時間経ったので、朝のセッションからのサプライチェーン ポイントに戻りましょう。

S2

そうですね、ベトナム製造へのシフト。リードタイム リスクを見落としていたと思います。

S1

関税変更後、リードタイムは14日から31日に延びました。

S3

これはロングビーチの港湾混雑を考慮する前の話です。

5時間ファイル全体で92%DOCX · SRT · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

3つの実際のオプション · 正直な比較

Otter Pro、DIY Whisper チャンキング、 またはTranscription.Solutions。

コンシューマーツールはファイル長を制限し、サイレント切り詰めします。Whisper APIは25 MBのリクエスト上限があるため、チャンカーを自分で構築します。10時間全ファイルを受け入れ、1つのトランスクリプトを返します。

Option 01

Otter Pro

長いファイルを1録音あたり4時間に制限。スピーカーラベルは2時間を過ぎるとドリフ���。

最大ファイル長4時間(Pro層)
最大ファイルサイズ~1.5 GB アップロード
スピーカーID一貫性2時間後ドリフト
長ファイル出力単一ドキュメント、上限で切り詰め
コスト$16.99/ユーザー/月
レジューマブル アップロードなし
Best for2時間未満の短い会議。丸1日の音声では機能しません。
Option 02

Transcription.Solutions

1ファイル10時間。並列チャンキング、グローバルスピーカーパス、1つのDOCXで完了。

最大ファイル長10時間(Pro & Business)
最大ファイルサイズ2 GB Pro · 5 GB Business
スピーカーID一貫性グローバル埋め込みパス
長ファイル出力単一ファイル · DOCX/SRT/TXT
コスト · 分単位$0.03 固定(長さ問わず)
レジューマブル アップロードマルチパート、接続断対応
Best for終日ワークショップ、証拠調べ、取締役会、口述歴史 — 90分の壁を超えるあらゆる場面。
Option 03

Whisper API + DIY チャンキング

分単位での最安値。チャンカー、スピーカー接合、リトライロジックは自分で構築。

最大ファイル長リクエストあたり25 MB(~25分)
最大ファイルサイズ25 MB ハード上限
スピーカーID一貫性なし — ダイアライゼーション非対応
長ファイル出力番号付き部分、手動で接合
コスト · 分単位$0.006(OpenAI Whisper)
エンジニア時間パイプラインあたり数時間から数日間
Best forチャンクあたりの生テキストを望み、スピーカー、要約、単一出力を不要とするエンジニア。

価格と制限は2026年5月時点で正確です。Otter Pro長さ制限は公開価格ページで最後に確認されています。

長いファイル��特有

汎用ツールが 90分を過ぎて失敗する3つの方法。

ほとんどのパイプラインは1時間の会議用に構築されています。長いオーディオは予測可能な方法で破破壊します — 当社の異なる対応方法をご紹介します。

何が問題になるか

  1. 190分でサイレント タイムアウト。 ジョブは1時間スピンしてから、有用なエラーなしで失敗。リトライできるものが何もありません。
  2. 2チャンク間でスピーカーID がドリフト。 1時間目のスピーカー1は、各チャンクが単独でダイアライゼーションされるため、3時間目ではスピーカー4になります。
  3. 3出力は番号付きフォルダ。 `transcript_part_01.txt` から `transcript_part_24.txt` まで、すべてのチャンク境界でタイムスタンプがリセット。手動で接合します。

ここで変更すること

  1. 1レジューマブル マルチパート アップロード。 4 GBのアップロードの2時間目で接続が落ちても? 最後に完了した部分から再開。4 GB再アップロードなし。
  2. 2グローバル スピーカー埋め込みパス。 チャンク単位のダイアライゼーション後、ファイル全体の声をクラスタ化するため、スピーカー3は12分も487分で同じ人物。
  3. 3時間マーカー付き単一DOCX。 1つのファイル、継続的なタイムスタンプ、オプションで60分ごとのチャプター ブレーク。接合なし。

長いファイルの推奨ジョブ設定

90分を超えるものをドロップすると、これらは自動的にオンになります。フォームからジョブごとにオーバーライド。

チャンク戦略
12分ウィンドウ · 10秒オーバーラップ
ダイアライゼーション
すべてのチャンク全体でグローバル パス
スピーカー モデル
長編 · 2~20スピーカー
アップロード
レジューマブル マルチパート
キュー
優先度(Business プラン)
エクスポート
単一DOCX · 時間マーカー オン

Accuracy · real-world numbers

92%は5時間ファイル全体で維持されます。 品質は時間ごとに変わりません。

長いオーディオの難しい部分はモデルではなく、1分から600分まで精度をフラットに保つことです。スピーカードリフトとチャンク境界エラーはほとんどのパイプラインを破壊するものです。以下の数字は最初の10分ではなく、全長の顧客ファイル全体で測定されています。

95%
スタジオ長編、単一スピーカー

オーディオブック朗読、ソロ ポッドキャスト、口述原稿。6~10時間のきれいな音声、ルーム ノイズなし。ダイアライゼーション不要。

92%
会議室、2~6スピーカー

会議テーブル、まともなマイク、3~5時間。グローバルスピーカーパスでファイル全体でID を安定させます。

88%
終日ワークショップ、ラペル マイク

マイク引き継ぎと視聴者Q&Aを伴う7~9時間の研修日。スピーカー チップで5分間のパスが必要な名前。

82%
フィールド ラウンドテーブル、8以上のスピーカー

長い口述歴史、フォーカス グループ、または声の重複と環境ノイズを伴うパネル。使用可能ですが、クリーンアップを想定。

よくある質問

8つのよくある質問 — 長いオーディオトランスクリプションについて。

01実際のファイル長とサイズの制限は何ですか?+
Pro と Business 両プランで 10 時間あたり。 Pro はファイルサイズを 2 GB に制限、Business を 5 GB に制限。10 時間を超えるものがある場合は、自然なブレークで1度スプリット — 同じプロジェクトで連続してアップロードすれば、スピーカーID を一貫性保ちます。
021つのトランスクリプトか番号付き部分のフォルダか?+
1つのファイル。常に。DOCX、SRT、TXT、またはJSON — 選択 可能。タイムスタンプはすべてのチャンク境界でリセットされるのではなく、00:00:00 から記録の終了まで継続して実行されます。
036時間ファイルの返信にかかる時間は?+
Pro キューで約 18~25 分、Business 優先度で 8~12 分。12 分のチャンクを並列処理するため、ウォール クロック時間はファイル長に対して線形ではなく部分線形でスケール。
04スピーカー ID は end-to-end で一貫性を保ちますか?+
はい。チャンク単位のダイアライゼーション後、グローバル埋め込みパスはファイル全体の声をクラスタ化します。12分のスピーカー3は487分でも同じスピーカー3。DIY Whisper パイプラインが間違える主要なものです。
054 GB ファイルの3時間目でアップロードが落ちたら?+
レジューマブル マルチパート アップロードは最後に完了した部分から再開。最初の 3 GB を再アップロードしない。不安定なホテル Wi-Fi とセルラー テザリングで動作 — 両方テスト済み。
06Whisper API が長いファイルで失敗する理由は?+
OpenAI の Whisper エンドポイントにはリクエストあたり 25 MB のハード キャップ — 圧縮オーディオの約 25 分。それ以上は、チャンクし、並列でトランスクライブし、トランスクリプトを接合してスピーカーを手動で��整する必要があります。すべてサーバー側で実行。
07分単位の価格は、10時間ファイルで10分ファイルと同じ?+
はい。分単位平坦 $0.03、長さに関係なく。10時間ファイルは $18 。Rev のように長いファイルに追加課金しません($1.50/分 人間 × 10時間 = $900)。
08時間マーカーまたは1時間ごとのタイムスタンプを取得できますか?+
ジョブ フォームで 'Hour markers' をトグルすると、DOCX は 60 分ごとのヘッディング ブレークでエクスポート。SRT は継続的なタイムコードを保持。JSON には両方 — チャプター配列とワード レベルのタイムスタンプ。

長いファイルをドロップしたら、 1つのトランスクリプトを取得。

毎月30分無料。カード不要。最大10時間のファイル、一貫性を保つスピーカーラベル、単一ファイル エクスポート。

無料で始める