Otter Pro
長檔案限制在每個錄音 4 小時。說話者標籤在 2 小時後漂移。
放入一個 長音檔 — 最長 10 小時,5 GB (Business 計畫)。我們並行分割,保持說話者 ID 始終一致,傳回單一轉錄稿而非編號資料夾。
↓ 5 小時檔案,轉錄進行中
大多數工具在 90 分鐘左右逾時,或將你的 長錄音 分割成編號的部分,你必須自己拼接。我們以 12 分鐘的重疊視窗分割,並行處理,然後進行全局說話者識別重新組合。
我們已經進行三個小時 — 讓我們回到上午會議的供應鏈要點。
沒錯,越南製造業轉向。我認為我們忽略了交期風險。
關稅變化後,交期從 14 天增加到 31 天。
那還沒考慮長灘港口的擁堵。
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
三個真實選項·誠實的比較
消費者工具限制檔案長度並無聲地截斷。Whisper API 有 25 MB 的每個請求限制,所以你得自己構建分割器。我們接受整個 10 小時檔案並傳回單一轉錄稿。
長檔案限制在每個錄音 4 小時。說話者標籤在 2 小時後漂移。
10 小時每個檔案。並行分割,全局說話者識別,傳出單一 DOCX。
每分鐘最便宜。你自己構建分割器、說話者拼接和重試邏輯。
定價和限制截至 2026 年 5 月準確。Otter Pro 長度限制最後在其公開定價頁面驗證。
特定於長檔案
大多數管道是為一小時會議構建的。長音檔以可預測的方式打破它們 — 以下是我們做的不同之處。
放入任何超過 90 分鐘的檔案,這些會自動啟用。從表單覆蓋每個工作。
Accuracy · real-world numbers
長音檔的難點不是模型 — 是從第 1 分鐘到第 600 分鐘保持準確度平穩。說話者漂移和分割邊界誤差 是大多數管道的殺手。下面的數字是根據完整長度的客戶檔案測量的,不是前 10 分鐘。
有聲書朗讀、獨播播客、聽寫文稿。6-10 小時乾淨語音,無室內噪音。無需說話者識別。
會議桌、適當的麥克風、3-5 小時。全局說話者識別將 ID 保持在整個檔案中穩定。
7-9 小時的培訓日,麥克風交接和觀眾問答。名字需要在說話者芯片上進行 5 分鐘識別。
長口述歷史、焦點小組或有重疊語音和環境噪音的座談會。可用,但預期需要清理。
常見問題