Transcrieți fișiere audio lungi.Până la 10 ore. Fără timeout.

Încărcați un fișier audio lung — până la 10 ore, 5 GB pe Business. Noi îl fragmentăm în paralel, menținem ID-uri de vorbitor consecvente de la cap la coadă și vă întoarcem un singur transcript în loc de o mapă numerotată.

Aruncă aici audio sau video

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Înregistrează direct din browser

Înregistrarea se face în 30 de secunde — recorder-ul se deschide imediat, direct în dashboard.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTFișierele se șterg automat în 24h

↓ Un fișier de 5 ore, la jumătatea transcriererii

Ore la rând. Un singur fișier curat la ieșire.

Majoritatea instrumentelor expiră în jurul marcajului de 90 de minute sau îți împart înregistrarea lungă în parțiale numerotate pe care trebuie să le unești. Noi fragmentăm în ferestre suprapuse de 12 minute, le procesăm în paralel și le reasamblăm cu o trecere globală de vorbitor.

Ședință de strategie a consiliuluiREC 3 vorbitori · 5:14:22 · 3,1 GB
auto-detectat en-GB44,1 kHz stereo · 192 kbps
~90s
Transcript · fișier unic92% acuratețe · t=3:14:08
S1

Suntem trei ore în — să revenim la punctul lanțului de aprovizionare din sesiunea de dimineață.

S2

Corect, pivoții de producție din Vietnam. Cred că am trecut ușor peste riscul timpului de livrare.

S1

Timpii de livrare au crescut de la 14 la 31 de zile după schimbarea tarifelor.

S3

Și asta este înainte să luăm în calcul congestia portului din Long Beach.

92% pe întreg fișierul de 5hDOCX · SRT · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Trei opțiuni reale · comparație onestă

Otter Pro. Fragmentare DIY Whisper. Sau noi.

Instrumentele de consum limitează lungimea fișierului și trunchează în tăcere. Whisper API are o limită de 25 MB pe cerere, deci trebuie să construiești fragmentatorul tu însuți. Noi acceptăm întregul fișier de 10 ore și returnăm un singur transcript.

Option 01

Otter Pro

Limitează fișierele lungi la 4 ore per înregistrare. Etichetele de vorbitor se abat după marca de 2 ore.

Lungime maximă a fișierului4 ore (nivel Pro)
Dimensiune maximă a fișierului~1,5 GB încărcare
ID-uri de vorbitor de cap la coadăSe abate după 2 ore
Ieșire fișier lungDocument unic, trunchat la limită
Cost$16,99/utilizator/lună
Încărcare reluabilăNu
Best forÎntâlniri scurte sub 2 ore. Eșuează la înregistrări pe o zi întreagă.
Option 02

Transcription.Solutions

10 ore per fișier. Fragmentare în paralel, trecere globală de vorbitor, un DOCX la ieșire.

Lungime maximă a fișierului10 ore (Pro & Business)
Dimensiune maximă a fișierului2 GB Pro · 5 GB Business
ID-uri de vorbitor de cap la coadăTrecere de embedding globală
Ieșire fișier lungFișier unic · DOCX/SRT/TXT
Cost · pe minut$0,03 plat indiferent de lungime
Încărcare reluabilăMultipart, rezistă la întreruperi
Best forAteliere pe o zi, depuneri, ședințe ale consiliului, istorii orale — orice mai mult de peretele de 90 de minute.
Option 03

Whisper API + fragmentare DIY

Cel mai ieftin pe minut. Tu construiești fragmentatorul, unirea de vorbitori și logica de reîncercare.

Lungime maximă a fișierului25 MB pe cerere (~25 min)
Dimensiune maximă a fișieruluiLimită fixă de 25 MB
ID-uri de vorbitor de cap la coadăNici unii — fără diarizare
Ieșire fișier lungParțiale numerotate, tu le unești
Cost · pe minut$0,006 (OpenAI Whisper)
Timp de inginerieOre până la zile per conductă
Best forIngineri care vor text brut pe bucată și nu au nevoie de vorbitori, rezumate sau o singură ieșire.

Prețurile și limitele sunt corecte din mai 2026. Limita de lungime Otter Pro a fost verificată ultima dată pe pagina lor publică de prețuri.

Specific pentru fișiere lungi

Trei moduri în care instrumentele generice eșuează după marca de 90 de minute.

Majoritatea conductelor au fost construite pentru întâlniri de o oră. Audio lung le rupe în moduri previzibile — iată ce facem noi diferit.

Ce merge prost

  1. 1Timeout tăcut la 90 de minute. Jobul se rotește o oră, apoi moare fără o eroare utilă. Rămâi cu nimic de reîncercat.
  2. 2ID-uri de vorbitor se abat între bucăți. Vorbitorul 1 la ora 1 devine Vorbitorul 4 la ora 3 pentru că fiecare bucată este diarizată în izolare.
  3. 3Ieșirea este o mapă numerotată. `transcript_part_01.txt` până la `transcript_part_24.txt` cu resetări de marcaj de timp la fiecare limită de bucată. Tu le unești pe tine.

Ce să inversezi aici

  1. 1Încărcare multipart reluabilă. Conexiunea se cade la ora 2 din încărcare? Se reia din ultima bucată completă. Fără re-încărcare a 4 GB.
  2. 2Trecere globală de embedding de vorbitor. După diarizarea per-bucată, noi grupăm voci pe întreg fișierul deci Vorbitorul 3 este aceeași persoană la minutul 12 și minutul 487.
  3. 3DOCX unic cu marcatori de oră. Un fișier, marcaje de timp continue, pauze de capitol opționale fiecare 60 de minute. Fără unire.

Setări de job recomandate pentru fișiere lungi

Încarcă orice peste 90 de minute și acestea se activează automat. Suprascriu per-job din formular.

Strategie de fragmentare
Ferestre de 12 min · suprapunere de 10s
Diarizare
Trecere globală pe toate bucățile
Model de vorbitor
Lungă-formă · 2-20 vorbitori
Încărcare
Multipart reluabilă
Coadă
Prioritate (plan Business)
Export
DOCX unic · marcatori de oră activați

Accuracy · real-world numbers

92% se menține pe un fișier de 5 ore. Calitatea rămâne constantă de la o oră la alta.

Partea grea cu audio lung nu este modelul — este menținerea acurateții constante de la minutul 1 la minutul 600. Derivă de vorbitor și erori la granițele bucăților sunt ceea ce ucide majoritatea conductelor. Numerele de mai jos sunt măsurate pe fișierele de clienți cu lungime completă, nu pe primele 10 minute.

95%
Lungă-formă studio, vorbitor singular

Narație de audiobook, podcast solo, manuscris dictat. 6-10 ore de voce curată fără zgomot ambient. Fără diarizare necesară.

92%
Sală de consiliu, 2-6 vorbitori

Masă de conferință, microfon decent, 3-5 ore. Trecerea globală de vorbitor ține ID-uri stabile pe întreg fișierul.

88%
Atelier pe o zi încreagă, microfoane lavalieră

Zi de training de 7-9 ore cu treceri de microfon și întrebări din public. Numele necesită o trecere de 5 minute pe cipurile de vorbitor.

82%
Masă rotundă în teren, 8+ vorbitori

Istorie orală lungă, grup de discuție, sau panou cu voci suprapuse și zgomot ambient. Utilizabil, dar așteaptă-te la curățare.

Întrebări frecvente

8 lucruri pe care oamenii le întreabă despre transcriere audio lungă.

01Care sunt limitele reale de lungime și dimensiune a fișierului?+
10 ore per fișier atât pe Pro cât și pe Business. Pro limitează dimensiunea fișierului la 2 GB, Business la 5 GB. Dacă ai ceva mai lung de 10 ore, împarte-l o dată la o pauză naturală — vom menține ID-uri de vorbitor consecvente dacă le încarci înapoi-la-spate pe același proiect.
02Primesc un singur transcript sau o mapă de parțiale numerotate?+
Un fișier. Întotdeauna. DOCX, SRT, TXT, sau JSON — alegere ta. Marcajele de timp rulează continuu de la 00:00:00 la sfârșitul înregistrării, nu se resetează la fiecare limită de bucată.
03Cât durează pentru ca un fișier de 6 ore să se întoarcă?+
Aproximativ 18-25 de minute pe coada Pro, 8-12 pe prioritate Business. Procesăm bucățile de 12 minute în paralel, deci timpul ceasului scalar sub-liniar cu lungimea fișierului, nu minut-pentru-minut.
04ID-urile de vorbitor rămân consecvente de cap la coadă?+
Da. După diarizarea per-bucată, o trecere globală de embedding grupează voci pe întreg fișierul. Vorbitorul 3 la minutul 12 este același Vorbitor 3 la minutul 487. Asta este principalul lucru pe care conductele DIY Whisper îl fac greșit.
05Ce se întâmplă dacă încărcarea mea se cade la ora 3 dintr-un fișier de 4 GB?+
Încărcarea multipart reluabilă se reia din ultima bucată completă. Nu re-încarci primii 3 GB. Funcționează pe Wi-Fi hotelului inconstant și tethering celular — am testat amândouă.
06De ce Whisper API eșuează la fișiere lungi?+
Punctul final Whisper al OpenAI are o limită fixă de 25 MB pe cerere — aproximativ 25 de minute de audio comprimat. Orice mai lung necesită să fragmentezi, să transcrieți în paralel, apoi să unești transcrieri și să aliniezi vorbitori tu însuți. Noi facem asta totvă pe server-side.
07Prețul pe-minut este același pe un fișier de 10 ore ca pe un fișier de 10 minute?+
Da. $0,03 per minut plat, indiferent de lungime. Un fișier de 10 ore costă $18. Nu suprataxăm fișiere lungi cum face Rev ($1,50/min uman × 10 ore = $900).
08Pot obține marcatori de capitole sau marcaje de timp fiecare oră?+
Comutează 'Marcatori de oră' pe formularul de job și DOCX-ul se exportă cu o pauză de titlu fiecare 60 de minute. SRT menține timecode continuu. JSON are ambele — tablou de capitol plus marcaje de timp la nivel de cuvânt.

Încărcați-vă fișierul lung. Primiți înapoi un singur transcript.

30 de minute gratuite fiecare lună. Fără card. Fișiere până la 10 ore, etichete de vorbitor care rămân consecvente, export single-file.

Începeți gratuit