Transkriber MP4-video til tekst.Lyd ekstrahert automatisk.

Slipp MP4-filen som den er — vi henter lydspor fra serversiden, returnerer en tidsstemplet transkripsjon, og sender en SRT som går rett tilbake til YouTube, Vimeo, eller din NLE.

Slipp lyden eller videoen din her

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Ta opp rett fra nettleseren

Registrering tar 30 sekunder – opptak åpnes rett etterpå, i dashbordet.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTFiler slettes automatisk etter 24t

↓ Se hva som kommer ut

MP4 inn. Transkripsjon + SRT ut.

MP4 er en beholder — vi leser lydstrømmen direkte, omkoder aldri videoen. Tidsstempler forblir bildepresise til din original-tidslinje, så SRT-en stemmer på første import.

training-module-04.mp4REC 1080p · 22:14 · 412 MB
auto-detektert en-USAAC 48 kHz stereo · 192 kbps
~90s
Transkripsjon · streaming95 % nøyaktighet
S1

Greit, i denne modulen går vi gjennom returarbeidsflyten fra ende til ende.

S2

Et raskt spørsmål før vi starter — gjelder dette også delvise refusjoner?

S1

Bra påpeking. Delvise bruker samme skjerm men en annen kode.

S2

Skjønner. Og godkjenningsterskelen er fortsatt to hundre dollar?

95 % på rent dialogSRT · VTT · DOCX · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Tre virkelige alternativer · ærlig sammenligning

DIY med ffmpeg. En videoeditor. Eller oss.

Du kan ekstrahere lyden selv og kjøre Whisper. Du kan dra MP4 inn i Descript eller VEED og jobbe inne i redigeringsprogrammet deres. Eller du kan slippe filen her og få transkripsjon + SRT tilbake, uten å være låst til noen editor.

Option 01

ffmpeg + Whisper

Gratis, lokal, fåfengt. Du eier pipelinen og hver bug i den.

KreverCLI + 10 GB modell + GPU
TaleidentifikasjonEget verktøy (pyannote)
SRT-utgangJa, manuelt flagg
Tid på 1-times MP420–90 min på CPU
Multi-track lydDu velger strømmen
Kostnad$0 + din maskinvare
Best forIngeniører som allerede kjører Whisper lokalt og ikke har noe imot å sette på diarization.
Option 02

Transcription.Solutions

Slipp MP4-en. Lydekstraksjon, diarization, SRT, sammendrag — en operasjon.

KreverNettleser, det er alt
TaleidentifikasjonInnebygd, hver jobb
SRT-utgangBildepresise til kilde
Tid på 1-times MP4~4 min, streamet
Multi-track lydVi lister alle strømmer
Kostnad · per min$0.03
Best forAlle med MP4 som vil ha teksten og SRT uten å lære en videoeditor eller CLI.
Option 03

Descript / VEED

Last MP4 inn i editoren. Transkripsjon vises som del av timeline UI.

KreverKonto + læringskurve for editor
TaleidentifikasjonJa, EN-justert
SRT-utgangEksport-barriert etter plan
Opplastingsak5 GB (Descript gratis)
Multi-track lydFørst spor bare
Kostnad$12–24/bruker/mnd
Best forRedaktører som vil klippe videoen og transkripsjon i samme verktøy.

Priser og funksjonsgrenser tilnærmet som av 2026. Descript og VEED tiernavn endres hyppig — sjekk nettstedet deres for gjeldende grenser.

Spesifikt for MP4

Tre ting som biter mennesker på generiske transkripsjonverktøy.

MP4 er en beholder, ikke en kodek — og de fleste transkripsjonverktøy behandler det som en stor lydklump. Det er der feilene kommer fra.

Hva som går galt

  1. 1Multi-track MP4 med boom + lav. Generiske verktøy tar spor 1 og ignorerer resten, så du mister den renere mikrofonen. Vanlig på FCP og Premiere-eksporter.
  2. 2Bakgrunnsmusikk i vlogs og annonser utløser fantom-ord. Gjenkjenneren prøver å transkribere vokalene på musikksengen.
  3. 3SRT-tidsstempler drifter når verktøyet omkoder videoen på vei inn. Ved minutt 40 er bildene en sekund unna.

Hva du skal vende her

  1. 1Last opp — vi sonder hver lydstrøm og lar deg velge hvilken som skal transkriberes. Standard er spor med høyest bitrate.
  2. 2Slå på Musikkuntertrykking på jobbskjemaet. Vi porter gjenkjenneren på talestemmningsdetektering slik at instrumentale seksjoner forblir tomme.
  3. 3Vi omkoder aldri video. Lyd ekstraheres ved native samplingsrate, tidsstemplinger refererer til beholdernes redigeringsliste — SRT stemmer bildepresist.

Anbefalte jobinstillinger for MP4

Slipp MP4 og disse slår på som standard. Overstyring per-jobb fra skjemaet.

Lydekstraksjon
Native samplingsrate, ingen omkoding
Sporvalg
Høyeste-bitrate-strøm
Diarization
Akustisk · 1-6 talere
Musikkuntertrykking
På for vlog/ad-forhåndsinnstillinger
SRT-format
≤42 tegn/linje, 2 linjer maks
Eksport
SRT · VTT · DOCX · tidsstemplet TXT

Accuracy · real-world numbers

95 % på et rent opptak. Ærlige tall når lyden slår tilbake.

MP4-nøyaktighet settes av mikrofonen, ikke kodeken. En lavaliermikrofon på et stille sett slår alltid et 4K-kamera med integrert lyd. Tallene nedenfor kommer fra ekte kunde-MP4-er, sortert etter hva som fanger lyden.

96%+
Studio-opptak, lav eller shotgun-mikrofon

Lavaliermikrofon eller boom inn i en opptaker, 48 kHz AAC ved 192+ kbps, behandlet rom. Tak-tilfellet. Talemerking slår gull på et to-person opptak.

93%
DSLR med on-kamera shotgun

Kamera-topp mikrofon 2-4 fot fra taler. Noe romton men tale er forståelig. De fleste YouTube-skaperopp lander her.

89%
Skjermopptak med USB-mikrofon

OBS, Loom, Camtasia-eksporter. Mikrofon er nær men rom er ubehandlet, ofte med systemlyd-bleed. Dårlig nok for veilednings-transkripsjon.

84%
Telefonfilmet vlog, integrert mikrofon

Innebygd telefon-mikrofon, vind eller håndteringsstøy, avstand varierer bilde for bilde. Ord er brukbare, forvent 1-2 rettelser per minutt på egennavn.

Vanlige spørsmål

8 ting mennesker spør om MP4-transkripsjon.

01Omkoder du videoen min?+
Nei. Vi leser bare lydstrømmen ut av MP4-beholderen. Videostrømmen berøres aldri, omkodes aldri, og lagres aldri etter at jobben avsluttes — du beholder originalfilen uendret.
02Hvilke kodeker inni MP4 støttes?+
Standard H.264 + AAC er den enkle saken. Vi håndterer også HEVC/H.265, ProRes-in-MP4, og lyd i MP3, Opus, ALAC, eller PCM. Hvis ffmpeg kan sonde det, kan vi transkribere det.
03Hva er filstørrelsesgrensen?+
10 GB per opplasting på nettopplasteren, 50 GB via API med resumable chunks. En typisk 1-times 1080p MP4 er 1-3 GB så de fleste filer passer nettbanen uten å tenke på det.
04Blir SRT min stilt opp med originalvideoen?+
Ja — tidsstemplinger refererer til MP4-ens redigeringsliste og native samplingsrate. Vi omkoder ikke, så det er ingen drift. Slipp SRT ved siden av MP4 i enhver spiller eller NLE og titler synkroniseres på første lasting.
05Kan jeg brenne bildtekstene inn i videoen?+
Ikke på vår side — vi utsender SRT og lar brennkloppen være til redigereren din. ffmpeg one-liner, HandBrake, Premiere, DaVinci, Kapwing — all accept SRT vi produserer. Vi vil ikke være kodingsverktøyet også.
06Hva med MOV, MKV, M4V, WebM?+
Alt støttes gjennom samme pipeline. MOV spesielt — samme MPEG-4-familie, identisk ekstraksjonssti. MKV med flere lydspor får samme spor-picker UI som multi-track MP4.
07Kan jeg bare sende YouTube eller Vimeo URL?+
Ja for YouTube — lim inn offentlig URL på opplastingsskjermen og vi henter lyden direkte, ingen MP4-nedlasting nødvendig. Vimeo krever en direkte fil eller en signert nedlastingskobling fordi spiller deres porter strømmen.
08Hva hvis det ikke er noe talestykke, bare musikk eller B-roll?+
VAD detekterer stille og musikk-bare seksjoner og hopper over dem, så du betaler ikke for omgivende opptak. Transkripsjon merker disse områdene som `[music]` eller `[no speech]` i stedet for å finne opp ord.

Slipp MP4-en din. Få transkripsjon og SRT tilbake.

30 gratis minutter hver måned. Intet kort. Lyd ekstrahert på serversiden, talemerking, bildepresise SRT — alt inkludert.

Start gratis