Transkribera WAV-filer med talaridentifiering.Okomprimerad kvalitet.

Ladda upp en WAV-inspelning direkt från din fältinspelningsutrustning, DAW-export eller intervjukit. Vi behåller 24-bitars huvudutrymme intakt, kör talaridentifiering på rå PCM och returnerar en tidsstämplad transkription med SRT på några minuter.

Släpp in ditt ljud eller video

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Spela in direkt från webbläsaren

Registrering tar 30 sekunder — inspelningen öppnas direkt efter, i dashboarden.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTFiler raderas automatiskt efter 24 h

↓ Se vad som kommer ut

Rå PCM in. Ren transkription ut.

Okomprimerad WAV innebär att varje sibilant, klusil och svagt ord bevaras intakt — ingen MP3-distorsion på konsonanter. Om filen är flerspårig (en talare per kanal) hoppar vi över akustisk talaridentifiering helt och hållet och delar baserat på kanallayouten.

WAV · 48 kHz / 24-bitREC 2 spår · 1h 12m · 743 MB
auto-detected sv-SEstereo PCM · okomprimerad
~90s
Transkription · realtid97% noggrannhet
S1

Ta mig tillbaka till den morgonen 1978 — vad var klockan när samtalet kom?

S2

Tjugo i fem, ungefär. Vattenkokaren var på, det minns jag.

S1

Och från där körde du direkt ner till hamnen?

S2

Direkt till båtvarvet. Ljusen brann fortfarande när jag kom fram.

97% på spårvis WAVSRT · DOCX · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Tre verkliga alternativ · ärlig jämförelse

Adobe Audition. Descript. Eller vi.

Auditions Speech to Text ingår i Creative Cloud och stannar inne i tidslinjen. Descript importerar WAV-filen till sin egen editor. Vi tar filen som den är, returnerar standardexporter och frågar dig inte att flytta ditt projekt någonstans.

Option 01

Adobe Audition / Premiere

Transkriptionspanel inne i Adobe-tidslinjen. Bunden till Creative Cloud och projektfilen.

KräverCreative Cloud-prenumeration
TalaridentifieringJa, endast nedblandad
Flerspårig WAVPlattas innan STT
ExportSRT · CSV · XML
Språk18, manuell val
Kostnad~23 kr/mån (en app)
Best forRedigerare som redan klipper i Premiere eller Audition och vill ha undertexter sydda till tidslinjen.
Option 02

Transcription.Solutions

Ladda upp WAV-filen. Spårvis talaridentifiering om den är flerspårig. Källljudet raderas inom 24 timmar.

KräverIngenting — bara filen
TalaridentifieringSpårvis eller akustisk
Flerspårig WAVUpp till 16 kanaler
ExportSRT · VTT · DOCX · TXT · JSON
Språk99, auto-identifierad
Pris · per minut0,03 USD
Best forVem som helst som håller i en rå WAV — fältinspelnare, podcastare som exporterar från DAW, munthistoriesamlare, forskare.
Option 03

Descript

Importerar din WAV till Descripts editor. Kraftfull, men du måste arbeta inne i den.

KräverDescript-konto + import
TalaridentifieringAkustisk, EN-optimerad
Flerspårig WAVImporteras som separata klipp
ExportTXT · SRT · DOCX
Språk23, noggrannhet varierar
Kostnad$16–24/användare/mån
Best forPodcastredigerare som vill redigera ljudet genom att redigera transkriptionen — Descripts riktiga superkraft.

Prissättningen är korrekt från och med 2026. Adobe och Descript ändrar funktionsflaggor ofta; kontrollera aktuell dokumentation innan du binder upp dig.

Specifikt för WAV

Tre fel med generiska transkriptionsverktyg.

De flesta uppladdningstjänster samplar ned din WAV i hemlighet innan den skickas till en igenkännare. Vi gör det inte.

Vad som går fel

  1. 1Flerspårig WAV blandas ned till mono. En 4-kanals fältinspelning från en Sound Devices MixPre reduceras till mono innan talidentifiering. Den spårseparation du betalade för kastas bort.
  2. 232-bitars float-WAV:ar från Zoom F-series eller MixPre avvisas helt och hållet, eller klipps ned till 16-bits och förlorar sitt huvudutrymme för signalåtervinning.
  3. 396 kHz / 24-bitars intervjuer tar för evigt att ladda upp eftersom verktyget omkoderar till MP3 i webbläsaren innan det skickas.

Vad du får här istället

  1. 1Ladda upp flerspårig WAV direkt (upp till 16 kanaler). Vi läser kanallayouten från WAV-huvudet och tilldelar en talare per spår — ingen akustisk gissning.
  2. 232-bitars float accepteras nativt. Vi bevarar float-huvudutrymmet när vi normaliserar för igenkännaren, så toppar över 0 dBFS klipps inte av.
  3. 3Direkt binär uppladdning, ingen omkodning i webbläsaren. En 2 GB WAV överförs med din fulla bandbredd och börjar bearbetas i det ögonblick den sista byten kommer fram.

Rekommenderade jobbinställningar för WAV

Ladda upp en WAV och dessa är aktiverade som standard. Åsidosätt per job från formuläret.

Samplingsfrekvens
Inställning (ingen nedsampling)
Bitdjup
24-bit / 32-float bevarad
Talaridentifiering
Spårvis om flerspårig
Talarmodell
Intervju · 2-8 talare
Fyllord
Behållet (slå av om nödvändigt)
Export
DOCX · SRT · tidsstämplad TXT

Accuracy · real-world numbers

97%+ på spårvis WAV. WAV ger igenkännaren den renaste möjliga signalen.

Eftersom WAV lagrar rå PCM utan perceptuell komprimering, konsonanter och sibilanter smetas inte ut på det sätt som MP3 gör. Igenkännaren hörer vad mikrofonen hörde. Siffrorna nedan kommer från verkliga kundprojekt i produktion.

98%
Studio-WAV · en talare

48 kHz / 24-bit, storkondensormikrofon, behandlat rum. Berättarröst, audioböcker och röstöverbokningar hamnar här.

96%
Flerspårig intervju-WAV

En kanal per talare (lavaliermikrofoner eller grünsmikrofoner). Talaridentifiering är bara kanalomdirigering — endast textfel.

92%
Handhållen fältinspelningsapparat

Zoom H5, Tascam DR-40, liknande. Stereo-rörelseupptagning, 2-3 talare, någon rumsreflexion. De flesta podcast-WAV-filer hamnar här.

85%
Bullrig miljö fält-WAV

Utomhus, café, fordon. Okomprimerad inhämtning hjälper — bullret är verkligt, inte codec-artefakt — men noggrannheten sjunker fortfarande på överlappande tal.

Vanliga frågor

8 frågor om WAV-transkription

01Vad är den maximala WAV-filstorleken?+
5 GB per fil på standardplanen, vilket är ungefär 8 timmar stereo 48 kHz / 24-bit, eller 2,5 timmar 96 kHz / 24-bit. Större filer fungerar bra på teamplanen — kontakta oss bara innan uppladdningen.
02Stödjer ni 32-bitars float-WAV från Zoom F-series eller MixPre?+
Ja, nativt. Vi läser float-samplen utan klippning vid 0 dBFS, så höga transienter som du planerade att dra ned i efterbearbetningen transkriberas fortfarande rena. De flesta generiska uppladdningstjänster konverterar tyst till 16-bit först.
03Jag har en 4-kanals WAV från en fältinspelningsapparat — en mikrofon per person. Kommer talaridentifiering att använda det?+
Det kommer det. Ladda upp polyfon-WAV direkt (blanda inte ned till stereo först). Vi tolkar kanallayouten från WAV-huvudet och tilldelar en talare per spår — mycket mer tillförlitligare än akustisk talaridentifiering på liknande röster.
04Kommer ni att sampla ned min 96 kHz WAV?+
Igenkännaren körs på 16 kHz internt — det är talets maximala förståelighetsgräns. Men vi håller originalfilen opåverkad och använder den för all efterbearbetning som brusgrinding. Dina exporter refererar till den ursprungliga tidslinjen.
05Är WAV faktiskt mer korrekt än MP3 för transkription?+
Marginellt, ja — vanligtvis 1-2 poäng bättre på ren tal. Större skillnaden märks på sibilanter och låga passager, där MP3:s psykoakustiska komprimering kastar bort information som igenkännaren skulle ha använt. För arkivering eller domstolsbevis är WAV rätt val.
06Bevaras BWF-metadata och tidskod?+
Vi läser BWF-bitar (bext, iXML) och använder starttidskoden för att anpassa transkriptionen till din sessionstidslinje. Originalfilen ändras aldrig — vi arbetar på en kopia som raderas inom 24 timmar.
07Kan jag ladda upp en mapp med WAV-filer från en DAW-sessionexport?+
Ja. Batch-uppladdning accepterar upp till 50 filer åt gången. Varje WAV får sitt eget jobb och sin transkription. Om de är spår från en session kan du också slå ihop dem till en enda flerspårig WAV innan uppladdning så diariscerar vi spårvis.
08Hur lång tid tar egentligen en tim stereo-WAV?+
Uppladdningen är den långsammaste delen — en 1 tim 48 kHz / 24-bits stereo-WAV är cirka 600 MB och tar 2-5 minuter på vanlig bredbandshastighet. När den väl är uppladdad körs själva transkriptionen på ungefär 4-6 minuter i standardkön.

Ladda upp din WAV. Behåll okomprimerad kvalitet. Se vad som kommer ut.

30 gratis minuter varje månad. Inget kreditkort. Spårvis talaridentifiering, 32-bitars float stöds, källljudet raderas inom 24 timmar.

Starta gratis