Trascrivi file WAV con etichette parlante.Qualità senza perdite.

Carica una registrazione WAV direttamente dal tuo rig portatile, bounce DAW o kit interviste. Manteniamo intatta la headroom a 24 bit, eseguiamo la diarizzazione sul PCM grezzo e restituiamo una trascrizione con timestamp e SRT in pochi minuti.

Trascina qui il tuo audio o video

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Registra direttamente dal tuo browser

La registrazione richiede 30 secondi: la registrazione si apre subito dopo, nella dashboard.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTFile cancellati automaticamente in 24h

↓ Scopri cosa esce

PCM grezzo in. Trascrizione pulita fuori.

WAV senza perdite significa che ogni sibilante, occlusiva e parola tranquilla sopravvive intatta — nessun artefatto MP3 sulle consonanti. Se il file è multitraccia (un parlante per canale), saltiamo completamente la diarizzazione acustica e dividiamo in base al layout del canale.

WAV · 48 kHz / 24-bitREC 2 tracce · 1h 12m · 743 MB
rilevamento automatico en-GBPCM stereo · non compresso
~90s
Trascrizione · streaming97% accuratezza
S1

Riportami a quella mattina nel settantotto — a che ora è arrivata la chiamata?

S2

Un quarto alle cinque, più o meno. Il bollitore era acceso, ricordo questo.

S1

E da lì sei andato dritto verso il porto?

S2

Dritto al cantiere navale. Le luci erano ancora accese quando sono entrato.

97% su WAV per tracciaSRT · DOCX · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Tre opzioni reali · confronto onesto

Adobe Audition. Descript. O noi.

Speech to Text di Audition è incluso in Creative Cloud e rimane dentro la timeline. Descript importa il WAV nel suo editor. Prendiamo il file così com'è, restituiamo export standard e non ti chiediamo di spostare il tuo progetto da nessuna parte.

Option 01

Adobe Audition / Premiere

Pannello trascrizione dentro la timeline Adobe. Vincolato a Creative Cloud e al file del progetto.

Richiedeabbonamento Creative Cloud
Diarizzazione parlanteSì, solo mixato
WAV multitracciaAppiattito prima di STT
ExportSRT · CSV · XML
Lingue18, selezione manuale
Costo~$23/mese (app singola)
Best forEditor che stanno già montando in Premiere o Audition e vogliono sottotitoli cuciti alla timeline.
Option 02

Transcription.Solutions

Carica il WAV. Diarizzazione per canale se è multitraccia. Sorgente eliminata in 24h.

RichiedeNiente — solo il file
Diarizzazione parlantePer traccia o acustica
WAV multitracciaFino a 16 canali
ExportSRT · VTT · DOCX · TXT · JSON
Lingue99, rilevamento automatico
Costo · per min$0.03
Best forChiunque abbia un WAV grezzo — registratori portatili, podcaster che esportano da una DAW, archivisti di storia orale, ricercatori.
Option 03

Descript

Importa il tuo WAV nell'editor di Descript. Potente, ma devi lavorare dentro di esso.

Richiedeaccount Descript + importazione
Diarizzazione parlanteAcustica, ottimizzata per EN
WAV multitracciaImportazione come clip separate
ExportTXT · SRT · DOCX
Lingue23, accuratezza variabile
Costo$16–24/utente/mese
Best forEditor di podcast che vogliono modificare l'audio modificando la trascrizione — il vero superpotere di Descript.

Prezzi accurati a partire dal 2026. I flag delle funzioni Adobe e Descript cambiano frequentemente; controlla la documentazione attuale prima di impegnarti.

Specifico per WAV

Tre cose che mordono la gente su strumenti di trascrizione generici.

La maggior parte degli uploader ridimensiona silenziosamente il tuo WAV prima di inviarlo a un riconoscitore. Noi no.

Cosa va storto

  1. 1Il WAV multitraccia viene appiattito. Una registrazione sul campo a 4 canali da un Sound Devices MixPre viene mixata in mono prima di STT. La separazione per microfono che hai pagato viene gettata via.
  2. 2I WAV a virgola mobile a 32 bit da Zoom F-series o MixPre vengono rifiutati completamente, oppure tagliati a 16 bit e perdono il recupero della headroom.
  3. 3Le interviste a 96 kHz / 24 bit impiegano un'eternità per essere caricate perché lo strumento ricodifica in MP3 nel browser prima di inviare.

Cosa cambiare qui

  1. 1Carica il WAV multitraccia così com'è (fino a 16 canali). Leggiamo il layout del canale dall'intestazione WAV e assegniamo un parlante per traccia — nessuna supposizione acustica.
  2. 2Il virgola mobile a 32 bit è accettato nativamente. Preserviamo la headroom in virgola mobile quando normalizziamo per il riconoscitore, quindi i picchi sopra 0 dBFS non si tagliano.
  3. 3Caricamento binario diretto, nessuna transcodifica nel browser. Un WAV da 2 GB si muove alla tua larghezza di banda completa e inizia l'elaborazione nel momento in cui l'ultimo byte arriva.

Impostazioni consigliate per lavori WAV

Carica un WAV e questi si attivano per impostazione predefinita. Ignora per lavoro dal modulo.

Frequenza di campionamento
Nativa (nessun ridimensionamento)
Profondità di bit
24 bit / 32-float preservati
Diarizzazione
Per canale se multitraccia
Modello di parlante
Intervista · 2-8 parlanti
Parole di riempimento
Mantenute (disattiva se necessario)
Export
DOCX · SRT · TXT con timestamp

Accuracy · real-world numbers

97%+ su WAV per traccia. WAV fornisce al riconoscitore il segnale più pulito possibile.

Poiché WAV memorizza PCM grezzo senza compressione percettiva, le consonanti e le sibilanti non vengono smussate come MP3 le smusa. Il riconoscitore sente quello che il microfono ha sentito. I numeri sottostanti provengono da veri lavori WAV dei clienti in produzione.

98%
Studio WAV · singolo parlante

48 kHz / 24-bit, condensatore a diaframma grande, stanza trattata acusticamente. Narrazione, audiolibri, prenotazioni di voice-over finiscono qui.

96%
WAV d'intervista multitraccia

Un canale per parlante (microfoni lavalier o a confine). La diarizzazione è solo routing del canale — errore solo testuale.

92%
Registratore portatile

Zoom H5, Tascam DR-40, simili. Pickup XY stereo, 2-3 parlanti, qualche riflessione ambientale. La maggior parte dei WAV podcast finisce qui.

85%
WAV portatile in ambiente rumoroso

Esterno, caffè, veicolo. La cattura senza perdite aiuta — il rumore è reale, non un artefatto del codec — ma l'accuratezza scende ancora con il parlato sovrapposto.

Domande comuni

8 cose che la gente chiede sulla trascrizione WAV.

01Qual è la dimensione massima del file WAV?+
5 GB per file nel piano standard, che è circa 8 ore di stereo 48 kHz / 24 bit, o 2,5 ore di 96 kHz / 24 bit. File più grandi vanno bene nel piano team — contattaci prima del caricamento.
02Supportate i WAV a virgola mobile a 32 bit da Zoom F-series o MixPre?+
Sì, nativamente. Leggiamo i campioni in virgola mobile senza taglio a 0 dBFS, quindi i transienti forti che avevi pianificato di ridurre in post vengono comunque trascritti chiaramente. La maggior parte degli uploader generici silenziosamente down-cast a 16 bit per primo.
03Ho un WAV a 4 canali da un registratore portatile — un microfono per persona. La diarizzazione lo userà?+
Sì. Carica il WAV polifonico direttamente (non esportare in stereo prima). Analizziamo il layout del canale dall'intestazione WAV e assegniamo un parlante per traccia — molto più affidabile della diarizzazione acustica su voci simili.
04Ridimensionerete il mio WAV a 96 kHz?+
Il riconoscitore funziona a 16 kHz internamente — questo è il limite della intelligibilità del parlato umano. Ma manteniamo il tuo file originale intatto e lo usiamo per qualsiasi post-elaborazione come noise gating. I tuoi export fanno riferimento alla timeline originale.
05WAV è effettivamente più accurato di MP3 per la trascrizione?+
Leggermente, sì — di solito 1-2 punti di WER sul parlato pulito. Il divario maggiore appare su sibilanti e passaggi tranquilli, dove la compressione psicoacustica di MP3 scarta informazioni che il riconoscitore avrebbe usato. Per il lavoro archivistico o forense, WAV è la scelta giusta.
06I metadati BWF e il timecode vengono preservati?+
Leggiamo i chunk BWF (bext, iXML) e usiamo il timecode iniziale per allineare la trascrizione alla tua timeline di sessione. Il WAV originale non viene mai modificato — lavoriamo su una copia che viene eliminata entro 24h.
07Posso caricare una cartella di file WAV da un'esportazione di sessione DAW?+
Sì. Il caricamento in batch accetta fino a 50 file alla volta. Ogni WAV ottiene il suo lavoro e la sua trascrizione. Se sono stem da una sessione, puoi anche unirli in un singolo WAV multitraccia prima del caricamento e faremo la diarizzazione per canale.
08Quanto tempo impiega effettivamente un WAV stereo di 1 ora?+
Il caricamento è la parte più lenta — un WAV stereo di 1 ora a 48 kHz / 24 bit è circa 600 MB e impiega 2-5 minuti su banda larga tipica. Una volta caricato, la trascrizione stessa viene eseguita in circa 4-6 minuti nella coda standard.

Carica il tuo WAV. Mantieni la qualità senza perdite. Scopri cosa esce.

30 minuti gratuiti ogni mese. Nessuna carta. Diarizzazione per traccia, virgola mobile a 32 bit supportata, audio sorgente eliminato in 24h.

Inizia gratuitamente