Da WAV a testo per registrazioni professionali
Il WAV è il formato di chi tiene al proprio audio: sessioni di registrazione in studio, registrazioni sul campo, take di voice-over, digitalizzazioni di archivi e aule di tribunale. Questi file sono grandi — una singola ora di audio non compresso può superare i 600 MB — il che rende il “caricalo sul nostro server” un flusso di lavoro terribile.
Questo strumento evita completamente il caricamento. Il file WAV viene decodificato nel tuo browser e trascritto sul tuo hardware, così anche un file enorme inizia a essere elaborato all'istante invece di procedere a rilento caricandosi sulla tua connessione. I tuoi file non vengono mai caricati — tutto avviene sul tuo dispositivo.
Verifica del supporto del browser in corso…
Come trascrivere un file WAV
-
Trascina il file WAV
Qualsiasi frequenza di campionamento o numero di canali funziona — lo strumento effettua automaticamente il downmix e il ricampionamento prima della trascrizione.
-
L'elaborazione inizia all'istante
Nessuna attesa per il caricamento, anche per file molto grandi. La trascrizione appare in modo progressivo, mostrandoti l'avanzamento rispetto alla durata della registrazione.
-
Rifinisci ed esporta
Correggi il vocabolario tecnico direttamente nel testo, poi esporta in TXT per i documenti, in SRT/VTT per i sottotitoli o in JSON con le tempistiche precise dei segmenti.
Progettato per file di grandi dimensioni
Nessun collo di bottiglia per il caricamento
Un file di sessione da 600 MB richiederebbe un'eternità per essere caricato. Leggerlo localmente richiede pochi secondi — l'unico vero lavoro è la trascrizione stessa.
Qualsiasi frequenza di campionamento
CD a 44.1 kHz, audio video a 48 kHz, master a 96 kHz, archivi telefonici a 8 kHz: tutto viene ricampionato correttamente dietro le quinte.
I tuoi master restano tuoi
Le registrazioni inedite e le sessioni dei clienti non toccano mai un server di terze parti. Ciò che hai registrato rimane esattamente dove l'hai messo.
Domande frequenti sulla trascrizione WAV
- C'è un limite di dimensione del file?
- Non viene imposto alcun limite rigido. I file molto grandi sono limitati solo dalla memoria del tuo dispositivo; l'audio viene elaborato a finestre per mantenere un uso costante della memoria durante la trascrizione vera e propria.
- Le frequenze di campionamento elevate migliorano la trascrizione?
- Non proprio — i modelli di riconoscimento vocale ascoltano a 16 kHz e il tuo file viene ricampionato automaticamente a quella frequenza. Le frequenze di campionamento elevate non fanno danni, ma non aumentano neanche la precisione.
- Stereo, mono, multicanale?
- Va tutto bene. I canali vengono convertiti in mono facendo la media prima della trascrizione, che è ciò che si aspetta il riconoscimento vocale.
- Quale modello esegue il riconoscimento?
- Il modello open source Whisper di OpenAI, eseguito localmente nel tuo browser dal nostro motore open source. Nessun dato relativo al tuo audio viene inviato all'esterno per eseguirlo.
- Posso trascrivere più take di seguito?
- Sì — trascina il file successivo non appena la trascrizione precedente è completata (o annulla a metà strada). Il modello rimane caricato, quindi i file successivi saltano il download e si avviano più velocemente.