Trascrizione audio in Arabo gratis nel tuo browser
VoxScriber Nano capisce il Arabo (العربية) e processa localmente sul tuo dispositivo. Limite di 10 min in modalità gratuita.
Esegue VoxScriber Nano (open-source) nel tuo browser — IA locale, fino a 10 min per file, precisione base (~85%). Per uso professionale, scopri Premium.
La trascrizione avviene localmente nel tuo browser. Puoi scegliere di condividere il risultato con noi (opzionale, con consenso) per migliorare il servizio. Limite: 10 min per file, precisione ~85%.
Gratuito vs Premium — le differenze
| Gratuito (browser) | Premium (cloud) | |
|---|---|---|
| Limite per file | 10 min | 10 horas |
| Precisione | ~85% | >95% |
| Diarizzazione (chi parla) | ❌ | ✅ |
| Timestamp per parola | ❌ | ✅ |
| Supporto video (MP4/MOV) | ❌ | ✅ |
| Formati di esportazione | TXT, SRT, VTT | DOCX, PDF, JSON… |
| Velocità (1h audio) | ~2 min / 1h | ~2 min / 1h |
| Privacy | 100% local | ☁️ + 🔒 |
IA locale
La trascrizione avviene nel tuo browser. La condivisione con i nostri server è opzionale (richiede consenso).
Veloce e locale
Elaborazione IA direttamente nel browser, senza code di attesa.
99 lingue
Rileva automaticamente la lingua dell'audio.
Senza registrazione
Inizia subito, senza creare un account.
Come funziona
Carica o registra l'audio
Trascina un file MP3, WAV, M4A, OGG o usa il microfono direttamente.
L'IA gira sul tuo dispositivo
Whisper AI si scarica una volta e rimane in cache. Nessuna attesa la prossima volta.
Copia o scarica il testo
Risultato in pochi secondi. Scarica in .txt o copia con un click.
Quanto bene Whisper gestisce Arabo?
Whisper trascrive l'arabo standard moderno in modo più affidabile, scritto da destra a sinistra senza segni diacritici (tashkeel) — come è normalmente scritto l'arabo. Il supporto per i dialetti varia: egiziano e levantino funzionano ragionevolmente, mentre il maghrebino (Darija) è il più debole. Il code-switching con francese o inglese all'interno di una frase funziona ma riduce la precisione.
Da dove proviene solitamente l'audio in Arabo
Messaggi vocali WhatsApp — il mezzo vocale dominante nel mondo arabo — più recitazioni coraniche e sermoni, lezioni universitarie e clip TV o di notizie.
Quanto è precisa la trascrizione nel browser?
La trascrizione nel browser esegue il modello Whisper di OpenAI direttamente sul tuo dispositivo usando WebAssembly. Offriamo tre dimensioni di modello e la precisione dipende da quale scegli:
- Nano (~40MB) — Il predefinito. Circa l'85% di precisione su parlato chiaro. Ideale per appunti rapidi, messaggi vocali e bozze. L'unico modello funzionante su iOS.
- Mini (~150MB) — Circa il 90% di precisione. Un buon compromesso se il tuo dispositivo ha 4GB+ di RAM e hai bisogno di un output più pulito.
- Plus (~500MB) — L'opzione locale più precisa, che si avvicina al 93% su audio chiaro. Più lento da scaricare e eseguire; ideale su desktop con 8GB+ di RAM.
Cosa riduce la precisione per qualsiasi modello locale: rumore di fondo, più persone che parlano sovrapposte, accenti marcati e registrazioni a basso bitrate come note vocali compresse. Se hai bisogno di una precisione professionale superiore al 95%, timestamp a livello di parola o etichette dei parlanti, sono necessari modelli cloud — vedi il confronto sopra.
Trascrizione nel browser vs cloud: di quale hai bisogno?
La trascrizione nel browser è lo strumento giusto quando la privacy è prioritaria o l'audio è breve: non viene caricato nulla, non c'è nulla da eliminare dopo e non costa nulla. Il compromesso è la velocità e la precisione — la tua CPU elabora circa un'ora di audio in venti minuti e il modello locale salta le etichette dei parlanti e la tempistica a livello di parola.
La trascrizione cloud è lo strumento giusto quando stai lavorando: riunioni, interviste, lezioni, registrazioni legali. Le GPU dedicate trasformano un'ora di audio in testo in circa due minuti con oltre il 95% di precisione, etichettano fino a 30 parlanti diversi, accettano file fino a 10 ore di durata ed esportano in DOCX, PDF e JSON oltre ai formati di sottotitoli.
Una regola pratica: se ti sentiresti a tuo agio a leggere la registrazione ad alta voce in un bar, la velocità e la precisione del cloud vincono. Se l'audio è sensibile — una consulenza medica, una riunione riservata, un appunto vocale privato — lo strumento nel browser mantiene tutto sul tuo computer e ti dà comunque una trascrizione utilizzabile in pochi minuti. Molti dei nostri utenti combinano entrambi: appunti privati rapidi nel browser, lavoro professionale nel cloud.
Vedi i piani Premium →Formati audio supportati
Carica MP3, WAV, M4A, OGG, OPUS, FLAC o WEBM — tutto ciò che il tuo browser può decodificare. Le fonti comuni funzionano subito: note vocali WhatsApp (OPUS), memo vocali iPhone (M4A), file del registratore Android, registrazioni Zoom (M4A/MP4), messaggi vocali Telegram (OGG) e file podcast (MP3). I contenitori video come MP4 e MOV vengono decodificati per la traccia audio quando il browser supporta il codec. Se un file non viene caricato, la causa più comune è un codec insolito all'interno di un contenitore comune — convertirlo prima in MP3 risolve il problema quasi sempre.
Hai bisogno prima di un formato diverso? Usa i nostri convertitori gratuiti: convertitore audio gratuito MP3 / WAV / OGG / AAC
Hai bisogno di più? Scopri il Premium
Per uso professionale — diarizzazione, file lunghi, analisi IA e tutti i formati di esportazione.
Diarizzazione dei parlanti
Identifica automaticamente chi parla in ogni segmento. Perfetto per riunioni, interviste e podcast.
File fino a 10 ore
Il modello locale supporta fino a 10 min. Premium gestisce file fino a 10 ore.
Riassunto, sentiment e argomenti
L'IA analizza il contenuto e genera riassunti, analisi del sentiment ed estrazione di argomenti.
Esportazione completa
Esporta in SRT, VTT, DOCX, JSON e PDF — ideale per sottotitoli, documenti e automazioni.
Domande frequenti
L'audio viene inviato a un server?
La trascrizione gira al 100% localmente nel tuo browser. Puoi scegliere di condividere audio e trascrizione con noi (casella di consenso) per migliorare il servizio — completamente opzionale.
Quali formati audio sono supportati?
MP3, WAV, M4A, OGG, FLAC, WEBM, MP4, MOV e qualsiasi formato che il tuo browser riesce a decodificare.
Quanto può durare il file audio?
Fino a 10 minuti per file in modalità gratuita. Per file più lunghi, il piano Premium supporta fino a 10 ore.
Quali lingue sono supportate?
Il modello Whisper supporta 99 lingue: italiano, inglese, portoghese, spagnolo, francese, tedesco, giapponese, arabo e molte altre.
Devo installare qualcosa?
No. Funziona direttamente nel browser. Il modello IA (~40MB) si scarica una volta e rimane in cache.
La trascrizione viene salvata da qualche parte?
Per impostazione predefinita, no — il risultato rimane solo nel tuo browser. Se spunti la casella di consenso, audio e trascrizione vengono inviati ai nostri server ed eliminati dopo 7 giorni. Puoi revocare il consenso in qualsiasi momento.
Qual è la differenza con il Premium?
La modalità gratuita usa VoxScriber Nano quantizzato a 4 bit (q4) localmente: limite 10 min per file, precisione ~85%, senza diarizzazione dei parlanti e timestamp solo a livello di segmento (~30s). Il Premium usa modelli cloud (AssemblyAI + Whisper Large float32): precisione >95%, diarizzazione fino a 30 parlanti, timestamp per parola, file fino a 10h, supporto video MP4/MOV/MKV ed export DOCX/PDF/JSON. Velocità: 1h audio impiega ~20min sulla tua CPU locale vs ~2min sulla GPU dedicata di Premium.
Funziona su mobile?
Sì, ma le prestazioni dipendono dal dispositivo. Su smartphone con poca RAM la trascrizione può essere più lenta.
È davvero gratuito?
Sì. Il trascrittore nel browser è genuinamente gratuito, senza periodo di prova, senza watermark e senza registrazione. Guadagniamo dai piani cloud Premium, non dallo strumento gratuito.
Il mio audio lascia il mio dispositivo?
No — la trascrizione avviene localmente tramite WebAssembly. L'unica eccezione è se selezioni esplicitamente la casella di consenso opzionale per condividere una registrazione con noi.
C'è un limite alla dimensione del file?
Il limite pratico è la durata (10 minuti per file) e la memoria del tuo dispositivo, non i megabyte. Un MP3 di 10 minuti è tipicamente 10-20MB e funziona bene sulla maggior parte dei dispositivi.
Quanto tempo richiede la trascrizione?
Con il modello Nano, prevedi circa 1-2 volte la durata dell'audio su un laptop moderno — un file di 5 minuti richiede circa 5-10 minuti. La prima esecuzione aggiunge un download una tantum del modello di circa 40MB.
Posso esportare sottotitoli (SRT)?
Sì — le esportazioni gratuite includono .txt, .srt e .vtt con timestamp dei segmenti. Per la precisione dei timestamp a livello di parola e le esportazioni DOCX/PDF/JSON, vedi Premium.
Posso trascrivere più file contemporaneamente?
Sì — puoi mettere in coda fino a 5 file e vengono elaborati uno dopo l'altro nel tuo browser. Premium rimuove il limite di coda e elabora i file in parallelo nel cloud.
Perché la prima trascrizione richiede più tempo?
Alla tua prima visita, il modello AI viene scaricato e compilato dal tuo browser. Viene poi memorizzato nella cache, quindi ogni trascrizione successiva inizia immediatamente.
Funziona offline?
Parzialmente — una volta che il modello è in cache, la trascrizione stessa non necessita di connessione. Devi comunque essere online per caricare la pagina stessa.
Trascrive i dialetti o solo l'arabo standard moderno?
Entrambi, ma l'MSA è più preciso; egiziano e levantino funzionano ragionevolmente, maghrebino meno.
Aggiunge tashkeel (segni diacritici)?
No — l'output è in arabo standard senza segni diacritici, come viene normalmente scritto.
La visualizzazione da destra a sinistra è supportata?
Sì — la trascrizione viene visualizzata da destra a sinistra e le esportazioni lo preservano.