Ecco la risposta, situazione per situazione.
Se il video ha i sottotitoli: usa l'opzione di traduzione dei sottotitoli della piattaforma stessa. Leggere testo già pubblicato batte ricavarlo di nuovo dal suono.
Se possiedi il file: trascrivilo, poi traduci la trascrizione. Più accurato, più veloce del tempo reale, e ottieni testo modificabile.
Se sta suonando in un'altra app: la via del microfono — un'app come OmniTalk ascolta l'altoparlante del tuo telefono. Togli gli auricolari; il circuito è acustico.
Se è una chiamata Telefono o FaceTime su hardware recente: la Traduzione live di Apple, senza bisogno di app.
Se i sottotitoli sono impressi nell'immagine: metti in pausa e traduci il fotogramma fermo con la fotocamera.
"Traduci questo video" sembra un compito solo. Sono tre, e scegliere quello sbagliato è il motivo per cui la gente conclude che niente funziona. La domanda che li separa non è in che lingua sia l'audio. È dove vive l'audio.
| Cosa hai | Il problema reale | Cosa lo risolve |
|---|---|---|
| Un file sul telefono o sul computer | Decodificare e trascrivere una registrazione fissa | Un servizio di trascrizione, o un'app che importa file |
| Qualcosa che suona in un'altra app | Raggiungere un audio che il sistema non consegna | Il microfono, o i sottotitoli della piattaforma stessa |
| Una chiamata dal vivo o uno streaming | Tutto quanto sopra, in tempo reale, senza seconda possibilità | Traduzione dal vivo, sulla chiamata o tramite il microfono |
Il vincolo che spiega tutto
iOS non offre alcun modo generale perché un'app legga l'uscita audio di un'altra app. Non c'è un tap dell'audio di sistema, nessun dispositivo di loopback, niente che un'app possa richiedere. Il meccanismo di trasmissione dello schermo di Apple può passare a un'estensione broadcast il flusso audio di sistema, ma richiede che l'utente avvii una trasmissione dello schermo dal Centro di Controllo, ed esiste per trasmettere lo schermo, non per leggere le altre app.
Quindi, quando un'app afferma di tradurre un video che suona in un'altra app, sta facendo una di due cose: leggere sottotitoli che la piattaforma già pubblica, o ascoltare con il microfono l'altoparlante del tuo stesso telefono.
La via del microfono è quella che usa la maggior parte delle app, compresa la nostra. È un vero circuito acustico: il telefono riproduce l'audio ad alta voce, e il telefono lo risente.
La cancellazione dell'eco è l'impostazione nascosta. Ogni app vocale esegue normalmente la cancellazione acustica dell'eco, il cui unico compito è rimuovere dal segnale del microfono l'uscita dell'altoparlante del telefono, così non ti senti da solo in chiamata. Per questa funzione quel filtro è esattamente sbagliato, perché l'uscita dell'altoparlante è la cosa che vuoi catturare. Un'app che fa le cose per bene lo disattiva.
Cosa ti costa. Rumore ambientale, riverbero e qualità dell'altoparlante entrano tutti nella trascrizione. Una stanza silenziosa e un volume moderato battono un volume alto, perché gli altoparlanti del telefono distorcono vicino al massimo. Questa via non eguaglierà mai la trascrizione diretta del file.
Le tre vie non sono intercambiabili, e le differenze sono abbastanza grandi da decidere la questione per te:
| Via | Copertura linguistica | Ritardo tipico | Cosa limita l'accuratezza |
|---|---|---|---|
| Traccia sottotitoli della piattaforma, tradotta | 100+ sulle grandi piattaforme | Nessuno, è già testo | Gli errori dei sottotitoli della piattaforma stessa |
| Trascrizione del file | Varia a seconda del servizio | Più veloce del tempo reale | La qualità della registrazione originale |
| Da altoparlante a microfono, dal vivo | 60+ in OmniTalk, 9 nella Traduzione live di Apple | Da 1 a 3 secondi | Rumore ambientale, distorsione dell'altoparlante, voci sovrapposte |
Fonti: funzioni di OmniTalk e pagina Apple sulla disponibilità delle funzioni iOS, consultate il 12 agosto 2026. I dati sul ritardo sono strutturali, non misurati: l'audio deve essere pronunciato prima di poter essere sentito.
Problema 1: un file che hai già
Se l'audio è un file che puoi spostare, non usare la via del microfono. Trascrivere l'originale è più accurato, più veloce del tempo reale, e ti dà un file di testo che puoi modificare.
Ordine pratico:
- Controlla prima se esistono sottotitoli. I sottotitoli automatici di YouTube e la maggior parte delle piattaforme di streaming pubblicano una traccia che puoi tradurre direttamente. Leggere testo già pubblicato batte ricavarlo di nuovo dal suono.
- Se è una tua registrazione, gli strumenti di trascrizione gestiscono un file in una frazione della sua durata: un'intervista di 10 minuti di solito è pronta in meno di 1 minuto, e la maggior parte dei servizi traduce la trascrizione come secondo passo.
- Se è un messaggio vocale, alcune app di messaggistica ora trascrivono al loro interno. Controlla prima di ricorrere ad altro. I vocali di WhatsApp sono un caso a parte — li abbiamo trattati separatamente.
Il punto debole qui è la qualità dell'audio di partenza, non gli strumenti. Due persone che parlano una sopra l'altra sono difficili per ogni sistema, e nessuna app aggiusta una registrazione fatta con il microfono nella tasca di qualcuno.
Problema 2: qualcosa che suona in un'altra app
Questo è il caso per cui esiste la via del microfono, ed è quello comune: un video in un'app social, un podcast, un vocale, un servizio del telegiornale.
Come ottenere un buon risultato:
- Togli gli auricolari: il circuito è acustico e senza questo non può funzionare.
- Usa un volume moderato, non il massimo: la distorsione dell'altoparlante costa più accuratezza di quanta ne guadagnino i decibel in più.
- Appoggia il telefono su una superficie dura invece che morbida, oppure tienilo in mano. I cuscini assorbono la riflessione.
- Aspettati da 1 a 3 secondi di ritardo: l'audio deve essere pronunciato prima di poter essere sentito, quindi i sottotitoli seguono l'immagine in ritardo. È intrinseco, non un difetto.
- Riascolta tutto ciò che conta. Un secondo passaggio sugli stessi 30 secondi non ti costa che tempo, e recupera gran parte di ciò che un solo ascolto perde.
Cosa non può fare: separare in modo affidabile due voci sovrapposte, gestire musica cantata, o recuperare parole borbottate. Tutto ciò che il microfono davvero non riesce a sentire è perso.
Problema 3: una chiamata dal vivo
Le chiamate sono un caso a sé, perché entrambe le persone sono già al telefono e l'audio è bidirezionale.
La Traduzione live di Apple funziona sulle chiamate Telefono e FaceTime su hardware idoneo, che è una superficie davvero diversa dall'uso di persona, e non ha la limitazione unidirezionale della versione in presenza. Abbiamo raccolto requisiti e lingue nell'articolo sulla Traduzione live.
Per qualsiasi cosa fuori da Telefono e FaceTime torni alla via del microfono, con il problema aggiuntivo che una chiamata tenuta all'orecchio non è udibile dal microfono. Il vivavoce è l'unica via pratica, e vale la pena dirlo chiaramente: l'altra persona se ne accorge.
I sottotitoli sono di nuovo un problema a parte
Se il video ha sottotitoli impressi nell'immagine invece che una traccia sottotitoli, il testo fa parte dell'immagine. Leggerlo è riconoscimento ottico dei caratteri, non riconoscimento vocale, e fallisce in 3 casi in cui il riconoscimento vocale non fallisce mai: font stilizzati, testo su sfondi affollati, e sottotitoli che restano a schermo per meno di 1 secondo.
La mossa pratica è mettere in pausa sul fotogramma e usare la traduzione da fotocamera o da screenshot invece di provare a leggere testo in movimento. L'accuratezza su un fotogramma fermo è molto migliore che su uno in movimento.
Dove OmniTalk perde
Non possiamo importare un file. Traduci video o audio ascolta dal vivo. Se hai un file audio sul telefono e tempo a disposizione, un servizio di trascrizione ti darà un risultato migliore e più modificabile, e preferiamo dirtelo piuttosto che vederti combattere con la via del microfono.
Non possiamo battere i sottotitoli pubblicati. Quando una piattaforma pubblica già una traccia sottotitoli, tradurre quel testo è più accurato di qualsiasi cosa ricavata dal suono. Controlla se ci sono sottotitoli prima di aprire qualsiasi app, compresa la nostra.
Il circuito acustico ha un tetto di qualità. Tutto quanto detto sopra su volume, distanza e rumore ambientale vale per noi come per chiunque. Una trascrizione perfetta di un altoparlante di telefono in un bar rumoroso non la offre nessun fornitore.
È una funzione PRO. Traduci video o audio non è nel piano gratuito, come da nostra pagina delle funzioni. I sottotitoli integrati di Apple e le tracce sottotitoli delle piattaforme non costano nulla e sono il primo tentativo giusto.
Una lista rapida per decidere
- Il video ha i sottotitoli e li vuoi in un'altra lingua. Usa l'opzione di traduzione dei sottotitoli della piattaforma stessa.
- Possiedi il file e il risultato conta. Trascrivi il file, poi traduci la trascrizione.
- Sta suonando in un'altra app e lo vuoi adesso. Via del microfono, auricolari fuori.
- È una chiamata Telefono o FaceTime su hardware recente. Traduzione live di Apple, senza app.
- Sono sottotitoli impressi nell'immagine. Metti in pausa, poi traduci il fotogramma fermo con la fotocamera.
Domande frequenti
Perché la traduzione audio smette di funzionare quando metto gli AirPods?
Perché l'app sta ascoltando l'altoparlante del telefono attraverso il microfono. Gli auricolari deviano l'audio nelle tue orecchie, quindi il microfono non ha nulla da sentire.
Un'app può tradurre l'audio di un'altra app senza l'altoparlante?
Non su iOS, nel caso generale. Non esiste un tap dell'audio di sistema disponibile per le app, ed è proprio per questo che esiste la via del microfono.
Perché i sottotitoli restano indietro rispetto al video?
L'audio deve essere pronunciato prima di poter essere sentito e riconosciuto. Un secondo o due di ritardo sono strutturali.
Trascrivere un file è più accurato della via del microfono?
Sì, di solito con ampio margine. Il file è il segnale originale; la via del microfono è una ri-registrazione di un altoparlante in una stanza.
Funziona con la musica?
Male. Il riconoscimento vocale è addestrato sul parlato, e voci cantate sopra la strumentazione sono un problema diverso.
E un video con due persone che parlano contemporaneamente?
Aspettati che la trascrizione segua una voce e perda l'altra. La separazione affidabile delle voci non è un problema risolto in questo contesto.
Dati consultati il 12 agosto 2026. Il comportamento delle piattaforme e le funzioni delle app cambiano; il vincolo audio di iOS descritto qui regge da diverse versioni principali, ma verifica tutto ciò da cui dipende un acquisto.
👉 Scarica OmniTalk dall'App Store · Funzioni di OmniTalk · FAQ di supporto (in inglese)