L’app Memo vocali di Apple può trascrivere direttamente le registrazioni su iPhone 12 o successivi con iOS 18 e sui Mac con Apple Silicon e macOS Sequoia. Se il dispositivo o la lingua non sono supportati, la funzione integrata non compare: in quel caso puoi condividere il memo come file e caricarlo su uno strumento di trascrizione.
Questa guida illustra entrambi i percorsi e indica con chiarezza i requisiti del dispositivo. Include inoltre un vero memo vocale riproducibile, la sua trascrizione non modificata e un test misurabile: comprimere un memo prima del caricamento cambia il testo ottenuto?
Trascrizione dei memo vocali a colpo d'occhio
| Integrato nell'iPhone | iPhone 12 o successivo, iOS 18 |
| Integrato nel Mac | macOS Sequoia e Apple Silicon: Mac Intel esclusi |
| Lingue integrate | Circa dieci, e non in tutti i paesi o regioni |
| Se il dispositivo non è supportato | Condividi e carica il file: non ci sono requisiti hardware |
| Formato file promemoria vocale | .m4a su iPhone; .m4a, .mp3, .amr o .3gp su Android |
| Prima è necessaria la conversione | Nessuno - e la ricompressione fa male, vedi la prova |
| Utilizzo gratuito | Primi 5 minuti senza account; 3 file/giorno a 50 MB con un account gratuito |
| Velocità | 0,13× in tempo reale misurato nel cloud rispetto a 0,3–5× pubblicato per Whisper locale |
- Ascolta un vero memo vocale e la sua trascrizione
- I memo vocali vengono trascritti? I requisiti
- Come ottenere una trascrizione nell'app Memo vocali
- Convertendo un promemoria l'app non lo trascriverà
- Non ricomprimere mai prima un promemoria: abbiamo misurato il perché
- Quanto tempo ci vuole: cloud vs tuo laptop
- Trascrizione gratuita di promemoria offline
- Strumenti web gratuiti a confronto
- Trasformare un promemoria in vere e proprie note
- Dove la trascrizione dei promemoria va storta
- Metodologia e risultati del test
- FAQ
- Fonti
Ascolta un vero memo vocale e la sua trascrizione
Premi Riproduci. È una vera nota vocale — una persona che pensa ad alta voce, non un testo letto — e la trascrizione sotto il lettore è il risultato non modificato prodotto dalla nostra pipeline su questo stesso file. Fai clic su una riga per passare al punto corrispondente.
Questa clip è qui perché è *disordinata come lo sono i veri promemoria*. Il parlante apre con "Okay, allora...", si interrompe a metà discussione con "Voglio dire, sono sicuro che la stragrande maggioranza delle persone non usa questa funzione" e ripete una frase mentre ne trova la fine: "Che idea ridicola. Che cosa ridicola da includere nell'app della fotocamera."
Questo mostra con chiarezza cosa offre una trascrizione: il testo è fedele, punteggiato e ricercabile, ma non è ancora un insieme di appunti. Trasformarlo in note è un secondo passaggio.
I memo vocali vengono trascritti? I requisiti che nessuno stampa
Sì, ma "gli smartphone moderni gestiscono tutto questo automaticamente" non è vero, e questo divario colpisce molte persone. Questi i requisiti effettivi:
| Dispositivo | Requisito | Se cadi fuori |
|---|---|---|
| iPhone/iPad | iPhone 12 o successivi con iOS 18 | Nessuna trascrizione su iPhone 11 o versioni precedenti, qualunque sia iOS installato |
| Mac | macOS Sequoia e Apple Silicon | Nessuna trascrizione sui Mac Intel, indipendentemente dalla versione di macOS |
| Lingua | Una decina, incl. Inglese, spagnolo, francese, tedesco, portoghese, italiano, giapponese, coreano, cinese | Nessuna trascrizione in una lingua non supportata |
| Regione | Apple precisa che la funzione non è disponibile in tutti i Paesi o in tutte le aree | La funzione può non comparire anche su hardware compatibile |
| Android | Nessun equivalente integrato | Dipende interamente dall'app del registratore |
Il requisito del Mac è quello che sorprende di più e proviene direttamente dalla pagina di supporto di Apple: per la trascrizione servono macOS Sequoia e un Mac con Apple Silicon. Un Mac Intel con la versione più recente di macOS non mostra comunque la trascrizione. Non ci sono impostazioni da abilitare né problemi da risolvere: la funzione semplicemente non è disponibile.
Se non soddisfi uno di questi requisiti, passa al caricamento del file. Non richiede hardware specifico, funziona anche su Android e Windows e supporta molte più lingue.
Come ottenere una trascrizione nell'app Memo vocali
Su un dispositivo idoneo questo è il percorso più veloce, perché la registrazione è già dove deve essere:
1. Apri Memo vocali e seleziona la registrazione.
2. Tocca l'icona di trascrizione sotto la forma d'onda; su iPhone, scorri verso l'alto nell'area della forma d'onda per visualizzarla.
3. Leggi la trascrizione e copia il testo ovunque ti serva.
Prima di affidarti a questa funzione, considera due limiti. La trascrizione integrata offre solo testo: non ci sono timestamp navigabili, etichette dei parlanti né esportazioni in documenti o file di sottotitoli. Inoltre è tutto o niente: non puoi forzare una lingua diversa, quindi una registrazione in una lingua non supportata o con un cambio di lingua a metà può produrre soltanto un risultato parziale.
Per rileggere un breve promemoria, è sufficiente. Per un'intervista, una conferenza o qualsiasi cosa tu debba citare in base al tempo, non lo è.
Come convertire una registrazione che l'app non trascrive
Il caricamento elimina tutti i requisiti precedenti: non servono un modello minimo di dispositivo, una versione specifica di macOS o Apple Silicon, e sono disponibili 99 lingue anziché dieci.
1. Ottieni il file. In Memo Vocali, tocca la registrazione, premi il pulsante Condividi e salvala in File. Otterrai un `.m4a`. Su Android, esporta o condividi la registrazione dall'app: il file potrebbe essere `.m4a`, `.mp3`, `.amr` o `.3gp`.
2. Carica l'originale. Trascinalo nel modulo in cima alla pagina o nello strumento di caricamento completo. Non convertirlo prima: la sezione successiva mostra, con dati misurati, perché è meglio evitarlo.
3. Imposta la lingua se lo sai. Il rilevamento automatico va bene per un promemoria chiaro in una lingua comune; una lingua fissa è migliore per gli accenti, il rumore o una breve registrazione.
4. Rivedi ed esporta. Correggi nomi e numeri, quindi scarica il risultato in TXT, Markdown o JSON oppure, con un piano a pagamento, in DOCX, PDF, SRT o VTT.
Su AMR e 3GP: I registratori Android utilizzano questi codec da anni e diversi trascrittori online li rifiutano apertamente, dicendoti di convertire prima in MP3. Accettiamo `.amr`, `.amr-wb`, `.3gp` e `.3g2` direttamente, insieme ad altre 23 estensioni, quindi non è prevista alcuna fase di conversione.
Non ricomprimere mai prima un promemoria: abbiamo misurato il perché
Il consiglio comune di "convertire il promemoria in MP3 prima di caricarlo" non è solo inutile. Abbiamo testato quanto costa effettivamente.
Abbiamo preso la registrazione di 51 secondi della demo precedente e ne abbiamo prodotto tre versioni: l'originale a 320 kbps, una copia a 96 kbps e una a 48 kbps. Tutte e tre sono state elaborate con lo stesso motore e le stesse impostazioni.
| Segmento | 320 kbps (originale) | 96 kbps | 48 kbps |
|---|---|---|---|
| 9 segmenti su 12 sono risultati identici in tutti e tre | |||
| 0:30 | …lascialo tu. | …lascialo tu. | …lascialo tu in qualche luogo. |
| 0:33 | Quindi penso, non posso spostarlo... | Quindi lo farò non posso spostarlo... | Non posso spostarlo. Non posso usarlo... |
| 0:38 | Questo è pazzo. | Suo pazzo. | Questo è pazzo. |
Seguono tre cose, e solo la prima è ovvia.
La compressione non degrada una trascrizione in modo uniforme. Nonostante una differenza di bitrate di 6,7 volte, tre quarti della trascrizione erano identici carattere per carattere. Il risultato non peggiora uniformemente al diminuire della qualità.
Il danno si concentra dove già chi parlava non era chiaro. Tutti e tre i disaccordi rientrano in un periodo di otto secondi - da 0:30 a 0:38 - che è esattamente il momento in cui il parlante abbandona una frase e la ricomincia. Nient'altro nel promemoria si è mosso.
Ogni bitrate interpreta in modo diverso le esitazioni. La versione a 96 kbps ha prodotto "Quindi non posso spostarlo", una frase incoerente; quella a 48 kbps ha eliminato completamente la falsa partenza. La ricodifica non introduce un errore prevedibile: cambia arbitrariamente il risultato nei passaggi ambigui.
In sintesi: carica il file originale registrato dal telefono. Quando rivedi la trascrizione, presta particolare attenzione ai punti in cui sai di aver borbottato: sono quelli in cui le versioni non coincidevano e per i quali la tua memoria resta la fonte più affidabile.
Quanto tempo ci vuole: cloud vs tuo laptop
Entrambi i metodi funzionano, ma i tempi possono differire di un ordine di grandezza. Inoltre, chi consiglia l'elaborazione locale per motivi di privacy spesso trascura il costo in termini di tempo.
| Metodo | Velocità | Memo di 1 minuto | Memo di 1 ora |
|---|---|---|---|
| La nostra pipeline cloud | 0,13× tempo reale (misurato) | ~8 secondi | ~8 minuti |
| Audacity + OpenVINO, modello base | ~0,3× tempo reale (dato pubblicato) | ~18 secondi | ~18 minuti |
| Audacity + OpenVINO, large-v3 | ~3–5× in tempo reale (pubblicato) | ~3–5 minuti | ~3-5 ore |
La cifra 0,13× è il tempo del motore misurato nella clip demo: 6,65 secondi per 51,12 secondi di audio. I moltiplicatori di Audacity sono quelli pubblicati dal progetto per le diverse dimensioni del modello del plugin. La colonna relativa a un'ora è un calcolo aritmetico basato su tali valori, non una misurazione: i file reali variano e il dato del cloud esclude il tempo di caricamento, che per un memo di un'ora tramite rete mobile può superare il tempo della trascrizione stessa.
In sintesi, la trascrizione locale è davvero gratuita e privata, ma con il modello più grande può richiedere diverse ore. Sceglila quando la riservatezza del contenuto lo richiede, non necessariamente come impostazione predefinita.
Trascrizione gratuita di promemoria offline
Se il promemoria è confidenziale – una conversazione con un cliente, una nota medica, una questione legale – l’argomento a favore dell’elaborazione locale non è il prezzo ma il fatto che l’audio non lascia mai la macchina.
Audacity è l'opzione gratuita. L'effetto OpenVINO Whisper esegue il modello Whisper di OpenAI interamente sul computer, su Windows, macOS e Linux, senza limiti di minuti, abbonamenti o filigrane. Offre cinque dimensioni del modello, da `base` a `large-v3`, oltre a una variante con diarizzazione dei parlanti e al supporto per le 99 lingue di Whisper. Il prezzo da pagare è il tempo: devi installare il plugin, scaricare un modello e attendere l'elaborazione indicata nella tabella.
TranscribeNext per Mac offre lo stesso risultato senza dover configurare più strumenti: trascina un memo nell'app per trascriverlo direttamente su un Mac con Apple Silicon, aggiungere le etichette dei parlanti ed esportarlo nel formato desiderato. Il cloud viene usato soltanto se lo scegli esplicitamente.
In ogni caso, il punto è lo stesso: se si tratta di una registrazione sensibile, non caricarla da nessuna parte, neanche qui.
Strumenti web gratuiti a confronto
Dati pubblicati da ciascun fornitore, controllati a luglio 2026. Cambiano; conferma prima di fare affidamento su di loro.
| Piano gratuito | Limite per file | AMR/3GP | Demo riproducibile | |
|---|---|---|---|---|
| TranscribeNext | Primi 5 minuti, nessun account; 3 file al giorno con un account gratuito | 50 MB gratuiti · 2 GB Plus · 5 GB Premium | Sì, diretto | Sì - in questa pagina |
| Happy Scribe | Primi 10 minuti gratuiti | Oltre 45 formati | Non pubblicato | No |
| AudioScribe | Fino a 5 minuti, senza registrazione | 100 MB | Dichiara di non supportare AMR | No |
| TalkNotes | 1 minuto, nessun account | 5 MB | Non pubblicato | No |
| NoteGPT | Piano gratuito; elaborazione in batch di 20 file | 5 GB per file | Non pubblicato | No |
| Audacity (offline) | Illimitato, gratuito | Nessuno | Dipende dai decoder della build installata | No |
Due precisazioni. I 10 minuti gratuiti di Happy Scribe sono il limite più generoso tra gli strumenti nel browser. Il servizio dichiara una precisione "fino al 96% su audio chiaro", ma, come ogni dato pubblicato da un fornitore, è misurato sul suo audio e non è direttamente confrontabile con quello degli altri strumenti. Per questo la pagina include una clip verificabile e un test ripetibile.
Anche il nostro piano gratuito ha dei limiti: i 5 minuti sono un'anteprima, mentre l'esportazione in DOCX, PDF, SRT e VTT è disponibile nei piani a pagamento. Gli account gratuiti possono esportare in TXT, Markdown e JSON.
Trasformare un memo vocale in note reali
Una trascrizione non è ancora un insieme di appunti, e la demo mostra bene il perché: contiene false partenze, interiezioni e una frase ripetuta. Nessuno vuole rileggere tutto questo.
L'ordine affidabile è trascrivere, quindi strutturare — due passaggi, non uno:
1. Trascrivere il promemoria in modo che le parole esistano come testo ricercabile.
2. Riassumere il testo trasformandolo in decisioni, attività e domande aperte, con un riepilogo generato dall'IA o mediante una revisione manuale.
Farlo in quest'ordine è importante. Un riepilogo generato direttamente dall'audio nasconde quale passaggio non è riuscito quando il risultato è sbagliato: non puoi dire se hai capito male o frainteso. Con la trascrizione in mano puoi controllarne uno, poi l'altro.
Questa è anche la risposta più onesta alla promessa di “trasformare un memo vocale in appunti” con una sola funzione: gli strumenti che lo fanno eseguono in realtà due passaggi consecutivi. Sapendolo, puoi correggere la trascrizione prima che il riepilogo venga generato a partire da un testo sbagliato.
Dove la trascrizione dei promemoria va storta
I memo vocali falliscono diversamente dalle riunioni, perché di solito sei solo, vicino al microfono e pensi invece di presentare:
Nessuno di questi problemi viene risolto scegliendo uno strumento diverso. Vengono risolti rileggendo i passaggi in cui sai di non essere chiaro, che è un'abitudine di cinque secondi, non un flusso di lavoro.
Metodologia e risultati del test
Data della prova: 27 luglio 2026
Clip sorgente: "Timelapse Excess", dalla libreria Voice Notes di David Blue: una vera nota vocale autoregistrata, pubblicata nel pubblico dominio (archive.org, Public Domain Mark; il repository dell'autore riporta una dedica di dominio pubblico Unlicense). 51,1 s, mono, originariamente 48 kHz a 320 kbps.
File servito: ricodificato con ffmpeg in mono 24 kHz a 48 kbps (307 KB). L'originale era di 2,95 MB, la maggior parte era un'immagine di copertina incorporata 4008×4008. Il player qui sopra serve questo file e la trascrizione mostrata ne è la trascrizione.
Prova di compressione: la stessa registrazione codificata a 320 kbps (originale), 96 kbps e 48 kbps, ciascuna trascritta con impostazioni identiche: Whisper large, lingua impostata su inglese, diarizzazione disattivata, profilo predefinito.
Risultato: 9 segmenti su 12 identici per tutti e tre i bitrate. I 3 che differivano cadono tutti tra 0:30 e 0:38, il tratto in cui il parlante abbandona e ricomincia una frase. Ogni bitrate ha prodotto una lettura diversa di quel tratto.
Velocità: 6,65 s di tempo del motore per 51,12 s di audio (≈0,13× tempo reale). Esclude il caricamento.
Dati di confronto: Moltiplicatori OpenVINO Whisper pubblicati da Audacity, da ~0,3× in tempo reale (base) a ~3–5× (large-v3). La colonna oraria nella tabella della velocità è aritmetica sulle tariffe pubblicate, non sulla nostra misurazione.
Trascrizione mostrata: output non modificato del motore. I tempi di inizio e fine di ogni riga sono misurati; l'evidenziazione parola per parola è interpolata all'interno della riga, perché il backend attuale restituisce timestamp per segmento e non per singola parola.
È una singola clip, non un benchmark. La pubblichiamo affinché il risultato possa essere verificato e il test ripetuto.
Ultimo testato: 27 luglio 2026
FAQ
I Memo Vocali trascrivono le registrazioni? Sì, sull'hardware supportato. L'app Memo vocali di Apple trascrive le registrazioni su iPhone 12 o versioni successive con iOS 18 e su un Mac con macOS Sequoia con Apple Silicon. La pagina di supporto di Apple afferma chiaramente i requisiti del Mac: la trascrizione richiede macOS Sequoia e un Mac con Apple Silicon e non è disponibile in tutti i paesi o regioni. La trascrizione è offerta in una decina di lingue, tra cui inglese, spagnolo, portoghese, italiano, francese, tedesco, giapponese, coreano e cinese.
Puoi trascrivere un memo vocale su un vecchio iPhone o un Mac Intel? Non con la trascrizione integrata di Apple. Un iPhone 11 o versioni precedenti e qualsiasi Mac Intel non rientrano nei requisiti, indipendentemente dalla versione iOS o macOS installata. Su questi dispositivi, condividi il promemoria come file e caricalo su uno strumento di trascrizione in un browser, che non ha alcun requisito hardware.
Come posso ottenere la trascrizione di un memo vocale? Su un dispositivo supportato, apri la registrazione in Memo vocali e tocca l'icona della trascrizione sotto la forma d'onda, quindi copia il testo. Su qualsiasi altro dispositivo, tocca il pulsante di condivisione sulla registrazione, salvala in File come .m4a e carica il file su uno strumento di trascrizione. Il percorso del browser fornisce anche timestamp e formati di esportazione che la trascrizione integrata non offre.
Come posso convertire un memo vocale in testo su Android? Android non ha un unico equivalente integrato, quindi il metodo dipende dall'app del registratore. Esporta o condividi la registrazione come file (solitamente .m4a, .mp3, .amr o .3gp) e caricala su uno strumento di trascrizione. Vale la pena controllare AMR e 3GP prima di scegliere uno strumento: diversi trascrittori online li rifiutano e ti dicono di convertirli prima in MP3, il che aggiunge una ricodifica di cui non hai bisogno.
Devo comprimere un memo vocale prima di caricarlo? No: carica l'originale. Abbiamo elaborato la stessa nota vocale di 51 secondi a tre bitrate: l'originale a 320 kbps, una copia a 96 kbps e una a 48 kbps. Nove dei dodici segmenti erano identici in tutte e tre le versioni. Le differenze si concentravano in un tratto di otto secondi in cui il parlante interrompe e ricomincia la frase. La compressione non peggiora uniformemente la trascrizione, ma può cambiare in modo imprevedibile proprio i passaggi già poco chiari.
Quanto tempo occorre per trascrivere un memo vocale? La trascrizione sul cloud è una frazione della durata della registrazione; la trascrizione locale può essere molte volte la sua lunghezza. La nostra pipeline ha impiegato 6,65 secondi di tempo del motore per un promemoria di 51 secondi, circa 0,13 volte il tempo reale. Il plug-in OpenVINO Whisper di Audacity pubblica circa 0,3 volte in tempo reale per il suo modello base e 3-5 volte per large-v3, quindi un promemoria di un'ora equivale a minuti nel cloud e potenzialmente ore a livello locale sul modello più grande.
Esiste un'app che trascrive i memo vocali? Su un iPhone supportato l'app Memo vocali stessa è l'app: non è necessaria alcuna installazione. Oltre a ciò, vale la pena installare un'app in due casi: quando vuoi che ogni registrazione venga trascritta automaticamente anziché una alla volta, e quando le registrazioni sono confidenziali e vuoi che siano trascritte sul dispositivo in modo che non venga caricato nulla. Per conversioni occasionali è sufficiente un browser.
Come posso trasformare un memo vocale in appunti? Prima trascrivi il memo, poi struttura il testo. Una trascrizione grezza di qualcuno che pensa ad alta voce non è ancora un appunto: contiene false partenze, interiezioni e ripetizioni. Dopo la trascrizione, usa un riepilogo con l’IA per estrarre decisioni e attività oppure modifica il testo a mano. Trascrivere e riassumere sono due passaggi distinti; eseguirli in quest’ordine rende il risultato utilizzabile.
Posso trascrivere memo vocali offline gratuitamente? Sì. Il plugin OpenVINO Whisper di Audacity esegue il modello Whisper di OpenAI interamente sul tuo computer, gratuitamente su Windows, Mac e Linux, senza limiti di minuti o abbonamenti, e l'audio non lascia mai la macchina. Il compromesso è tempo e configurazione: installi un plug-in, scarichi un modello e l'elaborazione richiede da 0,3× a 5× la durata della registrazione a seconda del modello scelto.
Quali formati audio utilizzano i memo vocali? I memo vocali di Apple vengono salvati come .m4a. I registratori Android variano: .m4a, .mp3, .amr e .3gp sono tutti comuni. Nessuno di essi necessita di conversione prima della trascrizione: TranscribeNext accetta 27 estensioni audio e video tra cui .amr, .3gp e .3g2 direttamente, quindi puoi caricare qualunque cosa abbia prodotto il tuo telefono.
Fonti
Guide correlate: Messaggio vocale in testo · Come convertire M4A in testo · Come trascrivere l'audio in Word · Le migliori app Mac per trascrivere l'audio
Trascrivi subito il tuo memo vocale
Se il tuo iPhone è idoneo, la trascrizione è già nell'app Memo vocali: apri la registrazione e scorri verso l'alto. In caso contrario, condividi il promemoria come file e trascinalo nel modulo in alto in questa pagina: i primi 5 minuti sono gratuiti senza account. Per i promemoria che preferiresti non caricare, TranscribeNext per Mac li trascrive sul dispositivo.
I memo vocali vengono salvati in formato M4A: la pagina sulla trascrizione M4A ne descrive le specifiche. Per muoverti più facilmente all'interno di una registrazione lunga, consulta la guida alla trascrizione con timestamp.