TranscribeNextTranscribeNext.com
BlogCome fare

Come trascrivere i memo vocali

🎧

Team di TranscribeNext

12 minuti di lettura
promemoria vocalipromemoria vocale in testoaudio in testotrascrizioneiPhoneMacIA

L’app Memo vocali di Apple può trascrivere direttamente le registrazioni su iPhone 12 o successivi con iOS 18 e sui Mac con Apple Silicon e macOS Sequoia. Se il dispositivo o la lingua non sono supportati, la funzione integrata non compare: in quel caso puoi condividere il memo come file e caricarlo su uno strumento di trascrizione.

Gratis

Questa guida illustra entrambi i percorsi e indica con chiarezza i requisiti del dispositivo. Include inoltre un vero memo vocale riproducibile, la sua trascrizione non modificata e un test misurabile: comprimere un memo prima del caricamento cambia il testo ottenuto?

Trascrizione dei memo vocali a colpo d'occhio

Integrato nell'iPhoneiPhone 12 o successivo, iOS 18
Integrato nel MacmacOS Sequoia e Apple Silicon: Mac Intel esclusi
Lingue integrateCirca dieci, e non in tutti i paesi o regioni
Se il dispositivo non è supportatoCondividi e carica il file: non ci sono requisiti hardware
Formato file promemoria vocale.m4a su iPhone; .m4a, .mp3, .amr o .3gp su Android
Prima è necessaria la conversioneNessuno - e la ricompressione fa male, vedi la prova
Utilizzo gratuitoPrimi 5 minuti senza account; 3 file/giorno a 50 MB con un account gratuito
Velocità0,13× in tempo reale misurato nel cloud rispetto a 0,3–5× pubblicato per Whisper locale

Ascolta un vero memo vocale e la sua trascrizione

Premi Riproduci. È una vera nota vocale — una persona che pensa ad alta voce, non un testo letto — e la trascrizione sotto il lettore è il risultato non modificato prodotto dalla nostra pipeline su questo stesso file. Fai clic su una riga per passare al punto corrispondente.

Hear a real voice memo and its transcript
Public-domain voice note · 0:51 · unedited transcript
0:00 / 0:50
Source: “Timelapse Excess” from David Blue’s Voice Notes library, published to the public domain (archive.org, Public Domain Mark; the author’s own repository carries an Unlicense public-domain dedication). We re-encoded it to mono 48 kbps for the web — the original carried a 4008×4008 cover image and was ten times larger. The transcript is the unedited output of our pipeline on this exact file. Line timings are measured; the word-level highlight is interpolated inside each line.

Questa clip è qui perché è *disordinata come lo sono i veri promemoria*. Il parlante apre con "Okay, allora...", si interrompe a metà discussione con "Voglio dire, sono sicuro che la stragrande maggioranza delle persone non usa questa funzione" e ripete una frase mentre ne trova la fine: "Che idea ridicola. Che cosa ridicola da includere nell'app della fotocamera."

Questo mostra con chiarezza cosa offre una trascrizione: il testo è fedele, punteggiato e ricercabile, ma non è ancora un insieme di appunti. Trasformarlo in note è un secondo passaggio.

I memo vocali vengono trascritti? I requisiti che nessuno stampa

Sì, ma "gli smartphone moderni gestiscono tutto questo automaticamente" non è vero, e questo divario colpisce molte persone. Questi i requisiti effettivi:

DispositivoRequisitoSe cadi fuori
iPhone/iPadiPhone 12 o successivi con iOS 18Nessuna trascrizione su iPhone 11 o versioni precedenti, qualunque sia iOS installato
MacmacOS Sequoia e Apple SiliconNessuna trascrizione sui Mac Intel, indipendentemente dalla versione di macOS
LinguaUna decina, incl. Inglese, spagnolo, francese, tedesco, portoghese, italiano, giapponese, coreano, cineseNessuna trascrizione in una lingua non supportata
RegioneApple precisa che la funzione non è disponibile in tutti i Paesi o in tutte le areeLa funzione può non comparire anche su hardware compatibile
AndroidNessun equivalente integratoDipende interamente dall'app del registratore

Il requisito del Mac è quello che sorprende di più e proviene direttamente dalla pagina di supporto di Apple: per la trascrizione servono macOS Sequoia e un Mac con Apple Silicon. Un Mac Intel con la versione più recente di macOS non mostra comunque la trascrizione. Non ci sono impostazioni da abilitare né problemi da risolvere: la funzione semplicemente non è disponibile.

Se non soddisfi uno di questi requisiti, passa al caricamento del file. Non richiede hardware specifico, funziona anche su Android e Windows e supporta molte più lingue.

Come ottenere una trascrizione nell'app Memo vocali

Su un dispositivo idoneo questo è il percorso più veloce, perché la registrazione è già dove deve essere:

1. Apri Memo vocali e seleziona la registrazione.

2. Tocca l'icona di trascrizione sotto la forma d'onda; su iPhone, scorri verso l'alto nell'area della forma d'onda per visualizzarla.

3. Leggi la trascrizione e copia il testo ovunque ti serva.

Prima di affidarti a questa funzione, considera due limiti. La trascrizione integrata offre solo testo: non ci sono timestamp navigabili, etichette dei parlanti né esportazioni in documenti o file di sottotitoli. Inoltre è tutto o niente: non puoi forzare una lingua diversa, quindi una registrazione in una lingua non supportata o con un cambio di lingua a metà può produrre soltanto un risultato parziale.

Per rileggere un breve promemoria, è sufficiente. Per un'intervista, una conferenza o qualsiasi cosa tu debba citare in base al tempo, non lo è.

Come convertire una registrazione che l'app non trascrive

Il caricamento elimina tutti i requisiti precedenti: non servono un modello minimo di dispositivo, una versione specifica di macOS o Apple Silicon, e sono disponibili 99 lingue anziché dieci.

1. Ottieni il file. In Memo Vocali, tocca la registrazione, premi il pulsante Condividi e salvala in File. Otterrai un `.m4a`. Su Android, esporta o condividi la registrazione dall'app: il file potrebbe essere `.m4a`, `.mp3`, `.amr` o `.3gp`.

2. Carica l'originale. Trascinalo nel modulo in cima alla pagina o nello strumento di caricamento completo. Non convertirlo prima: la sezione successiva mostra, con dati misurati, perché è meglio evitarlo.

3. Imposta la lingua se lo sai. Il rilevamento automatico va bene per un promemoria chiaro in una lingua comune; una lingua fissa è migliore per gli accenti, il rumore o una breve registrazione.

4. Rivedi ed esporta. Correggi nomi e numeri, quindi scarica il risultato in TXT, Markdown o JSON oppure, con un piano a pagamento, in DOCX, PDF, SRT o VTT.

Su AMR e 3GP: I registratori Android utilizzano questi codec da anni e diversi trascrittori online li rifiutano apertamente, dicendoti di convertire prima in MP3. Accettiamo `.amr`, `.amr-wb`, `.3gp` e `.3g2` direttamente, insieme ad altre 23 estensioni, quindi non è prevista alcuna fase di conversione.

Non ricomprimere mai prima un promemoria: abbiamo misurato il perché

Il consiglio comune di "convertire il promemoria in MP3 prima di caricarlo" non è solo inutile. Abbiamo testato quanto costa effettivamente.

Abbiamo preso la registrazione di 51 secondi della demo precedente e ne abbiamo prodotto tre versioni: l'originale a 320 kbps, una copia a 96 kbps e una a 48 kbps. Tutte e tre sono state elaborate con lo stesso motore e le stesse impostazioni.

Segmento320 kbps (originale)96 kbps48 kbps
9 segmenti su 12 sono risultati identici in tutti e tre
0:30…lascialo tu.…lascialo tu.…lascialo tu in qualche luogo.
0:33Quindi penso, non posso spostarlo...Quindi lo farò non posso spostarlo...Non posso spostarlo. Non posso usarlo...
0:38Questo è pazzo.Suo pazzo.Questo è pazzo.

Seguono tre cose, e solo la prima è ovvia.

La compressione non degrada una trascrizione in modo uniforme. Nonostante una differenza di bitrate di 6,7 volte, tre quarti della trascrizione erano identici carattere per carattere. Il risultato non peggiora uniformemente al diminuire della qualità.

Il danno si concentra dove già chi parlava non era chiaro. Tutti e tre i disaccordi rientrano in un periodo di otto secondi - da 0:30 a 0:38 - che è esattamente il momento in cui il parlante abbandona una frase e la ricomincia. Nient'altro nel promemoria si è mosso.

Ogni bitrate interpreta in modo diverso le esitazioni. La versione a 96 kbps ha prodotto "Quindi non posso spostarlo", una frase incoerente; quella a 48 kbps ha eliminato completamente la falsa partenza. La ricodifica non introduce un errore prevedibile: cambia arbitrariamente il risultato nei passaggi ambigui.

In sintesi: carica il file originale registrato dal telefono. Quando rivedi la trascrizione, presta particolare attenzione ai punti in cui sai di aver borbottato: sono quelli in cui le versioni non coincidevano e per i quali la tua memoria resta la fonte più affidabile.

Quanto tempo ci vuole: cloud vs tuo laptop

Entrambi i metodi funzionano, ma i tempi possono differire di un ordine di grandezza. Inoltre, chi consiglia l'elaborazione locale per motivi di privacy spesso trascura il costo in termini di tempo.

MetodoVelocitàMemo di 1 minutoMemo di 1 ora
La nostra pipeline cloud0,13× tempo reale (misurato)~8 secondi~8 minuti
Audacity + OpenVINO, modello base~0,3× tempo reale (dato pubblicato)~18 secondi~18 minuti
Audacity + OpenVINO, large-v3~3–5× in tempo reale (pubblicato)~3–5 minuti~3-5 ore

La cifra 0,13× è il tempo del motore misurato nella clip demo: 6,65 secondi per 51,12 secondi di audio. I moltiplicatori di Audacity sono quelli pubblicati dal progetto per le diverse dimensioni del modello del plugin. La colonna relativa a un'ora è un calcolo aritmetico basato su tali valori, non una misurazione: i file reali variano e il dato del cloud esclude il tempo di caricamento, che per un memo di un'ora tramite rete mobile può superare il tempo della trascrizione stessa.

In sintesi, la trascrizione locale è davvero gratuita e privata, ma con il modello più grande può richiedere diverse ore. Sceglila quando la riservatezza del contenuto lo richiede, non necessariamente come impostazione predefinita.

Trascrizione gratuita di promemoria offline

Se il promemoria è confidenziale – una conversazione con un cliente, una nota medica, una questione legale – l’argomento a favore dell’elaborazione locale non è il prezzo ma il fatto che l’audio non lascia mai la macchina.

Audacity è l'opzione gratuita. L'effetto OpenVINO Whisper esegue il modello Whisper di OpenAI interamente sul computer, su Windows, macOS e Linux, senza limiti di minuti, abbonamenti o filigrane. Offre cinque dimensioni del modello, da `base` a `large-v3`, oltre a una variante con diarizzazione dei parlanti e al supporto per le 99 lingue di Whisper. Il prezzo da pagare è il tempo: devi installare il plugin, scaricare un modello e attendere l'elaborazione indicata nella tabella.

TranscribeNext per Mac offre lo stesso risultato senza dover configurare più strumenti: trascina un memo nell'app per trascriverlo direttamente su un Mac con Apple Silicon, aggiungere le etichette dei parlanti ed esportarlo nel formato desiderato. Il cloud viene usato soltanto se lo scegli esplicitamente.

In ogni caso, il punto è lo stesso: se si tratta di una registrazione sensibile, non caricarla da nessuna parte, neanche qui.

Strumenti web gratuiti a confronto

Dati pubblicati da ciascun fornitore, controllati a luglio 2026. Cambiano; conferma prima di fare affidamento su di loro.

Piano gratuitoLimite per fileAMR/3GPDemo riproducibile
TranscribeNextPrimi 5 minuti, nessun account; 3 file al giorno con un account gratuito50 MB gratuiti · 2 GB Plus · 5 GB PremiumSì, direttoSì - in questa pagina
Happy ScribePrimi 10 minuti gratuitiOltre 45 formatiNon pubblicatoNo
AudioScribeFino a 5 minuti, senza registrazione100 MBDichiara di non supportare AMRNo
TalkNotes1 minuto, nessun account5 MBNon pubblicatoNo
NoteGPTPiano gratuito; elaborazione in batch di 20 file5 GB per fileNon pubblicatoNo
Audacity (offline)Illimitato, gratuitoNessunoDipende dai decoder della build installataNo

Due precisazioni. I 10 minuti gratuiti di Happy Scribe sono il limite più generoso tra gli strumenti nel browser. Il servizio dichiara una precisione "fino al 96% su audio chiaro", ma, come ogni dato pubblicato da un fornitore, è misurato sul suo audio e non è direttamente confrontabile con quello degli altri strumenti. Per questo la pagina include una clip verificabile e un test ripetibile.

Anche il nostro piano gratuito ha dei limiti: i 5 minuti sono un'anteprima, mentre l'esportazione in DOCX, PDF, SRT e VTT è disponibile nei piani a pagamento. Gli account gratuiti possono esportare in TXT, Markdown e JSON.

Trasformare un memo vocale in note reali

Una trascrizione non è ancora un insieme di appunti, e la demo mostra bene il perché: contiene false partenze, interiezioni e una frase ripetuta. Nessuno vuole rileggere tutto questo.

L'ordine affidabile è trascrivere, quindi strutturare — due passaggi, non uno:

1. Trascrivere il promemoria in modo che le parole esistano come testo ricercabile.

2. Riassumere il testo trasformandolo in decisioni, attività e domande aperte, con un riepilogo generato dall'IA o mediante una revisione manuale.

Farlo in quest'ordine è importante. Un riepilogo generato direttamente dall'audio nasconde quale passaggio non è riuscito quando il risultato è sbagliato: non puoi dire se hai capito male o frainteso. Con la trascrizione in mano puoi controllarne uno, poi l'altro.

Questa è anche la risposta più onesta alla promessa di “trasformare un memo vocale in appunti” con una sola funzione: gli strumenti che lo fanno eseguono in realtà due passaggi consecutivi. Sapendolo, puoi correggere la trascrizione prima che il riepilogo venga generato a partire da un testo sbagliato.

Dove la trascrizione dei promemoria va storta

I memo vocali falliscono diversamente dalle riunioni, perché di solito sei solo, vicino al microfono e pensi invece di presentare:

  • False partenze. Sono la principale causa di righe innaturali. Nel test del bitrate, ogni versione ha interpretato in modo diverso l’unica frase interrotta e ricominciata dal parlante.
  • Finali a voce bassa. I memo spesso terminano a metà di un pensiero, mentre la voce si affievolisce: è uno dei passaggi più difficili da riconoscere.
  • Nomi e numeri. Un numero di telefono o il nome di una persona dettato in un promemoria è la parte più preziosa e meno affidabile della trascrizione. Controllalo.
  • Registrazione in movimento. Camminare, guidare, vento: i promemoria vengono registrati dove le riunioni non lo sono.
  • Gergo e stenografia. Parli da solo con abbreviazioni che nessun motore ha sentito.
  • Lingue miste. Cambiare lingua a metà memo può confondere sia il rilevamento automatico sia un modello impostato su una lingua specifica.
  • Appunti molto brevi. Una nota di cinque secondi non fornisce al motore quasi nessun contesto con cui chiarire le ambiguità.
  • Nessuno di questi problemi viene risolto scegliendo uno strumento diverso. Vengono risolti rileggendo i passaggi in cui sai di non essere chiaro, che è un'abitudine di cinque secondi, non un flusso di lavoro.

    Metodologia e risultati del test

    Data della prova: 27 luglio 2026

    Clip sorgente: "Timelapse Excess", dalla libreria Voice Notes di David Blue: una vera nota vocale autoregistrata, pubblicata nel pubblico dominio (archive.org, Public Domain Mark; il repository dell'autore riporta una dedica di dominio pubblico Unlicense). 51,1 s, mono, originariamente 48 kHz a 320 kbps.

    File servito: ricodificato con ffmpeg in mono 24 kHz a 48 kbps (307 KB). L'originale era di 2,95 MB, la maggior parte era un'immagine di copertina incorporata 4008×4008. Il player qui sopra serve questo file e la trascrizione mostrata ne è la trascrizione.

    Prova di compressione: la stessa registrazione codificata a 320 kbps (originale), 96 kbps e 48 kbps, ciascuna trascritta con impostazioni identiche: Whisper large, lingua impostata su inglese, diarizzazione disattivata, profilo predefinito.

    Risultato: 9 segmenti su 12 identici per tutti e tre i bitrate. I 3 che differivano cadono tutti tra 0:30 e 0:38, il tratto in cui il parlante abbandona e ricomincia una frase. Ogni bitrate ha prodotto una lettura diversa di quel tratto.

    Velocità: 6,65 s di tempo del motore per 51,12 s di audio (≈0,13× tempo reale). Esclude il caricamento.

    Dati di confronto: Moltiplicatori OpenVINO Whisper pubblicati da Audacity, da ~0,3× in tempo reale (base) a ~3–5× (large-v3). La colonna oraria nella tabella della velocità è aritmetica sulle tariffe pubblicate, non sulla nostra misurazione.

    Trascrizione mostrata: output non modificato del motore. I tempi di inizio e fine di ogni riga sono misurati; l'evidenziazione parola per parola è interpolata all'interno della riga, perché il backend attuale restituisce timestamp per segmento e non per singola parola.

    È una singola clip, non un benchmark. La pubblichiamo affinché il risultato possa essere verificato e il test ripetuto.

    Ultimo testato: 27 luglio 2026

    FAQ

    I Memo Vocali trascrivono le registrazioni? Sì, sull'hardware supportato. L'app Memo vocali di Apple trascrive le registrazioni su iPhone 12 o versioni successive con iOS 18 e su un Mac con macOS Sequoia con Apple Silicon. La pagina di supporto di Apple afferma chiaramente i requisiti del Mac: la trascrizione richiede macOS Sequoia e un Mac con Apple Silicon e non è disponibile in tutti i paesi o regioni. La trascrizione è offerta in una decina di lingue, tra cui inglese, spagnolo, portoghese, italiano, francese, tedesco, giapponese, coreano e cinese.

    Puoi trascrivere un memo vocale su un vecchio iPhone o un Mac Intel? Non con la trascrizione integrata di Apple. Un iPhone 11 o versioni precedenti e qualsiasi Mac Intel non rientrano nei requisiti, indipendentemente dalla versione iOS o macOS installata. Su questi dispositivi, condividi il promemoria come file e caricalo su uno strumento di trascrizione in un browser, che non ha alcun requisito hardware.

    Come posso ottenere la trascrizione di un memo vocale? Su un dispositivo supportato, apri la registrazione in Memo vocali e tocca l'icona della trascrizione sotto la forma d'onda, quindi copia il testo. Su qualsiasi altro dispositivo, tocca il pulsante di condivisione sulla registrazione, salvala in File come .m4a e carica il file su uno strumento di trascrizione. Il percorso del browser fornisce anche timestamp e formati di esportazione che la trascrizione integrata non offre.

    Come posso convertire un memo vocale in testo su Android? Android non ha un unico equivalente integrato, quindi il metodo dipende dall'app del registratore. Esporta o condividi la registrazione come file (solitamente .m4a, .mp3, .amr o .3gp) e caricala su uno strumento di trascrizione. Vale la pena controllare AMR e 3GP prima di scegliere uno strumento: diversi trascrittori online li rifiutano e ti dicono di convertirli prima in MP3, il che aggiunge una ricodifica di cui non hai bisogno.

    Devo comprimere un memo vocale prima di caricarlo? No: carica l'originale. Abbiamo elaborato la stessa nota vocale di 51 secondi a tre bitrate: l'originale a 320 kbps, una copia a 96 kbps e una a 48 kbps. Nove dei dodici segmenti erano identici in tutte e tre le versioni. Le differenze si concentravano in un tratto di otto secondi in cui il parlante interrompe e ricomincia la frase. La compressione non peggiora uniformemente la trascrizione, ma può cambiare in modo imprevedibile proprio i passaggi già poco chiari.

    Quanto tempo occorre per trascrivere un memo vocale? La trascrizione sul cloud è una frazione della durata della registrazione; la trascrizione locale può essere molte volte la sua lunghezza. La nostra pipeline ha impiegato 6,65 secondi di tempo del motore per un promemoria di 51 secondi, circa 0,13 volte il tempo reale. Il plug-in OpenVINO Whisper di Audacity pubblica circa 0,3 volte in tempo reale per il suo modello base e 3-5 volte per large-v3, quindi un promemoria di un'ora equivale a minuti nel cloud e potenzialmente ore a livello locale sul modello più grande.

    Esiste un'app che trascrive i memo vocali? Su un iPhone supportato l'app Memo vocali stessa è l'app: non è necessaria alcuna installazione. Oltre a ciò, vale la pena installare un'app in due casi: quando vuoi che ogni registrazione venga trascritta automaticamente anziché una alla volta, e quando le registrazioni sono confidenziali e vuoi che siano trascritte sul dispositivo in modo che non venga caricato nulla. Per conversioni occasionali è sufficiente un browser.

    Come posso trasformare un memo vocale in appunti? Prima trascrivi il memo, poi struttura il testo. Una trascrizione grezza di qualcuno che pensa ad alta voce non è ancora un appunto: contiene false partenze, interiezioni e ripetizioni. Dopo la trascrizione, usa un riepilogo con l’IA per estrarre decisioni e attività oppure modifica il testo a mano. Trascrivere e riassumere sono due passaggi distinti; eseguirli in quest’ordine rende il risultato utilizzabile.

    Posso trascrivere memo vocali offline gratuitamente? Sì. Il plugin OpenVINO Whisper di Audacity esegue il modello Whisper di OpenAI interamente sul tuo computer, gratuitamente su Windows, Mac e Linux, senza limiti di minuti o abbonamenti, e l'audio non lascia mai la macchina. Il compromesso è tempo e configurazione: installi un plug-in, scarichi un modello e l'elaborazione richiede da 0,3× a 5× la durata della registrazione a seconda del modello scelto.

    Quali formati audio utilizzano i memo vocali? I memo vocali di Apple vengono salvati come .m4a. I registratori Android variano: .m4a, .mp3, .amr e .3gp sono tutti comuni. Nessuno di essi necessita di conversione prima della trascrizione: TranscribeNext accetta 27 estensioni audio e video tra cui .amr, .3gp e .3g2 direttamente, quindi puoi caricare qualunque cosa abbia prodotto il tuo telefono.

    Fonti

  • Apple: visualizzare la trascrizione di un memo vocale su Mac (requisiti di macOS Sequoia e Apple Silicon; “non disponibile in tutti i Paesi o in tutte le zone”) — verificato il 27 luglio 2026
  • Apple: visualizza una trascrizione di memo vocali su iPhone
  • Audacity – Trascrizione (plug-in OpenVINO Whisper, funzionamento offline, dimensioni del modello e moltiplicatori in tempo reale pubblicati, 99 lingue)
  • Happy Scribe, AudioScribe, TalkNotes, NoteGPT — limiti dei piani gratuiti, dimensioni massime dei file e formati supportati pubblicati sulle rispettive pagine dedicate ai memo vocali, verificati a luglio 2026
  • David Blue - Note vocali, la libreria di dominio pubblico da cui proviene il clip demo
  • Formati di caricamento accettati da TranscribeNext: elenco MIME usato dalla convalida effettiva del caricamento, non una pagina di marketing
  • Prezzi di TranscribeNext e limiti dei piani · Funzionalità · Informativa sulla privacy · TranscribeNext per Mac
  • Test audio e dati temporali: pipeline di produzione TranscribeNext, 27 luglio 2026 — cfr metodologia
  • Guide correlate: Messaggio vocale in testo · Come convertire M4A in testo · Come trascrivere l'audio in Word · Le migliori app Mac per trascrivere l'audio

    Trascrivi subito il tuo memo vocale

    Se il tuo iPhone è idoneo, la trascrizione è già nell'app Memo vocali: apri la registrazione e scorri verso l'alto. In caso contrario, condividi il promemoria come file e trascinalo nel modulo in alto in questa pagina: i primi 5 minuti sono gratuiti senza account. Per i promemoria che preferiresti non caricare, TranscribeNext per Mac li trascrive sul dispositivo.

    I memo vocali vengono salvati in formato M4A: la pagina sulla trascrizione M4A ne descrive le specifiche. Per muoverti più facilmente all'interno di una registrazione lunga, consulta la guida alla trascrizione con timestamp.

    Pronto a trascrivere il tuo audio?

    Prova TranscribeNext gratuitamente e sperimenta la trascrizione basata sull'intelligenza artificiale

    Inizia gratuitamente: non è richiesta la carta di credito

    © 2026 TranscribeNext.com. Tutti i diritti riservati.

    Come trascrivere i memo vocali: metodi integrati, online e offline a confronto | TranscribeNext