Diarización de hablantes explicada
Aprende cómo TranscribeNext identifica los distintos hablantes en tu audio y los etiqueta automáticamente.
La diarización de hablantes es una potente función de IA que identifica los distintos hablantes en tu audio y etiqueta cada sección con «Hablante 1», «Hablante 2», etc.
Consejo Plus
La diarización de hablantes está disponible en los planes Plus y Premium. Los usuarios Gratis pueden actualizarse para desbloquear esta función.
¿Qué es la diarización de hablantes?
La diarización de hablantes responde a la pregunta "¿quién habló cuándo?" analizando características de la voz como tono, timbre y patrones de habla.
En lugar de un único bloque continuo de texto, obtienes:
- Hablante 1: Hola, bienvenido al pódcast.
- Hablante 2: Gracias por invitarme.
- Hablante 1: Vamos directo al tema...
Cómo activar la diarización de hablantes
- 1Sube tu archivo de audio
- 2En los ajustes de subida, cambia a «Modo personalizado»
- 3Marca la casilla «Identificar diferentes hablantes»
- 4Elige el número de hablantes: detección automática o especificar (2-20)
- 5Haz clic en «Iniciar transcripción»

Detección automática frente a recuento manual
Detección automática (recomendada):
- La IA determina automáticamente el número de hablantes
- Funciona mejor en la mayoría de los casos
- Puede identificar de más o de menos en algunas ocasiones
Recuento manual (2-20 hablantes):
- Especifica exactamente cuántos hablantes hay
- Más preciso si conoce el número
- Mejor para formatos estructurados (entrevistas, mesas redondas)
Consejo Plus
Si no tienes claro qué opción elegir, usa la detección automática. Después podrás editar las etiquetas de hablante.
Cómo funciona la diarización
La IA analiza:
- Características de la voz — Tono, timbre y registro
- Patrones de habla — Ritmo, cadencia y pausas
- Características acústicas — Frecuencia y energía
Después agrupa los segmentos hablados por la misma persona y asigna etiquetas como «Hablante 1», «Hablante 2», etc.
Mejores resultados con la diarización
- Usa micrófonos individuales — Si es posible, graba a cada persona en su propio canal
- Evitad hablar a la vez — Las voces solapadas son difíciles de separar
- Mantén turnos claros — Las pausas ayudan a distinguir a cada hablante
- Conserva el audio original — La compresión fuerte puede borrar rasgos de la voz
- Evita el ruido de fondo — Interfiere con el análisis de las voces
Ver las etiquetas de hablante
Cuando termina la transcripción con diarización:
- 1Abre tu transcripción
- 2Ve a la pestaña «Transcripción»
- 3Verás etiquetas como «Hablante 1», «Hablante 2»
- 4Cada sección está coloreada por hablante
- 5Las marcas de tiempo muestran cuándo empezó a hablar cada uno

Exportar con etiquetas de hablante
Al exportar, las etiquetas de hablante se incluyen en todos los formatos:
- TXT - Texto plano con el prefijo "Hablante 1:"
- DOCX - Formato con nombres de hablante
- PDF - Maquetación profesional con identificación de hablantes
- SRT - Subtítulos con etiquetas de hablante (útil para vídeos)
Cuándo la diarización tiene dificultades
- Voces parecidas - Dos personas con voces muy similares pueden confundirse
- Habla superpuesta - Varios hablando a la vez es difícil de separar
- Mala calidad de audio - Ruido de fondo o grabación pobre
- Muchos hablantes - Más de 5-6 hablantes se vuelve difícil
- Turnos cortos - Conversaciones de ida y vuelta muy rápidas
Importante
La separación de hablantes se genera con IA y puede equivocarse. Revisa siempre las asignaciones en cualquier transcripción importante.
Casos de uso de la diarización
- Pódcasts y entrevistas - Consulta claramente quién dijo qué
- Actas de reuniones — Atribuye los comentarios a cada hablante
- Grupos focales - Sigue las respuestas de distintos participantes
- Declaraciones jurídicas — Identifica a cada participante y revisa la atribución
- Mesas redondas - Sigue a varios ponentes
- Llamadas con clientes — Separa al agente del cliente
Consejo Plus
Para obtener mejores resultados en reuniones, usa el bot de grabación, que puede asociar a los hablantes con los nombres de la reunión.
Etiquetas
Artículos relacionados
Transcripción con marcas de tiempo: salta a cualquier momento
Cada transcripción de TranscribeNext incluye marcas de tiempo por segmentos. Busca en el texto, salta al momento correspondiente y exporta los tiempos a TXT, SRT o JSON.
Formato de marca de tiempo SRT: hh:mm:ss,mmm explicado
La sintaxis exacta de las marcas de tiempo SubRip, hh:mm:ss,mmm --> hh:mm:ss,mmm, campo por campo: qué significa cada número, las reglas que rompen los reproductores, en qué se diferencia SRT de VTT y SBV, y cómo exportar SRT desde TranscribeNext.
Entender la precisión de la transcripción
Conoce qué afecta a la precisión de la transcripción y cómo obtener los mejores resultados de tus archivos de audio.
Buscar dentro de la transcripción
Encuentra rápidamente palabras, frases o temas específicos en tus transcripciones.
Herramientas relacionadas
- formatos de audio y vídeo admitidos — MP3, WAV, OGG, MP4, MPEG y nueve más, cada uno con sus límites y consejos.
- app de transcripción para Mac — graba y transcribe sin conexión con Whisper y Parakeet: gratis y sin que nada salga del equipo.