La diarization audio identifie qui parle avec l'IA
La diarization audio est l'étape pipeline qui répond à la question « qui a dit quoi » en segmentant la parole par locuteur. Cette technologie sépare automatiquement plusieurs voix dans un enregistrement monophonique. L'IA applique des modèles d'embedding vocal pour discriminer et regrouper les locuteurs.
≈ 21s