Pas de compte requis. Pas de limite quotidienne.D’autres vous proposent trois fichiers par jour et prétendent que c’est illimité. Ici, vous pouvez traiter des fichiers jusqu’à 60 minutes, aussi souvent que vous le souhaitez.
La transcription d’une conversation n’est qu’à moitié utile si l’on ne peut pas déterminer qui a dit quoi. ScribeGrab regroupe les voix qu’il entend et ajoute Interlocuteur 1, Interlocuteur 2 au début de chaque ligne – automatiquement, dans le texte et les sous-titres.
Obtenez une transcription simple et des sous-titres directement ici. Les étiquettes de locuteur, la censure sonore, la traduction, les sous-titres intégrés et les fichiers de plus de 90 Mo sont disponibles dans l’outil complet L’outil complet.
Transcrivez un fichier audio maintenant →On appelle aussi cela la diarisation : il ne s’agit pas de reconnaître qui est une personne, mais plutôt de remarquer que cette voix et cette autre voix appartiennent à deux personnes différentes, et d’indiquer où chacune d’elles prend la parole. Le résultat est un transcript que vous pouvez lire comme un scénario au lieu d’un bloc de texte indigeste.
Chaque segment de discours est transformé en une empreinte vocale (un « embedding » ECAPA-TDNN), et ces empreintes sont regroupées : les voix qui se ressemblent sont traitées comme appartenant à la même personne. Le groupe auquel appartient un segment détermine son étiquette, qui est ensuite inscrite dans les fichiers TXT, SRT et VTT.
Il fonctionne de manière autonome. Il n’y a pas de paramètres à configurer ni d’informations à lui fournir au préalable, y compris le nombre de personnes présentes dans la pièce.
Il ne peut pas connaître le nom de qui que ce soit. Il n’a jamais entendu votre voix auparavant, il dira donc « Locuteur 1 », et non « Sarah » : lisez la première phrase prononcée par chaque personne et remplacez les étiquettes dans votre éditeur de texte.
La transcription elle-même n’est pas affectée : si les voix ne peuvent pas être distinguées de manière fiable, vous obtenez simplement la transcription normale sans étiquettes.
Les étiquettes des intervenants sont générées à partir du même fichier que le reste, de sorte qu’un appel enregistré peut être restitué avec des étiquettes et des sous-titres, ainsi que les jurons supprimés si vous devez le partager. Voir également la transcription d’une interview et un enregistrement Zoom ou Teams.
Non. Si deux voix distinctes ou plus sont détectées, les étiquettes sont ajoutées automatiquement dans la transcription et dans les deux formats de sous-titres.
Non, aucun outil ne peut le faire sans que l’on lui indique au préalable qui est qui. Vous obtiendrez « Intervenant 1 », « Intervenant 2 », etc. ; repérez la première ligne de chaque intervenant et remplacez les étiquettes dans votre éditeur de texte.
De deux à huit. Au-delà, le regroupement des voix n’est pas assez fiable pour être affiché, il est donc préférable de ne pas afficher d’étiquettes plutôt que de faire une supposition erronée.
Soit il a entendu une seule voix, soit il a entendu plus de huit groupes, ce qui signifie que l’enregistrement était trop bruyant ou comportait trop de chevauchements pour permettre un regroupement précis. Le relevé lui-même reste complet.
Oui, comme tout le reste ici : pas d’inscription, pas de limite quotidienne, pas de filigrane et votre fichier est supprimé immédiatement après le traitement.