Savoir qui a dit quoi
L'enregistrement est séparé par voix, de sorte que chaque ligne de la transcription porte la personne qui l'a dite — et les sous-titres peuvent le porter aussi.
- Quinze langues
- On paie la parole, pas le silence
- Pas d'abonnement
Pour qui c'est
Une séance de conseil où il importe de savoir qui a proposé quoi. Une table ronde qui, sans cela, se lit comme un seul long paragraphe. Des entretiens où il faut distinguer la question de la réponse. Tout enregistrement à plusieurs personnes dont quelqu'un doit citer.
Comment ça marche
- 1
Vous téléversez l'enregistrement et cochez que vous voulez les voix séparées.
- 2
Avant de transcrire, le fichier entier est écouté à la recherche de voix — le fichier entier, car c'est ce qui fait que la voix de la minute 3 et celle de la minute 40 sont la même personne.
- 3
Chaque passage de parole est rattaché à une voix, et les voix sont regroupées.
- 4
La transcription revient avec un locuteur à chaque tour, et les sous-titres le portent aussi.
Ce que vous obtenez
- Chaque tour étiqueté avec qui l'a prononcé.
- Les mêmes étiquettes dans le texte, les sous-titres et le JSON.
- Dans les sous-titres, une fois par tour et non sur chaque ligne.
- Combien de voix distinctes ont été trouvées.
- Cela travaille sur l'enregistrement entier, pas morceau par morceau.
- Facturé une fois, quel que soit le nombre de langues demandées.
Pour être franc : Sur un enregistrement propre, cela peut approcher 85 %, et c'est le meilleur cas, pas la norme : avec du bruit de fond ou des accents marqués, cela baisse, et nous ne pouvons pas vous dire de combien sans entendre votre enregistrement. Deux voix proches se confondent, et deux personnes qui parlent en même temps davantage. Prenez-le comme un très bon premier passage qui vous évite de taper, pas comme un procès-verbal judiciaire.
Ce que ça coûte
8 € par heure d'audio
Facturé une fois et non par langue : séparer les voix se fait avant toute traduction, donc cela coûte pareil que la transcription sorte dans une langue ou dans quinze.
Voir les tarifsQuestions
- Connaît-il les noms des gens ?
- Non. Il distingue les voix et les appelle Locuteur 1, Locuteur 2 et ainsi de suite, dans l'ordre où elles parlent la première fois. Leur donner des noms est un rechercher-remplacer que vous faites une fois.
- Combien de voix supporte-t-il ?
- Il est pensé pour de petits groupes — une table, une réunion, un entretien. Une salle de trente personnes qui se relaient n'est pas son objet.
- Et si deux parlent en même temps ?
- C'est là qu'il peine, et là où tout le monde peine. La parole superposée est la partie la plus difficile de ce problème et nous ne prétendons pas le contraire.
- Cela retarde-t-il le travail ?
- Cela ajoute un passage sur l'enregistrement entier avant que la transcription commence. Sur une réunion de dix-huit minutes, ce passage dure moins d'une minute.
- Les sous-titres le portent-ils ?
- Oui, quand il y a plus d'une voix. L'étiquette est sur le premier sous-titre de chaque tour et non sur chaque ligne, ce qui remplirait l'écran de ce qu'on sait déjà.
Le reste de ce qui se fait sur un fichier
Le même fichier, le même moteur et la même réserve de crédits. Presque personne n'a besoin d'une seule de ces choses : qui transcrit une session finit par vouloir savoir qui a parlé.
Essayez-le sur une réunion
Quelque chose avec trois ou quatre personnes. C'est là que se voit la différence entre un mur de texte et une transcription qui se lit.
Commencer