Savoir qui a dit quoi

L'enregistrement est séparé par voix, de sorte que chaque ligne de la transcription porte la personne qui l'a dite — et les sous-titres peuvent le porter aussi.

  • Quatorze langues
  • On paie la parole, pas le silence
  • Pas d'abonnement

Pour qui c'est

Une séance de conseil où il importe de savoir qui a proposé quoi. Une table ronde qui, sans cela, se lit comme un seul long paragraphe. Des entretiens où il faut distinguer la question de la réponse. Tout enregistrement à plusieurs personnes dont quelqu'un doit citer.

Comment ça marche

  1. 1

    Vous téléversez l'enregistrement et cochez que vous voulez les voix séparées.

  2. 2

    Avant de transcrire, le fichier entier est écouté à la recherche de voix — le fichier entier, car c'est ce qui fait que la voix de la minute 3 et celle de la minute 40 sont la même personne.

  3. 3

    Chaque passage de parole est rattaché à une voix, et les voix sont regroupées.

  4. 4

    La transcription revient avec un locuteur à chaque tour, et les sous-titres le portent aussi.

Ce que vous obtenez

  • Chaque tour étiqueté avec qui l'a prononcé.
  • Les mêmes étiquettes dans le texte, les sous-titres et le JSON.
  • Dans les sous-titres, une fois par tour et non sur chaque ligne.
  • Combien de voix distinctes ont été trouvées.
  • Cela travaille sur l'enregistrement entier, pas morceau par morceau.
  • Facturé une fois, quel que soit le nombre de langues demandées.

Pour être franc : Il a raison environ 85 % du temps sur un enregistrement correct, mesuré contre un corpus annoté. Deux voix semblables se confondent, et deux personnes qui parlent en même temps davantage. Prenez-le comme un très bon premier passage qui épargne la frappe, pas comme un procès-verbal.

Ce que ça coûte

+2 € l'heure de parole

En plus de la transcription ou de la traduction. Facturé une fois et non par langue : séparer les voix a lieu avant toute traduction et coûte pareil que la transcription sorte en une langue ou en quatorze.

Voir les tarifs

Questions

Connaît-il les noms des gens ?
Non. Il distingue les voix et les appelle Locuteur 1, Locuteur 2 et ainsi de suite, dans l'ordre où elles parlent la première fois. Leur donner des noms est un rechercher-remplacer que vous faites une fois.
Combien de voix supporte-t-il ?
Il est pensé pour de petits groupes — une table, une réunion, un entretien. Une salle de trente personnes qui se relaient n'est pas son objet.
Et si deux parlent en même temps ?
C'est là qu'il peine, et là où tout le monde peine. La parole superposée est la partie la plus difficile de ce problème et nous ne prétendons pas le contraire.
Cela retarde-t-il le travail ?
Cela ajoute un passage sur l'enregistrement entier avant que la transcription commence. Sur une réunion de dix-huit minutes, ce passage dure moins d'une minute.
Les sous-titres le portent-ils ?
Oui, quand il y a plus d'une voix. L'étiquette est sur le premier sous-titre de chaque tour et non sur chaque ligne, ce qui remplirait l'écran de ce qu'on sait déjà.

Essayez-le sur une réunion

Quelque chose avec trois ou quatre personnes. C'est là que se voit la différence entre un mur de texte et une transcription qui se lit.

Commencer