Sabe quién dijo qué

La grabación se separa por voces, de modo que cada línea de la transcripción lleva a quien la dijo — y los subtítulos también pueden llevarlo.

  • Catorce idiomas
  • Se paga el habla, no el silencio
  • Sin cuota mensual

Para quién es

Un pleno en el que importa quién propuso qué. Una mesa redonda que sin esto se lee como un párrafo interminable. Entrevistas donde hay que distinguir la pregunta de la respuesta. Cualquier grabación con más de una persona de la que alguien tenga que citar.

Cómo funciona

  1. 1

    Subes la grabación y marcas que quieres las voces separadas.

  2. 2

    Antes de transcribir se escucha el fichero entero buscando voces — entero, porque es lo que hace que la voz del minuto 3 y la del minuto 40 sean la misma persona.

  3. 3

    Cada tramo de habla se asigna a una voz, y las voces se agrupan.

  4. 4

    La transcripción vuelve con su locutor en cada intervención, y los subtítulos también lo llevan.

Qué te llevas

  • Cada intervención etiquetada con quién la dijo.
  • Las mismas etiquetas en el texto, en los subtítulos y en el JSON.
  • En subtítulos, la etiqueta una vez por intervención y no en cada línea.
  • Cuántas voces distintas se han encontrado.
  • Funciona sobre la grabación entera, no trozo a trozo.
  • Se cobra una vez, pidas los idiomas que pidas.

Dicho con franqueza: Acierta en torno al 85 % en una grabación decente, medido contra un corpus anotado. Dos personas con voces parecidas se confunden, y dos personas hablando a la vez se confunden más. Tómalo como un primer pase muy bueno que te ahorra teclear, no como un acta judicial.

Qué cuesta

+2 € por hora de habla

Sobre la transcripción o la traducción. Se cobra una vez y no por idioma: separar voces ocurre antes de traducir nada, así que cuesta lo mismo si la transcripción sale en un idioma o en catorce.

Ver precios

Preguntas

¿Sabe los nombres de la gente?
No. Distingue voces y las llama Locutor 1, Locutor 2 y así, por orden de aparición. Ponerles nombre es un buscar-y-reemplazar que haces una vez.
¿Cuántas voces aguanta?
Está pensado para grupos pequeños: una mesa, una reunión, una entrevista. Un salón con treinta personas turnándose no es para lo que sirve.
¿Y si dos hablan a la vez?
Ahí es donde falla, y donde falla todo el mundo. El habla solapada es la parte más difícil de este problema y no vamos a fingir lo contrario.
¿Retrasa el trabajo?
Añade una pasada sobre la grabación entera antes de empezar a transcribir. En una reunión de dieciocho minutos, esa pasada es menos de un minuto.
¿Lo llevan los subtítulos?
Sí, cuando hay más de una voz. La etiqueta va en el primer subtítulo de cada intervención y no en cada línea, que llenaría la pantalla de lo que ya se sabe.

Pruébalo con una reunión

Algo con tres o cuatro personas. Ahí es donde se nota la diferencia entre un muro de texto y una transcripción que se lee.

Empezar