Simultanübersetzung, von Stimme zu Stimme, in Echtzeit
Simultanübersetzung mit künstlicher Intelligenz: jemand spricht und das Publikum hört es Sekunden später in seiner Sprache, als Stimme und nicht nur als Untertitel. Simultandolmetschen ohne Kabine, ohne Empfänger zu verteilen und ohne Installation.
Ein Saal, in dem das jede Woche passiert

Wer kein Spanisch spricht, öffnet einen Link auf dem Telefon, wählt eine Sprache und folgt der Feier. Über fünf Stunden am Stück, in einer der feindlichsten Akustiken überhaupt.
- Fünfzehn Sprachen
- Sie zahlen Gesprochenes, keine Stille
- Keine monatliche Gebühr
Für wen das ist
Eine Gemeinde, deren Sonntagsbesucher nicht mehr eine Sprache teilen. Ein Kongress, der sich keine Kabine und zwei Dolmetscher pro Sprache leisten kann. Eine Ratssitzung, der folgen können muss, wer letztes Jahr hergezogen ist. Überall dort, wo jemand zu einem Saal spricht und ein Teil des Saals es verpasst.
Wie es funktioniert
- 1
Der Ton des Saals erreicht uns. Ein kleines Gerät am Ambo schickt ihn über SRT, oder was Sie ohnehin zum Senden nutzen schickt ihn über RTMP.
- 2
Die Engine hört zu, entscheidet, was gesagt wird, und übersetzt es, während der Satz noch in der Luft hängt.
- 3
Eine synthetische Stimme spricht es in jeder Sprache, und das Publikum hört es über einen Link auf dem eigenen Telefon.
- 4
Sie sehen es in Ihrem Panel: welche Räume senden, wie lange schon und was das gekostet hat.
Was Sie bekommen
- Fünfzehn Sprachen gleichzeitig, aus derselben Aufnahme.
- Unter einer Sekunde vom Satzende bis zum Einsetzen der Stimme.
- Nichts zu installieren für die Zuhörer: ein Link oder ein QR-Code an der Wand.
- Ihre eigenen Räume, angelegt und pausiert aus dem Panel oder über die API.
- Nichts wird aufgezeichnet. Der Ton wird im Vorbeigehen übersetzt und nicht behalten.
- Zugangsdaten je Raum, damit ein verlorenes Gerät nicht die übrigen öffnet.
Gut zu wissen: Der Saal braucht ein brauchbares Mikrofon. Die Übersetzung kann nur so gut sein wie das, was sie hört, und ein Telefon hinten im Kirchenschiff nimmt das Kirchenschiff auf und nicht den Sprecher — den größten Unterschied in der Qualität macht das Mikrofon, nicht wir.
Was es kostet
2 Credits pro gesprochener Minute und Sprache
Bezahlt wird das Gesprochene, nicht die Dauer der Veranstaltung: eine Stunde mit zwanzig Minuten Stimme verbraucht zwanzig Minuten. Und alle Sprachen zählen, die gesprochene inklusive — ein Raum auf Spanisch, der auf Englisch, Französisch und Deutsch gehört wird, sind vier. Wenn Sie nur die Untertitel wollen, ohne die Stimme irgendwohin zu tragen, sind es 1,25 Credits pro gesprochener Minute, und die multiplizieren nicht mit den Sprachen.
Die Pakete ansehenFragen
- Braucht das Publikum eine App?
- Nein. Es öffnet einen Link im Browser, den es ohnehin hat, und wählt seine Sprache. Ein QR-Code am Eingang reicht meist.
- Wie groß ist die Verzögerung?
- Unter einer Sekunde ab dem Satzende. Es geht nicht Wort für Wort: die Engine wartet das Satzende ab, weil ein halber Satz übersetzt die falsche Hälfte ergibt.
- Wird etwas aufgezeichnet?
- Das Audio nie: es wird im Vorbeigehen übersetzt und nichts davon bleibt. Der Text nur, wenn du das Speichern einschaltest, und dann sind es fünfzehn Tage. Wenn du eine Aufnahme transkribiert haben willst, ist das ein anderer Dienst und du schickst uns die Datei.
- Was brauche ich im Saal?
- Ein Mikrofon, das den Sprecher hört, und einen Weg, uns den Ton zu schicken: das kleine Gerät über SRT, oder was Sie ohnehin zum Senden nutzen über RTMP.
- Und wenn das Internet ausfällt?
- Der Raum verbindet sich von selbst neu und macht weiter. Was während der Lücke gesagt wurde, ist verloren — daran führt kein Weg vorbei — aber niemand muss etwas neu starten.
Wo es eingesetzt wird
Dieselbe Engine in sehr verschiedenen Räumen. Jede dieser Seiten sagt, wie es dort aufgebaut wird, woher der Ton kommt und wo die eigene Grenze liegt.
Und womit es meist verglichen wird
Drei ehrliche Vergleiche, und in jedem steht, was die andere Möglichkeit besser kann.
Die Wörter, die es nur bei Ihnen gibt
Die eigenen Namen einer Organisation — Personen, Straßen, Referenzen, Funktionen — sind genau das, was ein allgemeines Modell nie gehört hat, und woran es scheitert: es ersetzt sie durch ein gewöhnliches Wort, das ähnlich klingt. Einmal aufschreiben, und sie scheitern nicht mehr. Sie werden im Raum eingetragen und gelten für alle seine Besprechungen.
- Es ist eine Liste, kein Training: aufgeschrieben, und ab dem ersten Satz wirkt sie.
- Sie sammelt nichts. Nicht Ihr Audio, nicht Ihren Text, keine Sekunde von irgendwas.
- Und sie ist inbegriffen. Kein Zusatztarif, keine Rechnungszeile.
Probieren Sie es an etwas Echtem
Der Willkommenstest reicht mehr als aus, um sich in den eigenen Raum zu setzen, mit dem eigenen Mikrofon, und zu hören, ob es Ihnen taugt.
LoslegenÜbersetzen ist freiwillig
Ein Raum kann übersetzen, untertiteln oder beides. Was nie passiert, ist dass derselbe Satz übersetzt und untertitelt wird: übersetzt wird er, wenn es jemanden gibt, für den zu übersetzen ist, und untertitelt, wenn nicht.
Untertiteln ohne Übersetzen kostet 1,25 Credits pro gesprochener Minute und multipliziert nicht mit den Sprachen, denn was man sieht, ist das Gesagte. Und es entscheidet sich Satz für Satz: schalten Sie die Übersetzung mittendrin ein, zählt das Vorherige weiter als Untertitel.
Untertitel sind in der Sitzung immer zu sehen, ob gespeichert wird oder nicht. Speichern ist etwas anderes und darüber entscheidet das Konto, nicht die Sitzung: was gesagt wird, wird fünfzehn Tage aufbewahrt und danach vernichtet.
Übersetzen
KOMMT MIT DEM TEXT
Text
SCHALTET SICH SELBST EIN
Stimme und Text, und am Ende das Protokoll.
Ohne Text kein Protokoll: der Raum wird nicht angelegt.
Übersetzen bringt den Text schon mit
Man kann nicht übersetzen, ohne vorher zu erkennen, was gesagt wird; ein Raum, der übersetzt, produziert den Text also bereits. Es ist kein eigenes Produkt: es kommt mit der Übersetzung.
Und man kann untertiteln, ohne zu übersetzen
Das ist die Ratssitzung, die ganz in einer Sprache stattfindet: es gibt niemanden, für den zu übersetzen wäre, und der Text wird trotzdem gebraucht. Und ebenso der Raum, der übersetzt und in dem heute alle gleich sprechen — mit beidem an untertitelt er, solange sie eine Sprache teilen, und geht von selbst zum Übersetzen über, sobald jemand anderes hereinkommt.
Was nicht geht, ist beides aus und trotzdem speichern
Ohne Text kein Protokoll, und es wird abgelehnt, statt einen Raum zu hinterlassen, der zu speichern behauptet und nichts speichert.
Außer übersetzen
Übersetzen ist, was passiert, während gesprochen wird. Dies ist, was drumherum passiert, und es geht von denselben Minuten ab: kein Extratarif, keine neue Rechnung.

Das Protokoll, zum Schluss
Ein Dokument mit dem, was entschieden wurde, wer welche Aufgabe übernimmt und in welcher Minute es gesagt wurde. Es geht beim Schließen des Raums in die Warteschlange und kommt per E-Mail.
Die Wörter Ihres Hauses
Die Namen, die es nur hier gibt: Personen, Straßen, Referenzen. Einmal aufgeschrieben, damit die Engine sie nicht mehr durch ähnlich klingende ersetzt.
Eine Schaltfläche, wenn etwas schiefgeht
Übersetzt die Maschine etwas, was sie nicht sollte, sagt ein Tippen es. Es funktioniert ohne Konto, und weder das Gespräch drumherum noch das Audio wird gesendet.