Sprache wird zu maschinen-lesbarem Text.
Ein Sendetag im Archiv, vier Stunden Mandantengespräch, drei DVDs aus 1998 — Audio rein, durchsuchbarer Text raus. Mit Sprechererkennung, Fachvokabular und 96 % Wortgenauigkeit. Wir transkribieren in einer Woche, was händisch ein Jahr dauert.
- ✓ 96 % Wortgenauigkeit
- ✓ Sprecher-Erkennung
- ✓ 44 Audio-Formate
- ✓ Hosting in Deutschland
Wo Transkription Stunden zurückgibt.
Vom Sender-Archiv bis zur Anwaltskanzlei — drei Bereiche, in denen automatische Transkription Wochen an Handarbeit ersetzt.
- i.Sender-Archive
Bestände durchsuchbar machen
Jahrzehnte an Sendungen liegen als unbeschriftete Audio-Files. Wir transkribieren im Batch, mit Sprecher-Labels und Zeitstempeln — Recherche-Teams finden Zitate in Sekunden.
- verarbeitet/Quartal
- 12 000 h
- Wortgenauigkeit
- 96 %
- ii.Anwaltskanzleien
Mandanten-Gespräche & Diktate
Aufzeichnungen aus Mandanten-Gesprächen werden vertraulich transkribiert. Anwälte diktieren ins Smartphone, fertige Schriftsätze liegen 8 Min später vor.
- Tipp-Zeit
- −72 %
- DSGVO-Sondervertrag
- Anwaltskammer
- iii.Forschung
Qualitative Interviews
Sozialwissenschaft transkribiert hunderte Interviewstunden für Codierung. Wir liefern in MAXQDA-, Atlas.ti- und f4-kompatiblen Formaten.
- → 4 Min Transkript
- 1 h Audio
- Transkriptionskosten
- −95 %
Was im Detail stimmt.
Sechs Funktionen, die zwischen Rohtranskript und Arbeitsgrundlage liegen.
- 01
Sprecher-Erkennung
Stimm-basierte Diarisierung. Bei mehreren Aufnahmen erkennt das System wiederkehrende Stimmen — auch über Files hinweg.
- 02
Fachvokabular
Sie laden eigene Glossare hoch — medizinisch, juristisch, technisch. Fachbegriffe werden korrekt geschrieben (Aktenzeichen, Wirkstoffe, Bauteilnummern).
- 03
Zeitstempel
Pro Wort, pro Satz oder pro Sprecher-Wechsel. Direkter Sprung im Audio durch Klick auf den Text.
- 04
Export-Formate
DOCX, PDF, SRT, VTT, JSON, XLSX. Plus MAXQDA, Atlas.ti, f4-Formate für Forschung.
- 05
Editor-Workflow
Browser-Editor mit synchroner Audio-Wiedergabe, Tastatur-Shortcuts und Vier-Augen-Prinzip-Workflow.
- 06
Batch-API
REST-API mit Webhooks. Tausende Files parallel — wir skalieren auf, Sie zahlen nur die verbrauchten Stunden.
Aufnahmen bleiben in Deutschland.
In Ihre bestehenden Tools.
Transkripte landen dort, wo sie weiterverarbeitet werden.
DMS
- DOCUWAREAuto-Ablage
- SHAREPOINTBibliothek
- NEXTCLOUDWebDAV
- ELOPlug-in
Forschung
- MAXQDADirekter Import
- ATLAS.TIDirekter Import
- F4ANALYSENative
- NVIVOÜber XML
Untertitel
- FINAL CUTSRT/VTT-Export
- PREMIERESRT/VTT-Export
- DAVINCISRT/VTT-Export
- CAPTIONHUBWebhook
Schnitt
- DESCRIPTJSON-Format
- TRINTMigration
- OTTERMigration
- GENERISCHREST + Webhooks
Vergleich gängiger Transkriptions-Dienste.
| VIDEO.TAXI | Otter.ai | Trint | Rev.com | |
|---|---|---|---|---|
| Hosting | DE | US | UK/US | US |
| Wortgenauigkeit (DE) | 96 % | 88 % | 92 % | 94 % |
| Fachvokabular | ja | nein | begrenzt | nein |
| Anwaltskammer-konform | ja | nein | nein | nein |
Stand: April 2026 · Wortgenauigkeit gemessen auf TV-Nachrichten-Korpus.
Was Recherche- und Compliance-Teams fragen.
Schnell-Tarif: 1 Stunde Audio → ~12–15 Minuten Wartezeit. Echtzeit-Tarif: synchron zur Aufnahme. Bei Batch-Verarbeitung skalieren wir parallel — 100 Stunden in etwa 25 Minuten.
Lassen Sie uns kurz sprechen.
Erzählen Sie uns von Ihrem Material — Sendearchiv, Mandantengespräche oder Mediathek. Wir zeigen Ihnen, wie Transkription bei Ihnen aussehen kann — mit Verarbeitung und Hosting in Deutschland.
Sieben weitere Werkzeuge in derselben Plattform.
- 01TranslatorLive-Übersetzung für Online-Meetings→
- 02SPEECH EventsLive-Übersetzung für Events→
- 03SPEECH DialogPräsenz-Übersetzung mit Rückkanal→
- 04SummariesZusammenfassungen & Protokolle→
- 05Voice AI AgentsSprachassistenten am Telefon→
- 07Live-UntertitelungBarrierefreiheit nach EU AA→
- 08LivestreamingSendebetrieb für Behörden & Medien→