Eine Aufnahme mit mehreren Sprechern transkribieren und jeden einzelnen kennzeichnen lassen
Laden Sie eine Aufnahme mit mehreren Personen hoch oder fügen Sie einen Link ein, und ScreenApp wandelt sie in ein Transkript um, wobei jeder Sprecher gekennzeichnet und jede Zeile mit einem Zeitstempel versehen ist. Nehmen Sie das Gespräch live mit dem Browser-Recorder oder den iOS- und Android-Apps auf, oder verbinden Sie den Meeting-Bot für Zoom, Google Meet und Microsoft Teams für einen Anruf, und laden Sie die Datei dann hoch, wenn Sie eine haben.
Ein gekennzeichnetes Transkript ersetzt das erneute Anhören einer Aufnahme, um herauszufinden, wer was gesagt hat.
Was Sie erhalten:
- Ein Transkript mit Sprecheridentifikation, in 100+ Sprachen
- KI-Chat mit jeder Aufnahme, damit Sie fragen können, was ein bestimmter Sprecher gesagt hat, anstatt das gesamte Transkript zu durchsuchen
- KI-Notizen: Aktionspunkte mit einem Verantwortlichen und einer Frist sowie separat aufgelistete Entscheidungen
- Export als PDF, DOCX, TXT, SRT und VTT
- Kostenloser Plan: 2 Transkriptionen von Aufnahmen mit jeweils bis zu 45 Minuten, mit KI-Chat darauf
So transkribieren Sie mehrere Sprecher
- Hochladen oder Link einfügen: Ziehen Sie die Audio- oder Videodatei (MP4, M4V, MOV, AVI, WEBM, MKV, FLV, TS, MTS, M2TS, 3GP, 3GPP, 3G2, WMV, ASF, VOB, OGV, RM, RMVB, MPG, MPEG, M2V, F4V, MXF) hinein oder fügen Sie einen Link ein. Es ist keine Kontoerstellung erforderlich, um zu beginnen.
- Transkribieren lassen: Das Audio wird in Text umgewandelt und jede Person wird in ein eigenes Sprecherlabel aufgeteilt, mit einem Zeitstempel auf jedem Satz.
- Überprüfen und exportieren: Lesen Sie das Transkript im Browser, benennen Sie bei Bedarf ein Sprecherlabel um und exportieren Sie es als PDF, DOCX, TXT, SRT und VTT.
Die Genauigkeit hängt vom Audio und der gesprochenen Sprache ab. 25 der 100+ unterstützten Sprachen verfügen über eine Sprecherdiarisierung auf Wortebene; die restlichen transkribieren in Text ohne sprecherspezifische Labels. Ein einzelnes Mikrofon mit Teilnehmern in der Nähe und begrenztem Übersprechen sorgt ebenfalls für die klarste Trennung zwischen den Sprechern. Sehen Sie, wie wir die Genauigkeit messen.
Transkription mehrerer Sprecher vs. andere Apps
| Funktion | ScreenApp | Otter.ai | Rev | Sonix |
|---|---|---|---|---|
| Kostenloser Plan | 2 Transkriptionen, jeweils bis zu 45 Min | 300 Min/Monat | 45 Min/Monat (KI) | 30-Min-Testversion |
| Sprecheridentifikation | Inklusive | Basic | Inklusive | Inklusive |
| Sprecher umbenennen | Klicken Sie auf ein Sprecheretikett, um es umzubenennen, einem Teammitglied zuzuordnen oder ein einzelnes Segment neu zuzuweisen | Nicht angegeben | Nicht angegeben | Nicht angegeben |
| KI-Notizen | Inklusive | Pro, $8.33/Monat jährlich abgerechnet, oder $16.99 monatlich | Nicht angegeben | Nicht angegeben |
| Exportformate | PDF, DOCX, TXT, SRT und VTT | mp3 und txt im kostenlosen Tarif, dazu pdf, docx und srt ab Pro, mit Massenexport ab Business | Nicht angegeben | DOCX, PDF, TXT, SRT, VTT |
| Sprachen | 100+ | 6 | Nicht angegeben | 54+ |
| Kostenpflichtiger Plan | $19/Monat jährlich | $8.33/Monat jährlich | $25.49/Monat jährlich | $25/Monat |
Sources, checked 2026-10-01: screenapp.io/accuracy#languages, ScreenApp pricing, screenapp.io/help/how-many-minutes-can-i-record, otter.ai/pricing, rev.com/pricing, sonix.ai/pricing, Editing speaker labels
- vs. Otter.ai: Der kostenlose Plan von Otter begrenzt Sie auf 300 Minuten pro Monat, und die Sprecheridentifikation im kostenlosen Plan ist Basic. ScreenApp enthält Sprecherlabels in jedem Plan und ermöglicht es Ihnen, ein Label nachträglich umzubenennen.
- vs. Rev: Der kostenlose Tarif von Rev bietet 45 KI-Minuten pro Monat und berechnet dann $25.49/Monat (jährlich abgerechnet) pro Minute für ein KI-Transkript oder $1.99 pro Minute für ein menschliches Transkript. Eine wiederkehrende Reihe von Aufnahmen mit mehreren Sprechern summiert sich bei beiden Tarifen schnell.
- vs. Sonix: Sonix bietet eine einmalige 30-Minuten-Testversion, dann einen $25-Monatsplan. Der kostenlose Plan von ScreenApp wird erneuert, anstatt eine einmalige Testversion zu sein.
Wer nutzt die Transkription mehrerer Sprecher
Journalisten transkribieren Interviews und Podiumsdiskussionen mit mehreren Quellen und zitieren dann jeden Sprecher direkt mit einem Zeitstempel zur Faktenprüfung.
Podcast-Produzenten transkribieren Episoden mit einem Moderator und mehreren Gästen und teilen das Gespräch nach Sprechern auf, um Shownotes und Clips zu erstellen.
Forscher transkribieren Gruppeninterviews und Fokusgruppen und lesen dann das Transkript nach Sprechern, um zu sehen, wie jeder Teilnehmer geantwortet hat.
Personal- und HR-Teams transkribieren Panel-Interviews mit mehreren Interviewern und einem Kandidaten, damit jeder, der die Datei später überprüft, sehen kann, wer was gefragt hat.
Rechts- und Compliance-Teams transkribieren Vernehmungen, Mehrparteienanrufe und aufgezeichnete Aussagen, bei denen es wichtig ist zu wissen, welche Person welche Zeile gesagt hat.
Dokumentar- und Videoteams transkribieren Interviewmaterial mit mehr als einem Thema und verwenden die Sprecherlabels, um zu protokollieren, wer zu welchem Zeitpunkt vor der Kamera ist.


