Sprecher in einem Transkript kennzeichnen, Zeitstempel erhalten
Laden Sie Audio oder Video mit mehr als einem Sprecher hoch oder fügen Sie einen Link dazu ein, und ScreenApp liefert ein Transkript, das die Beiträge jedes Sprechers mit einem Zeitstempel kennzeichnet. Die Aufnahme muss nicht von Ihrem Gerät hochgeladen werden: Ein Link von Dropbox, Google Drive oder einem Podcast-Host funktioniert ebenfalls.
Ein gekennzeichnetes Transkript bedeutet, dass Sie finden können, was eine bestimmte Person gesagt hat, ohne die gesamte Aufnahme noch einmal anhören zu müssen.
Was Sie erhalten:
- Ein Transkript mit Sprecherkennzeichnungen und Zeitstempeln, in 100+ Sprachen
- Klicken Sie auf ein Sprecheretikett, um es umzubenennen, einem Teammitglied zuzuordnen oder ein einzelnes Segment neu zuzuweisen
- Export als PDF, DOCX, TXT, SRT und VTT
- Stellen Sie der KI Fragen zur Aufnahme und erhalten Sie Antworten, die auf den Zeitpunkt des Geschehens verweisen
- Kostenloser Plan: 2 Transkriptionen von Aufnahmen mit jeweils bis zu 45 Minuten, inklusive Sprecherkennzeichnungen
Das System ordnet Sprecher nach Stimme zu, nicht nach Gesichtern oder Namen, daher beginnt jede Aufnahme mit generischen Bezeichnungen (Sprecher 1, Sprecher 2), die Sie anschließend umbenennen können.
So identifizieren Sie Sprecher in Audio
- Hochladen oder Link einfügen: Ziehen Sie eine Datei herein (MP3, M4A, MP4A, M4B, AAC, WAV, OGG, OPUS, FLAC, AIFF, WMA, WEBMA, MKA, AC3, EAC3, WV, AMR, DSF, DFF, bis zu 2 GB im kostenlosen Online-Tool) oder fügen Sie einen Link von Dropbox, Google Drive oder einem Podcast-Host ein.
- Das Transkript trennt nach Sprechern: Jede Stimme erhält eine eigene Kennzeichnung, mit einem Zeitstempel bei jedem Beitrag.
- Umbenennen und exportieren: Klicken Sie auf ein Sprecheretikett, um es umzubenennen, einem Teammitglied zuzuordnen oder ein einzelnes Segment neu zuzuweisen. Exportieren Sie das fertige Transkript als PDF, DOCX, TXT, SRT und VTT.
Klares Audio mit deutlichen Stimmen lässt sich am besten trennen, und Überlappende Sprache kann das Diarisierungssystem verwirren, also vermeiden Sie, dass Sprecher sich gegenseitig ins Wort fallen, wenn Sie können. Sehen Sie, wie wir die Genauigkeit messen.
Sprecher-Diarisierung vs. andere Apps
| Funktion | ScreenApp | AssemblyAI | Otter.ai | Notta |
|---|---|---|---|---|
| Kostenloser Plan | 2 Transkriptionen, 45 Min | $50 in Credits | 300 Min/Monat, 30 Min/Gespräch | 120 Min/Monat, 3 Min/Gespräch |
| Sprecherkennzeichnungen | Inklusive | +0,02 $/Std. Add-on | Inklusive ab Basic Plan | Inbegriffen |
| Sprachen | 100+ | Nicht angegeben | 6 | 58 |
| Exportformate | PDF, DOCX, TXT, SRT und VTT | Nicht angegeben | mp3 und txt im kostenlosen Tarif, dazu pdf, docx und srt ab Pro, mit Massenexport ab Business | TXT, DOCX, PDF oder XLSX |
| Kostenpflichtiger Plan | $19/Monat jährlich | $0.15/Stunde | $8.33/Monat jährlich | $8.17/Monat jährlich |
Sources, checked 2026-09-16: screenapp.io/accuracy#languages, ScreenApp pricing, screenapp.io/help/how-many-minutes-can-i-record, assemblyai.com/pricing, otter.ai/pricing, notta.ai/en/pricing, notta.ai/en/lecture-summarizer
- vs. AssemblyAI: AssemblyAI ist eine Entwickler-API, die $0.15 pro Stunde Audio kostet, mit Sprecher-Diarisierung als +0,02 $/Std. Add-on und $50 kostenlosen Credits für ein neues Konto. ScreenApp ist eine fertige App: Laden Sie eine Datei hoch und erhalten Sie das gekennzeichnete Transkript zurück, keine Integration erforderlich.
- vs. Otter.ai: Otters kostenloser Plan umfasst 300 Minuten pro Monat, begrenzt auf 30 Minuten pro Gespräch, mit Sprecheridentifikation ab dem Basic Plan. ScreenApps kostenloser Plan umfasst 2 Transkriptionen von Aufnahmen mit jeweils bis zu 45 Minuten, mit Sprecherkennzeichnungen von Anfang an.
- vs. Notta: Nottas kostenloser Plan bietet 120 Minuten pro Monat in Clips von bis zu 3 Minuten, inklusive Sprecheridentifikation. Notta transkribiert 58 Sprachen; ScreenApp transkribiert 100+.
Wer nutzt Sprecher-Diarisierung
Podcaster laden die Roh-Episode hoch und erhalten ein nach Host und Gast aufgeteiltes Transkript, das bereit ist, in Shownotes oder eine Transkriptseite für die Episode eingefügt zu werden.
Besprechungs- und Interviewnotizen profitieren, wenn das Audio allein noch zeigt, wer was gesagt hat. Interviewer nutzen die Sprecheraufteilung, um ihre eigenen Fragen von den Antworten zu trennen, ohne noch einmal zuzuhören.
Forscher, die Fokusgruppen oder qualitative Interviews durchführen, verwenden konsistente Sprecherkennzeichnungen, um zu verfolgen, wer was beigetragen hat, anstatt Beiträge manuell zu kennzeichnen.
Juristen und medizinisches Fachpersonal benötigen sprechergekennzeichnete Transkripte von Zeugenaussagen, Kundenanrufen und Konsultationen, mit einem Zeitstempel für jeden Beitrag.


