Closed captions are time-synchronized text displays that transcribe the audio content of a video, including spoken dialogue, speaker identification, sound effects, and music cues. Unlike subtitles, which translate dialogue for viewers who can hear, closed captions assume the viewer cannot hear and provide a complete text representation of all meaningful audio. The term “closed” means viewers can toggle captions on or off — distinguishing them from “open captions,” which are permanently embedded in the video.
Closed captions break audio content into small chunks called “caption frames,” each synchronized with specific timestamps in the video. A typical Bildunterschriftenrahmen wird 3–7 Sekunden lang angezeigt – lang genug, um den Text bequem lesen zu können, aber kurz genug, um mit dem natürlichen Sprechtempo Schritt zu halten.
Jeder Bildunterschriftenrahmen enthält:
Captions are stored in separate files (SRT, VTT, or SCC formats) that video players read alongside the video. This separation is what makes them “closed” — the player can choose whether to display them based on viewer preference or accessibility settings.
Für eine professionelle Untertitelqualität ist Folgendes erforderlich: 99% Genauigkeit — das heißt, nicht mehr als ein Fehler pro hundert Wörter. Die automatische Spracherkennung allein erreicht in der Regel nur eine Genauigkeit von 80–95% und lässt nicht-sprachliche Elemente gänzlich außer Acht, weshalb eine Überprüfung durch Menschen für Untertitel, die den Compliance-Anforderungen entsprechen, nach wie vor unerlässlich ist.
Auch wenn die Begriffe „Untertitel“ und „Closed Captions“ oft synonym verwendet werden, dienen sie doch grundlegend unterschiedlichen Zwecken:
Geschlossene Untertitel:
Untertitel:
In the United States, this distinction carries legal significance for accessibility compliance. Content that requires “captions” under the ADA must include non-speech audio information — subtitles alone won’t satisfy the requirement.
A related term you’ll encounter is SDH (Untertitel für Gehörlose und Hörgeschädigte), bei denen die Formatierung der Untertitel mit dem Inhalt der Untertitel kombiniert wird – im Wesentlichen also Untertitel, die im Stil von Untertiteln angezeigt werden.
Der Unterschied liegt letztlich in der Kontrolle durch den Zuschauer:
Geschlossene Untertitel sind von der Videodatei getrennt. Zuschauer können sie ein- oder ausschalten, das Erscheinungsbild anpassen (auf unterstützten Plattformen) oder zwischen Untertitelspuren in verschiedenen Sprachen wechseln.
Offene Beschriftungen are burned directly into the video image. They’re always visible and can’t be turned off. This makes them useful for social media platforms that don’t support caption files, but removes viewer choice.
Für die meisten professionellen Anwendungen werden Untertitel bevorzugt, da sie Flexibilität bieten. Offene Untertitel gewährleisten jedoch die Sichtbarkeit beim Hochladen auf Plattformen mit uneinheitlicher Untertitelunterstützung oder beim Teilen von Videoclips, die außerhalb ihres ursprünglichen Players angesehen werden.
Mehrere Gesetze schreiben Untertitel für Videoinhalte vor. Gemäß einer neuen Vorschrift zu Titel II des Gesetz für Menschen mit Behinderungen, müssen Landes- und Kommunalbehörden sicherstellen, dass die Inhalte ihrer Websites und mobilen Apps barrierefrei sind; die Fristen für die Einhaltung der Vorschriften liegen bei 2026 und 2027. Abschnitt 508 gilt für Bundesbehörden. Das CVAA schreibt Untertitel für Online-Videos vor, die zuvor im Fernsehen ausgestrahlt wurden. Neu FCC-Vorschriften taking effect August 27, 2026 mandate “readily accessible” caption settings on all devices.
Die Nichteinhaltung hat konkrete Konsequenzen. Ein Unternehmen zahlte $3,3 Millionen, um Verstöße gegen das ADA im Zusammenhang mit Schulungsvideos ohne Untertitel beizulegen.
Über die Einhaltung gesetzlicher Vorschriften hinaus sorgen Untertitel für messbare geschäftliche Ergebnisse:
Here’s something that surprises many content creators: 80% of people who use captions don’t have hearing loss. They’re watching in noisy environments, learning a language, or simply prefer reading along. Among Gen Z and Millennials, 50% regelmäßig ansehen mit Untertiteln.
Captions aren’t just an accessibility accommodation anymore — they’re a mainstream viewing preference.
Sie haben mehrere Möglichkeiten, Untertitel zu erstellen:
Manuelle Transkription bietet die höchste Genauigkeit, kostet jedoch $150+ pro Stunde und benötigt das 4- bis 6-Fache der Echtzeit für die Bearbeitung. Dies ist nach wie vor erforderlich für Gerichtsverfahren, medizinische Inhalte oder Materialien, die eine zertifizierte Genauigkeit erfordern.
Automatisierte Transkription nutzt KI, um innerhalb weniger Minuten Untertitel zu einem Bruchteil der Kosten zu erstellen. Tools zur automatischen Untertitelung können erste Transkripte erstellen, die von Lektoren überarbeitet werden, und verbinden so Schnelligkeit mit Genauigkeit. Plattformen wie Sonix bieten Funktionen zur Sprecheridentifizierung, benutzerdefinierte Wörterbücher für Fachbegriffe sowie Exportoptionen für verschiedene Untertitelformate.
Hybride Arbeitsabläufe — automatisierte Transkription in Verbindung mit einer manuellen Überprüfung — hat sich zum Branchenstandard entwickelt, um Qualität, Geschwindigkeit und Kosten in Einklang zu bringen. Dieser Ansatz sorgt dafür, dass barrierefreie Videoinhalte für Unternehmen jeder Größe realisierbar.
Egal, für welche Methode Sie sich entscheiden: Planen Sie ein, Untertitel in mehreren Formaten zu exportieren. SRT-Dateien funktionieren fast überall, während VTT web-spezifische Formatierungen unterstützt. Wenn Sie beide Formate verwenden, ist die plattformübergreifende Kompatibilität gewährleistet.
CC (closed captions) includes sound effects, speaker labels, and music descriptions — everything you’d need if you couldn’t hear. Subtitles typically show only dialogue, often translated from another language. When accessibility is the goal, choose CC.
Nur wenn der Urheber eine Untertiteldatei bereitgestellt hat oder die Plattform eine generiert hat. Die meisten Streaming-Dienste bieten Untertitel an, doch bei von Nutzern hochgeladenen Inhalten in sozialen Medien fehlen diese oft, es sei denn, der Urheber hat sie manuell hinzugefügt.
Die beruflichen Standards verlangen eine Genauigkeit von 99% – maximal etwa ein Fehler pro hundert Wörter. Zur Einhaltung der Gesetze zur Barrierefreiheit müssen Untertitel zudem nicht-sprachliche Audioelemente berücksichtigen und korrekt synchronisiert sein.
Ja. Suchmaschinen indexieren Untertitel, wodurch Ihre Videoinhalte durchsuchbar werden. Videos mit Untertiteln erzielen deutlich mehr organischen Traffic als Videos ohne Untertitel.
Closed captions are stored separately from video, and each platform applies its own styling — fonts, colors, backgrounds, and positioning. Some platforms let viewers customize appearance; others don’t. This is normal and one reason creators sometimes choose open (burned-in) captions for consistent branding.
Umfassende Daten, die auf der Grundlage umfangreicher Untersuchungen zum Wachstum des Marktes für Podcast-Transkriptionen, zur Einführung von KI und zu Inhalten zusammengestellt wurden…
Wir haben die Audiodatei Yanny vs. Laurel durch die Sonix AI-Engine laufen lassen und hier ist...
Unter automatisierter Transkription versteht man den Vorgang, bei dem gesprochene Audio- oder Videoinhalte in geschriebenen Text umgewandelt werden…
Die Sprecher-Diarisierung ist ein KI-gestützter Prozess, der verschiedene Sprecher in Audioaufnahmen automatisch identifiziert und kennzeichnet…
Bei der Zoom-Transkription handelt es sich um den Vorgang, bei dem gesprochene Inhalte aus Zoom-Besprechungen in geschriebenen Text umgewandelt werden,…
Sonix hat den weltweit ersten AudioText Editor™ entwickelt, der nun nahtlos mit Adobe zusammenarbeitet…
Diese Website verwendet Cookies.