Deutsch

Video & Untertitel · Untertitel-Toolkit

WebVTT erklärt: von WebSRT zum W3C-Untertitelformat für HTML5-Videos

· Hintergrund

Untertitel webvtt Dateiformate Browser-Verarbeitung

Eine einfache Cue-Datei, die einen WebVTT-Header, Einstellungen und eine Browser-Track-Verbindung erhält
Original-ToolAcre-Vektorillustration

WebVTT wurde erstellt, damit Browser Untertitel nativ anzeigen können. Dieser Beitrag behandelt seine Ursprünge als WebSRT, wie es sich von SRT unterscheidet, was die Spezifikation hinzufügt und wo es heute verwendet wird.

Warum der Browser ein eigenes Untertitelformat benötigte – die Einführung nativer Videos und das Fehlen eines Standard-Trackformats

Natives Video verlieh einer Webseite ein Medienelement, aber zeitgesteuerter Text benötigte immer noch eine interoperable Dateidarstellung, die Browser abrufen und analysieren konnten. Eine informelle SRT-Datei reichte nicht für eine Browserfunktion aus, die eine definierte Syntax, ein definiertes Cue-Verhalten und Hooks für die Präsentation erforderte. WebVTT stellt diesen webseitigen Vertrag bereit und behält dabei die erkennbare Cue- und Zeitstempelform bei.

Dieser Browserkontext erklärt sowohl seine Vertrautheit als auch seine zusätzliche Struktur. Ein minimaler VTT ähnelt SRT, ist aber nicht SRT mit einer anderen Erweiterung. Die Signatur, die Zeichensetzung des Zeitstempels und die Cue-Grammatik sind Teil der Entscheidung, ob der Browser überhaupt WebVTT empfangen hat.

WebSRT und die Umbenennung in WebVTT – die frühe WHATWG-Arbeit und der Umzug zum W3C

Das Format wurde unter dem früheren Namen WebSRT diskutiert, bevor es zu WebVTT oder Web Video Text Tracks wurde. Diese Abstammung kommuniziert den Designpfad: Beginnen Sie mit einer allgemein verständlichen Untertitelblockform und definieren Sie dann das zusätzliche Verhalten, das von Webmedien benötigt wird. In diesem Artikel werden Datumsangaben, namentlich genannte Herausgeber und eine detaillierte Chronologie der Normungsgremien vermieden, da diese Fakten nicht durch die für die Implementierungsansprüche verwendeten Repository-Materialien überprüft werden.

Für einen Front-End-Entwickler besteht die dauerhafte Lektion darin, dass WebVTT eine spezifizierte Eingabe für Browser-Medienfunktionen und keine spielerspezifische Konvention ist. Die Implementierung sollte auf die aktuelle Syntax und den Test im verbrauchenden Player abzielen, anstatt von historischen Bezeichnungen abhängig zu sein.

Was die Spezifikation gegenüber SRT hinzufügt – den WEBVTT-Header, Cue-IDs, Cue-Einstellungen und Styling-Hooks

WebVTT fügt eine erforderliche WEBVTT-Signatur hinzu und lässt Cue-IDs zu, die nicht numerisch sein müssen. Cue-Einstellungen können der Endzeit folgen, um Ausrichtung und Platzierung auszudrücken, während NOTE-, STYLE- und REGION-Blöcke Metadaten und Präsentationsstrukturen bereitstellen, die über eine einfache SRT-Cue-Liste hinausgehen. Browser-Styling-Hooks können dann angezeigte Hinweise adressieren, ohne Text in das Video einzubrennen.

ToolAcre implementiert eine fokussierte Teilmenge. Es behält die nach dem Endzeitstempel gefundenen Einstellungen bei, löscht jedoch Cue-IDs und überspringt NOTE-, STYLE- und REGION-Blöcke beim Laden. Das reicht für eine normale Konvertierung aus und ist bewusst kein verlustfreier Editor für das vollständige WebVTT-Modell.

Der Punkt, der Header und UTF-8 – die kleinen Unterschiede, die verhindern, dass eine SRT-Datei eine gültige VTT-Datei ist

Drei kleine Details trennen ein minimales VTT von SRT. Die erste Zeile muss die WEBVTT-Signatur tragen, Zeitstempel verwenden einen Punkt vor Millisekunden und der Text muss UTF-8 sein. ToolAcre erkennt VTT durch Testen der Signatur und toleriert dabei eine optionale Bytereihenfolgemarkierung und führendes Leerzeichen; Text ohne diese Signatur ist standardmäßig SRT.

Der Serialisierer schreibt die Signatur und die Punktzeichensetzung, anstatt das beizubehalten, was die Quelle gerade verwendet hat. Die Dateieingabe wird als UTF-8 gelesen. Ein veraltet codierter SRT kann daher vor der Konvertierung Ersatzzeichen anzeigen und eine Änderung seiner Containersyntax kann bereits falsch dekodierte Bytes nicht wiederherstellen.

Wo WebVTT verwendet wird – das HTML5-Track-Element, HLS-Untertitel und viele Videoplattformen

WebVTT ist das Sidecar-Format, das dem HTML-Videospurelement zugeordnet ist und in Webbereitstellungssystemen angezeigt wird, die zeitgesteuerten Text verwenden. Einige Streaming- und Plattform-Workflows verwenden ebenfalls WebVTT, die Akzeptanzdetails gehören jedoch zum Ziel und sollten dort überprüft und nicht aus der Erweiterung abgeleitet werden. Eine gültige VTT-Datei kann immer noch mit dem falschen Medientyp bereitgestellt oder durch Cross-Origin-Übermittlungsregeln blockiert werden.

Das Toolkit erstellt eine Dateidarstellung; Es werden keine HTML-Seite, Server-Header oder ein Streaming-Manifest konfiguriert. Behandeln Sie die Konvertierung als eine Phase der Bereitstellung und testen Sie den tatsächlichen Player mit derselben URL, denselben Headern und derselben Ursprungsbeziehung, die die Zielgruppe verwenden wird.

Was dies nicht abdeckt – das vollständige Stil- und Regionsmodell, das die meisten Untertiteldateien nie verwenden

Das vollständige Stil- und Regionsmodell liegt außerhalb dieses Konverters. Komplexe Cue-Selektoren, Regionslayout und Präsentationsrichtlinien erfordern ein WebVTT-fähiges Autorentool und Browsertests. Der Parser überspringt STYLE- und REGION-Blöcke, sodass das Senden eines solchen Masters über diesen Pfad sie aus beiden Ausgaben entfernt, anstatt sie unsichtbar beizubehalten.

Das Tool überträgt auch eine Cue-Einstellung in die Ausgabe von SRT, obwohl für SRT kein Mechanismus definiert ist, um darauf zu reagieren. Dieses dokumentierte Limit ist ein Grund, den ursprünglichen VTT-Master beizubehalten, wenn die Platzierung wichtig ist, und kein Grund anzunehmen, dass jedes Ziel den zusätzlichen Text auf die gleiche Weise ignoriert.

Imbiss: ein echter Standard für das Web – wie das Subtitle Toolkit WebVTT erzeugt, das ihm folgt

WebVTT wandelt ein bekanntes zeitgesteuertes Textmuster in definierte Webeingaben um. Die Signatur identifiziert es, die Zeitstempelgrammatik ist kanonisch und das Cue-Modell kann mehr als nur einfachen sequentiellen Text enthalten. Subtitle Toolkit erzeugt die minimale kanonische Datei aus SRT, indem es die Zeiten in ganze Millisekunden analysiert und dann einen WEBVTT-Header, Punkttrennzeichen und Hinweise ohne Identifikatorzeilen schreibt.

Vergleichen Sie die Anzahl der Quell- und Ausgabe-Cues und lesen Sie alle Analyseprobleme, bevor Sie das Ergebnis einem Player zuordnen. Wenn die Quelle auf Kommentaren, Regionen, Stilblöcken oder Bezeichnern basiert, wählen Sie einen Workflow, der diese Funktionen beibehält. Ein fokussierter Konverter sollte diese Grenze angeben, anstatt vollständige Rundlauftreue zu implizieren.