Video & Untertitel · Untertitel-Toolkit
Warum verirrte Tags in einer Untertiteldatei den Upload von Plattformuntertiteln beeinträchtigen können
· Warum es wichtig ist
Untertitel Textverarbeitung webvtt
Plattformen analysieren Untertitel-Uploads streng und oft stillschweigend. In diesem Beitrag werden die häufigsten Gründe erläutert, warum eine Untertiteldatei abgelehnt oder seltsam angezeigt wird, warum Formatierungs-Tags und -Codes die üblichen Übeltäter sind und wie eine saubere Standarddatei das Problem vermeidet.
Der Upload wurde akzeptiert und die Beschriftungen zeigen wörtliche Tags – das stille Scheitern einer unsauberen Datei
Das schlechteste Ergebnis ist keine Ablehnung. Ein abgelehnter Upload zeigt Ihnen bereits beim Betrachten des Formulars an, dass etwas nicht stimmt. Das gemeinsame Ergebnis ist Akzeptanz, gefolgt von Untertiteln, die den Zuschauern ihr eigenes Markup anzeigen, da es sich bei der Upload-Prüfung und dem Rendering-Pfad um unterschiedliche Softwareteile handelt, die unterschiedliche Fragen stellen.
Bei der Upload-Prüfung wird normalerweise gefragt, ob die Datei überhaupt in Cues geparst wird. Beim Rendern wird gefragt, was mit dem Inhalt jedes Hinweises geschehen soll, und ein Parser, der ein unbekanntes Tag ignoriert, zeichnet ihn als Text. Beide Schritte erfüllten ihren Zweck.
Was Plattformen tatsächlich akzeptieren – einfaches SRT und WebVTT mit vorhersehbarer Struktur und wenig Toleranz für Extras
Was Plattformen akzeptieren, ist enger gefasst als das, was Tools ausgeben. In der Praxis bedeutet das einfaches SRT oder WebVTT mit einer vorhersehbaren Form: durch Leerzeilen getrennte Blöcke, eine Timecode-Zeile, Textzeilen und wenig anderes. Die Toleranz für Extras ist gering und, was noch wichtiger ist, nicht dokumentiert. Daher kann man mit Sicherheit davon ausgehen, dass alles, was über diese Form hinausgeht, eher ein Risiko als ein Merkmal darstellt.
Das ist kein Selbstzweck. Eine Plattform, die willkürliches Markup akzeptiert, müsste entscheiden, wie sie es auf allen Web-, Mobil- und Fernseh-Clients einheitlich rendert, was eine viel größere Verpflichtung darstellt, als eine Untertiteldatei zu akzeptieren.
Die üblichen Übeltäter – HTML-ähnliche Tags, Codes im ASS-Stil, Stücklisten, gemischte Zeilenenden und leere Hinweise
Es gibt nur wenige wiederkehrende Schuldige. Spitze Klammer-Tags für Kursivschrift, Sprecherstimmen und Cue-Klassen überleben die Konvertierung aus Formaten, die sie unterstützen. Durch Klammern getrennte Überschreibungscodes stammen aus SubStation-Formaten und haben außerhalb dieser Formate keine Bedeutung. Eine Bytereihenfolgemarkierung am Anfang der Datei hängt sich an die erste Indexnummer an. Gemischte Zeilenenden aus der plattformübergreifenden Bearbeitung unterbrechen die Blockaufteilung. Hinweise, deren Text nach dem Entfernen des Markups leer wurde, bleiben als Leerzeichen mit Zeitstempel erhalten.
Nichts davon ist exotisch. Sie sind die normale Ausgabe einer Konvertierungskette, bei der jeder Schritt einzeln sinnvoll war, weshalb sie in Dateien erscheinen, die in einem Editor gut aussehen.
Warum eine Plattform toleriert, was eine andere ablehnt – unterschiedliche Parser hinter ähnlichen Upload-Formularen
Verschiedene Plattformen tolerieren unterschiedliche Teilmengen, und das macht die Fehlerdiagnose verwirrend. Dieselbe Datei kann auf einem Dienst sauber hochgeladen und korrekt gerendert werden, auf einem zweiten hochladen und Markup rendern und von einem dritten abgelehnt werden, ohne dass eine Fehlermeldung die eigentliche Ursache nennt. Die Datei hat sich zwischen den Versuchen nicht geändert; Drei Parser waren anderer Meinung.
Eine Plattform als Referenz zu betrachten, ist daher der falsche Instinkt. Eine Datei, die mit dem freizügigsten Dienst arbeitet, verrät Ihnen nichts über die anderen, und der strengste Parser ist derjenige, der definiert, ob eine Datei portierbar ist.
Arbeitsbeispiel: eine Datei, drei Uploads – wie derselbe Kram anders angezeigt wird und nach dem Bereinigen verschwindet
Nehmen Sie einen Export, der einen Top-of-Frame-Override-Code für sechzig Cues, Hervorhebungs-Tags für vierzig und eine Byte-Reihenfolgemarkierung enthält. Auf drei Dienste hochgeladen, könnte es überall akzeptiert werden. Beim ersten Mal werden die Tags berücksichtigt und der Überschreibungscode wird wörtlich gezeichnet. Im zweiten erscheinen beide als Text. Im dritten Teil steht die Markierung im ersten Stichwort, das einfach nie erscheint, und niemand bemerkt es, weil die Eröffnungszeile normalerweise ein Titel ist.
Bei der einmaligen Reinigung werden alle drei Klassen an der Quelle entfernt. Die spitzen Klammern-Tags und geschweiften Klammercodes werden ersetzt, der zurückbleibende Leerraum wird reduziert, durch das Entfernen geleerte Cues werden verworfen und nicht als zeitgestempelte Leerzeichen ausgegeben, und die Datei wird mit Cues neu geschrieben, die fortlaufend von eins an neu nummeriert werden. Die gleiche Ausgabe geht dann an alle drei Dienste.
Was dies nicht abdeckt – plattformspezifische Styleguides, Zeichenbeschränkungen pro Zeile und eingebrannte Beschriftungen
Dies betrifft die strukturelle Portabilität, nicht die redaktionelle Konformität. Plattform-Styleguides zu Zeilenlänge, maximale Zeichenanzahl, Positionierung von Lautsprecherbeschriftungen und Handhabung von Soundeffekten sind separate Anforderungen, die eine saubere Datei nicht automatisch erfüllt. Eine strukturell perfekte Untertiteldatei kann immer noch gegen einen Styleguide verstoßen.
Eingebrannte Untertitel sind ein völlig anderer Mechanismus. Der in die Videobilder gerenderte Text ist keine Untertiteldatei, kann nicht ausgeschaltet werden und bleibt von den hier beschriebenen Änderungen unberührt.
Fazit: Einmal bereinigen, überall hochladen – wie die Bereinigungs- und Konvertierungsfunktionen des Subtitle Toolkits eine plattformfreundliche Datei erzeugen
Einmal bereinigen und überall die gleiche Datei hochladen. Die Alternative, die einen separaten Export pro Plattform beibehält, vervielfacht die Anzahl der Dateien, die nicht mehr synchron mit dem Master sein können, und beseitigt bei keiner von ihnen die zugrunde liegende Unordnung.
Führen Sie die Bereinigung und Konvertierung gleichzeitig durch und lesen Sie dann die gemeldeten Probleme vor dem Hochladen und nicht danach. Die Probleme benennen Hinweise nach Nummer, was den Unterschied zwischen dem Wissen, dass eine Datei ein Problem hat, und dem Wissen, welche Zeile betrachtet werden muss, ausmacht.