Vídeo y subtítulos · Kit de herramientas de subtítulos
Por qué las etiquetas perdidas en un archivo de subtítulos pueden interrumpir la carga de subtítulos en la plataforma
· Por qué es importante
subtítulos procesamiento de textos webvtt
Las plataformas analizan las cargas de subtítulos de manera estricta y, a menudo, silenciosa. Esta publicación explica las razones comunes por las que un archivo de subtítulos se rechaza o se muestra de manera extraña, por qué las etiquetas y códigos de formato son los culpables habituales y cómo un archivo limpio y estándar evita el problema.
La carga fue aceptada y los subtítulos muestran etiquetas literales: la falla silenciosa de un archivo sucio
El peor resultado no es el rechazo. Una carga rechazada te indica que algo anda mal mientras todavía estás mirando el formulario. El resultado común es la aceptación seguida de subtítulos que muestran su propio marcado a los espectadores, porque la verificación de carga y la ruta de renderizado son piezas diferentes de software que plantean preguntas diferentes.
La verificación de carga generalmente pregunta si el archivo se analiza en señales. El renderizado pregunta qué hacer con el contenido de cada señal y un analizador que ignora una etiqueta desconocida lo dibuja como texto. Ambos pasos hicieron aquello para lo que fueron diseñados.
Qué plataformas realmente aceptan: SRT y WebVTT simples con estructura predecible y poca tolerancia a los extras
Lo que aceptan las plataformas es más limitado que lo que emiten las herramientas. En la práctica, eso significa SRT o WebVTT simple con una forma predecible: bloques separados por líneas en blanco, una línea de código de tiempo, líneas de texto y poco más. La tolerancia hacia los extras es baja y, lo que es más importante, no está documentada, por lo que se puede asumir con seguridad que cualquier cosa que vaya más allá de esa forma es un riesgo más que una característica.
Esto no es conservadurismo en sí mismo. Una plataforma que aceptara marcado arbitrario tendría que decidir cómo presentarlo de manera consistente en clientes web, móviles y de televisión, lo cual es un compromiso mucho mayor que aceptar un archivo de subtítulos.
Los culpables habituales: etiquetas tipo HTML, códigos estilo ASS, listas de materiales, finales de línea mixtos y señales en blanco
Los culpables recurrentes son pocos. Las etiquetas entre corchetes angulares para cursiva, voces de oradores y clases de indicaciones sobreviven a la conversión de formatos que las admiten. Los códigos de anulación delimitados por llaves provienen de formatos SubStation y no significan nada fuera de ellos. Una marca de orden de bytes al comienzo del archivo se adjunta al primer número de índice. Finales de línea mixtos provenientes de la división de bloques de interrupción de edición multiplataforma. Las señales cuyo texto quedó vacío después de que se eliminó el marcado permanecen como espacios en blanco con marca de tiempo.
Ninguno de estos es exótico. Son el resultado normal de una cadena de conversión en la que cada paso era individualmente razonable, razón por la cual aparecen en archivos que se ven bien en un editor.
Por qué una plataforma tolera lo que otra rechaza: diferentes analizadores detrás de formularios de carga similares
Diferentes plataformas toleran diferentes subconjuntos, y eso es lo que hace que el diagnóstico de la falla sea confuso. El mismo archivo puede cargarse limpiamente y procesarse correctamente en un servicio, cargarse y procesarse con marcas en un segundo y ser rechazado por un tercero, sin que aparezca ningún mensaje de error que mencione la causa real. El archivo no cambió entre intentos; Tres analizadores no estuvieron de acuerdo.
Tratar una plataforma como referencia es, por tanto, un instinto equivocado. Un archivo que funciona en el servicio más permisivo no dice nada sobre los demás, y el analizador más estricto es el que define si un archivo es portátil.
Ejemplo resuelto: un archivo, tres cargas: cómo el mismo desorden aparece de manera diferente y desaparece después de la limpieza
Tome una exportación que contenga un código de anulación de la parte superior del cuadro en sesenta señales, etiquetas de énfasis en cuarenta y una marca de orden de bytes. Subido a tres servicios, podría ser aceptado en todas partes. En el primero, se respetan las etiquetas y el código de anulación se dibuja literalmente. En el segundo, ambos aparecen como texto. En el tercero, la marca cuesta la primera señal, que simplemente nunca aparece y nadie se da cuenta porque la línea inicial suele ser un título.
Al limpiar una vez se eliminan las tres clases en el origen. Las etiquetas de corchetes angulares y los códigos de llaves se sustituyen, el espacio en blanco que queda se contrae, las pistas vaciadas por las eliminaciones se eliminan en lugar de emitirse como espacios en blanco con marca de tiempo, y el archivo se reescribe con pistas renumeradas de forma contigua a partir de una. Luego, el mismo resultado va a los tres servicios.
Lo que esto no cubre: guías de estilo específicas de la plataforma, límites de caracteres por línea y subtítulos grabados.
Esto cubre la portabilidad estructural, no la conformidad editorial. Las guías de estilo de la plataforma sobre longitud de línea, número máximo de caracteres, ubicación de las etiquetas de los oradores y manejo de efectos de sonido son requisitos separados que un archivo limpio no satisface automáticamente. Un archivo de subtítulos estructuralmente perfecto aún puede infringir una guía de estilo.
Los subtítulos grabados son un mecanismo completamente diferente. El texto representado en los fotogramas del vídeo no es un archivo de subtítulos, no se puede desactivar y no se ve afectado por nada de lo que se describe aquí.
Conclusión: limpie una vez, cargue en cualquier lugar: cómo las funciones de limpieza y conversión de Subtitle Toolkit producen un archivo compatible con la plataforma
Limpie una vez y cargue el mismo archivo en todas partes. La alternativa, mantener una exportación separada por plataforma, multiplica la cantidad de archivos que pueden desincronizarse con el maestro y no elimina el desorden subyacente de ninguno de ellos.
Ejecute la limpieza y la conversión juntas, luego lea los problemas informados antes de cargarlos y no después. Los problemas nombran las pistas por número, que es la diferencia entre saber que un archivo tiene un problema y saber qué línea mirar.