Español

Texto y herramientas cotidianas · Generador de contraseñas

Explicación de las listas de palabras EFF: listas largas, cortas y de prefijos únicos

· Antecedentes

contraseñas frases de contraseña listas de palabras

Tres columnas de lista de palabras con un conjunto grande y dos conjuntos verificados más pequeños
Ilustración de vector original de ToolAcre

Describe las tres listas de palabras que Electronic Frontier Foundation publicó en 2016, los criterios detrás de ellas (memorabilidad, distinción, sin palabras confusas u ofensivas) y en qué se diferencian de la lista original de dados.

Por qué es necesario diseñar una lista de palabras: qué salió mal con las listas que contienen palabras oscuras, casi duplicadas y cadenas incómodas

Una lista de palabras es parte del espacio de elección del generador, por lo que su contenido exacto y su tamaño son importantes. ToolAcre envía tres archivos de texto en inglés en minúsculas bajo la aplicación de contraseña y expone registros de opciones coincidentes. Las pruebas en tiempo de compilación cuentan las líneas que no están en blanco y fallan si un archivo ya no coincide con el tamaño anunciado.

El libro de trabajo agrega historial editorial sobre palabras oscuras, casi duplicados y términos ofensivos. Esas afirmaciones requieren material primario de la EFF que no está incluido en el conjunto de implementación citado, por lo que este artículo no las repite de memoria. Se centra en activos comprometidos, etiquetas, procedencia y comportamientos que el repositorio puede verificar.

Lo que este repositorio verifica sobre las tres listas de palabras enviadas

`eff-long.txt` contiene exactamente 7,776 entradas que no están en blanco y está seleccionado de forma predeterminada. La tabla de opciones la describe como la lista larga EFF, asocia un rango de índice del tamaño de cinco dados con cada palabra y deriva alrededor de 12.9 bits por extracción sin filtrar como log₂(7,776). La prueba vuelve a calcular ese logaritmo en lugar de confiar en el folklore.

El navegador recupera este archivo del origen de la página en la primera carga. El filtrado por longitud de palabra mínima y máxima elimina las entradas no elegibles y elimina los duplicados en el orden en que se ven por primera vez antes de la generación. En consecuencia, el tamaño completo del archivo no siempre es el tamaño del grupo actual.

La lista larga se envía con exactamente 7,776 entradas en minúscula

`eff-short.txt` contiene exactamente 1,296 entradas. La descripción de su interfaz dice que las palabras son más cortas y más rápidas de escribir, y calcula alrededor de 10.3 bits por extracción sin filtrar de log₂(1,296). Un grupo más pequeño significa que se requieren más sorteos de palabras para alcanzar el mismo recuento de opciones calculado, pero este artículo no establece un objetivo universal.

La lista se carga bajo demanda cuando se selecciona y se almacena en caché como una promesa para la página actual, lo que evita descargas simultáneas duplicadas. Una carga fallida se desaloja para que otra selección pueda volver a intentarlo. Los casos faltantes, vacíos y de falla de la red producen distintos errores legibles por humanos.

La primera lista corta se envía con exactamente 1,296 entradas

`eff-special.txt` también contiene exactamente 1,296 entradas. ToolAcre lo etiqueta como "EFF Prefijos cortos y distintos" y afirma que las primeras tres letras identifican una palabra y ninguna palabra es un prefijo de otra. El repositorio no establece de forma independiente un perdón de errores tipográficos más amplio o un historial de distancia mínima de edición, por lo que esas afirmaciones generales no se amplían aquí.

Su igual tamaño proporciona la misma contribución log₂(1,296) sin filtrar por sorteo uniforme que la otra lista corta. El vocabulario difiere y las pruebas del navegador confirman que al cambiar de lista se generan cambios en el vocabulario en lugar de simplemente cambiar una etiqueta.

La lista corta de prefijos distintos también se envía con exactamente 1,296 entradas

Los créditos y los registros de terceros dicen que a las listas EFF redistribuidas se les eliminaron las columnas de tirada de dados, mientras que las palabras y el orden permanecieron sin cambios. Registran la atribución y la procedencia de la licencia. No contienen el proceso completo de revisión humana, conjuntos de datos de frecuencia ni criterios de rechazo implícitos en el esquema del libro de trabajo.

Ese límite de evidencia es importante porque el historial de diseño de la lista no es necesario para verificar el comportamiento actual del generador. Los revisores pueden inspeccionar cada línea comprometida, contar las entradas y seguir la selección. Las afirmaciones históricas deben esperar a una fuente EFF en lugar de inferirse de un nombre de archivo o descripción de producto.

Se omiten las afirmaciones del historial de selección; Los archivos comprometidos y la procedencia son la evidencia.

La publicación no debilita la selección uniforme del índice porque no se asume el secreto de la lista. El modelo de entropía de ToolAcre trata la configuración y el vocabulario como si fueran conocidos. El valor desconocido es la nueva secuencia de índices seleccionados a través de Web Crypto y muestreo de rechazo. Un atacante que conozca el archivo no cambia retroactivamente cuántos índices elegibles existían.

Publicar una frase generada en particular es diferente: eso revela la secuencia seleccionada en sí. Por lo tanto, los ejemplos deben analizar la configuración y el tamaño del grupo sin imprimir las credenciales que los lectores puedan copiar. Nunca utilice una frase de la documentación como secreto de cuenta.

Lo que esto no cubre: listas de palabras en otros idiomas y variantes mantenidas por la comunidad

Solo se envían estas tres listas en inglés. La página de limitaciones dice que no se agregaron otros idiomas porque los activos no verificados o inadecuados socavarían el cálculo. Este artículo no analiza las variantes, licencias o calidad lingüística de la comunidad sin esas fuentes.

Los usuarios que necesiten otro idioma deben elegir herramientas cuya lista, procedencia, licencia y tamaño puedan verificar. La traducción de palabras ad hoc cambia el conjunto y puede introducir duplicados o asociaciones, por lo que la estimación original ya no describiría el nuevo proceso.

La conclusión: el generador de contraseñas se basa en las listas de palabras de EFF, por lo que cada palabra es familiar, distinta y se puede escribir

Elija la lista larga o corta según las propiedades comprometidas y el formato aceptado de su destino, luego inspeccione el recuento elegible después del filtrado. El generador calcula a partir de las palabras realmente cargadas, por lo que se refleja un rango más estrecho en lugar de ocultarse detrás del tamaño del archivo anunciado.

Los hechos duraderos son tres activos, recuentos exactos probados, carga del mismo origen y selección uniforme. Las afirmaciones sobre su historia cultural, su memorabilidad universal o su idoneidad para cada relato están intencionalmente ausentes. La lista es un insumo para la generación, no un administrador ni una garantía de seguridad.