Texte et outils du quotidien · Générateur de mots de passe
Les listes de mots EFF expliquées : listes longues, courtes et à préfixes uniques
· Contexte
mots de passe phrases secrètes listes de mots
Décrit les trois listes de mots publiées par l'Electronic Frontier Foundation dans 2016, les critères qui les sous-tendent - mémorisation, distinction, pas de mots prêtant à confusion ou offensants - et en quoi elles diffèrent de la liste originale des dés.
Pourquoi une liste de mots doit être conçue – qu'est-ce qui n'a pas fonctionné avec les listes contenant des mots obscurs, des quasi-doublons et des chaînes gênantes
Une liste de mots fait partie de l'espace de choix du générateur, son contenu exact et sa taille sont donc importants. ToolAcre fournit trois fichiers texte anglais en minuscules sous l'application de mot de passe et expose les enregistrements d'options correspondants. Les tests au moment de la construction comptent les lignes non vides et échouent si un fichier ne correspond plus à sa taille annoncée.
Le classeur ajoute un historique éditorial sur les mots obscurs, les quasi-doublons et les termes offensants. Ces affirmations nécessitent du matériel primaire EFF non inclus dans l’ensemble d’implémentation cité, donc cet article ne les répète pas de mémoire. Il se concentre sur les actifs engagés, les étiquettes, la provenance et les comportements que le référentiel peut vérifier.
Ce que ce référentiel vérifie sur les trois listes de mots expédiées
`eff-long.txt` contient exactement 7,776 entrées non vides et est sélectionné par défaut. La table d'options le décrit comme la longue liste EFF, associe une plage d'index de la taille de cinq dés à chaque mot et dérive environ 12.9 bits par tirage non filtré sous forme de log₂(7,776). Le test recalcule ce logarithme plutôt que de se fier au folklore.
Le navigateur récupère ce fichier à partir de la propre origine de la page lors du premier chargement. Le filtrage par longueur de mot minimale et maximale supprime les entrées inéligibles et les doublons dans l'ordre d'apparition avant la génération. Par conséquent, la taille totale du fichier ne correspond pas toujours à la taille actuelle du pool.
La longue liste est livrée avec exactement 7,776 entrées minuscules
`eff-short.txt` contient exactement 1,296 entrées. La description de son interface indique que les mots sont plus courts et plus rapides à saisir, et calcule environ 10.3 bits par tirage non filtré à partir de log₂(1,296). Un pool plus petit signifie que davantage de tirages de mots sont nécessaires pour atteindre le même nombre de choix calculé, mais cet article ne fixe aucun objectif universel.
La liste est chargée à la demande lorsqu'elle est sélectionnée et mise en cache comme promesse pour la page actuelle, évitant ainsi les téléchargements simultanés en double. Un chargement ayant échoué est expulsé afin qu'une autre sélection puisse réessayer. Les cas manquants, vides et de défaillance du réseau produisent des erreurs distinctes lisibles par l'homme.
La première liste restreinte est livrée avec exactement 1,296 entrées
`eff-special.txt` contient également exactement 1,296 entrées. ToolAcre l'appelle « EFF Préfixes courts et distincts » et déclare que les trois premières lettres identifient un mot et qu'aucun mot n'est le préfixe d'un autre. Le référentiel n'établit pas de manière indépendante une tolérance plus large aux fautes de frappe ou un historique de distance d'édition minimale, donc ces revendications générales ne sont pas développées ici.
Sa taille égale donne la même contribution log₂(1,296) non filtrée par tirage uniforme que l'autre liste restreinte. Le vocabulaire diffère et les tests du navigateur confirment que le changement de liste modifie le vocabulaire généré plutôt que de simplement changer une étiquette.
La liste restreinte des préfixes distincts est également livrée avec exactement 1,296 entrées
Les crédits et les enregistrements tiers indiquent que les colonnes de lancer de dés des listes EFF redistribuées ont été supprimées tandis que les mots et l'ordre sont restés inchangés. Ils enregistrent l'attribution et la provenance de la licence. Ils ne contiennent pas le processus complet d’examen humain, les ensembles de données de fréquence ou les critères de rejet impliqués dans le plan du classeur.
Cette limite de preuve est importante car l'historique de conception de la liste n'est pas nécessaire pour vérifier le comportement actuel du générateur. Les réviseurs peuvent inspecter chaque ligne validée, compter les entrées et suivre la sélection. Les allégations historiques doivent attendre une source EFF plutôt que d'être déduites d'un nom de fichier ou d'une description de produit.
Les revendications d'historique de sélection sont omises ; les fichiers engagés et leur provenance sont la preuve
La publication n'affaiblit pas la sélection uniforme de l'index car le secret de la liste n'est pas supposé. Le modèle d'entropie de ToolAcre traite les paramètres et le vocabulaire comme connus. La valeur inconnue est la nouvelle séquence d'indices sélectionnés via Web Crypto et l'échantillonnage de rejet. Un attaquant apprenant le fichier ne modifie pas rétroactivement le nombre d’index éligibles existants.
La publication d'une phrase générée particulière est différente : cela révèle la séquence sélectionnée elle-même. Par conséquent, les exemples doivent discuter des paramètres et des tailles de pool sans imprimer les informations d'identification que les lecteurs pourraient copier. N'utilisez jamais une phrase de la documentation comme secret de compte.
Ce que cela ne couvre pas : listes de mots dans d'autres langues et variantes gérées par la communauté
Seules ces trois listes anglaises sont expédiées. La page des limitations indique que d'autres langues n'ont pas été ajoutées car des éléments non vérifiés ou inadaptés compromettraient le calcul. Cet article n'étudie pas les variantes communautaires, les licences ou la qualité linguistique sans ces sources.
Les utilisateurs ayant besoin d'une autre langue doivent choisir des outils dont ils peuvent vérifier la liste, la provenance, la licence et la taille. La traduction de mots ad hoc modifie le pool et peut introduire des doublons ou des associations, de sorte que l'estimation originale ne décrira plus le nouveau processus.
Ce qu'il faut retenir : le générateur de mots de passe s'inspire des listes de mots EFF, de sorte que chaque mot est familier, distinct et tapable.
Choisissez la liste longue ou courte en fonction des propriétés validées et du format accepté de votre destination, puis inspectez le nombre d'éligibles après le filtrage. Le générateur calcule à partir des mots réellement chargés, de sorte qu'une plage plus étroite est reflétée plutôt que cachée derrière la taille du fichier annoncée.
Les faits durables sont trois atouts : des décomptes testés exacts, un chargement de même origine et une sélection uniforme. Les affirmations sur leur histoire culturelle, leur mémorisation universelle ou leur adéquation à chaque récit sont intentionnellement absentes. La liste est une entrée dans la génération, et non un gestionnaire ou une garantie de sécurité.