Português (Brasil)

Ferramentas de texto e do dia a dia · Gerador de senhas

As listas de palavras EFF explicadas: listas longas, curtas e com prefixos exclusivos

· Fundo

senhas senhas listas de palavras

Três colunas de lista de palavras com um conjunto grande e dois conjuntos verificados menores
Ilustração vetorial original ToolAcre

Descreve as três listas de palavras que a Electronic Frontier Foundation publicou em 2016, os critérios por trás delas — memorabilidade, distinção, sem palavras confusas ou ofensivas — e como elas diferem da lista original de diceware.

Por que uma lista de palavras precisa ser projetada – o que deu errado com listas contendo palavras obscuras, quase duplicadas e strings estranhas

Uma lista de palavras faz parte do espaço de escolha do gerador, portanto, seu conteúdo e tamanho exatos são importantes. ToolAcre envia três arquivos de texto em inglês em letras minúsculas no aplicativo de senha e expõe registros de opções correspondentes. Os testes em tempo de construção contam linhas não vazias e falham se um arquivo não corresponder mais ao tamanho anunciado.

A apostila adiciona histórico editorial sobre palavras obscuras, quase duplicatas e termos ofensivos. Essas afirmações requerem EFF material primário não incluído no conjunto de implementação citado, portanto, este artigo não as repete de memória. Ele se concentra nos ativos comprometidos, nos rótulos, na procedência e nos comportamentos que o repositório pode verificar.

O que este repositório verifica sobre as três listas de palavras enviadas

`eff-long.txt` contém exatamente 7,776 entradas não vazias e é selecionado por padrão. A tabela de opções a descreve como a longa lista EFF, associa um intervalo de índice do tamanho de cinco dados a cada palavra e deriva cerca de 12.9 bits por sorteio não filtrado como log₂(7,776). O teste recalcula esse logaritmo em vez de confiar no folclore.

O navegador busca esse arquivo na própria origem da página no primeiro carregamento. A filtragem por comprimento mínimo e máximo de palavras remove entradas inelegíveis e desduplica na ordem vista pela primeira vez antes da geração. Conseqüentemente, o tamanho total do arquivo nem sempre é o tamanho atual do pool.

A longa lista vem exatamente com 7,776 entradas em minúsculas

`eff-short.txt` contém exatamente 1,296 entradas. A descrição da interface diz que as palavras são mais curtas e rápidas de digitar e calcula cerca de 10.3 bits por extração não filtrada de log₂(1,296). Um pool menor significa que mais sorteios de palavras são necessários para atingir a mesma contagem de escolhas calculadas, mas este artigo não define uma meta universal.

A lista é carregada sob demanda quando selecionada e armazenada em cache como uma promessa para a página atual, evitando downloads simultâneos duplicados. Um carregamento com falha é removido para que outra seleção possa tentar novamente. Casos ausentes, vazios e de falha de rede produzem erros distintos legíveis por humanos.

A primeira lista curta vem com exatamente 1,296 entradas

`eff-special.txt` também contém exatamente 1,296 entradas. ToolAcre rotula-o como “EFF Prefixos curtos e distintos” e afirma que as três primeiras letras identificam uma palavra e nenhuma palavra é prefixo de outra. O repositório não estabelece de forma independente um histórico mais amplo de perdão de erros de digitação ou distância mínima de edição, portanto, essas reivindicações gerais não são expandidas aqui.

Seu tamanho igual fornece a mesma contribuição log₂(1,296) não filtrada por sorteio uniforme que a outra lista curta. O vocabulário é diferente e os testes do navegador confirmam que a troca de listas altera o vocabulário gerado, em vez de apenas alterar um rótulo.

A lista curta de prefixos distintos também vem com exatamente 1,296 entradas

Os créditos e registros de terceiros dizem que as listas EFF redistribuídas tiveram suas colunas de lançamento de dados removidas, enquanto as palavras e a ordem permaneceram inalteradas. Eles registram a atribuição e a proveniência da licença. Eles não contêm o processo completo de revisão humana, conjuntos de dados de frequência ou critérios de rejeição implícitos no esboço da apostila.

Esse limite de evidência é importante porque o histórico do projeto da lista não é necessário para verificar o comportamento atual do gerador. Os revisores podem inspecionar cada linha confirmada, contar entradas e acompanhar a seleção. As declarações históricas devem aguardar uma fonte EFF em vez de serem inferidas a partir de um nome de arquivo ou descrição de produto.

As declarações de histórico de seleção são omitidas; arquivos comprometidos e procedência são a evidência

A publicação não enfraquece a seleção uniforme do índice porque o sigilo da lista não é assumido. O modelo de entropia de ToolAcre trata as configurações e o vocabulário como conhecidos. O valor desconhecido é a nova sequência de índices selecionados por meio de Web Crypto e amostragem de rejeição. Um invasor que conhece o arquivo não altera retroativamente quantos índices elegíveis existiam.

Publicar uma determinada frase gerada é diferente: revela a própria sequência selecionada. Portanto, os exemplos devem discutir configurações e tamanhos de pool sem imprimir credenciais que os leitores possam copiar. Nunca use uma frase da documentação como segredo da conta.

O que isso não cobre — listas de palavras em outros idiomas e variantes mantidas pela comunidade

Somente essas três listas em inglês são enviadas. A página de limitações diz que outros idiomas não foram adicionados porque ativos não verificados ou inadequados prejudicariam o cálculo. Este artigo não pesquisa variantes comunitárias, licenças ou qualidade linguística sem essas fontes.

Os usuários que necessitam de outro idioma devem escolher ferramentas cuja lista, procedência, licença e tamanho possam verificar. A tradução ad hoc de palavras altera o conjunto e pode introduzir duplicatas ou associações, de modo que a estimativa original não descreveria mais o novo processo.

Conclusão: o Gerador de Senhas baseia-se nas listas de palavras EFF, para que cada palavra seja familiar, distinta e digitável

Escolha a lista longa ou curta com base nas propriedades comprometidas e no formato aceito do seu destino e, em seguida, inspecione a contagem qualificada após a filtragem. O gerador calcula a partir das palavras realmente carregadas, de modo que um intervalo mais restrito é refletido, em vez de oculto atrás do tamanho do arquivo anunciado.

Os fatos duráveis ​​são três ativos, contagens testadas exatas, carregamento de mesma origem e seleção uniforme. Afirmações sobre a sua história cultural, memorabilidade universal ou adequação para todos os relatos estão intencionalmente ausentes. A lista é um insumo para a geração, não um gerenciador ou garantia de segurança.