Explorador de Frequência e Probabilidade de Kanji

quantos kanji cobrem 95% dos caracteres em um texto japonês real?

A carregar a simulação interativa...

Sobre Explorador de Frequência e Probabilidade de Kanji

Explore a frequência dos kanji japoneses, a cobertura cumulativa de leitura, a probabilidade de encontro e as estatísticas de número de traços — estatística e probabilidade aplicadas ao japonês escrito.. Esta ferramenta está categorizada em Estatística e Finanças e opera com equações e regras padrão para produzir resultados precisos.

Esta calculadora inclui casos pré-configurados: Ler 95% (conhecidos); Ler 90% (conhecidos); Primeiros 100 kanji; Consultar 水 (água); Consultar 人 (pessoa); Radical de água 氵; P(15+ traços); Analise seu próprio texto.

Palavras-chave: kanji, japanese, frequency, cumulative coverage, probability, zipf, entropy, stroke count, descriptive statistics, reading coverage

Cobertura não é compreensão 🖖

A cobertura indica que proporção das ocorrências de kanji em um texto é representada pelo conjunto que você já conhece. Ao aprender os 1,162 kanji mais frequentes, você reconhecerá cerca de 95% dos caracteres kanji deste corpus. Mas uma página cheia de caracteres familiares pode continuar ilegível se a gramática e o vocabulário forem novos. A cobertura mede os símbolos que você encontra, não o que você entende.

O mesmo kanji, duas probabilidades 🖖

"Qual a probabilidade de um kanji ter 15 traços ou mais?" admite duas respostas corretas. Ao sortear um kanji uniformemente do dicionário (tipos), os complexos são uma fatia considerável; ao sortear uma ocorrência de um texto real (ocorrências), são bem mais raros, pois os caracteres que você lê tendem a ser simples (人, 日, 一). Essa diferença entre tipos e ocorrências é uma amostragem ponderada pela frequência — o mesmo mecanismo do paradoxo da amizade.

Problemas de exemplo