Explorador de Frecuencia y Probabilidad de Kanji

¿cuántos kanji cubren el 95 % de los caracteres de un texto japonés real?

Cargando simulación interactiva...

Acerca de Explorador de Frecuencia y Probabilidad de Kanji

Explora la frecuencia de los kanji japoneses, la cobertura acumulada de lectura, la probabilidad de aparición y las estadísticas del número de trazos: estadística y probabilidad aplicadas al japonés escrito.. Esta herramienta está categorizada bajo Estadística y Finanzas y opera con ecuaciones y reglas estándar para proporcionar resultados precisos.

Esta calculadora incluye casos preconfigurados: Leer 95% (conocidos); Leer 90% (conocidos); Primeros 100 kanji; Buscar 水 (agua); Buscar 人 (persona); Radical de agua 氵; P(15+ trazos); Analiza tu propio texto.

Palabras clave: kanji, japanese, frequency, cumulative coverage, probability, zipf, entropy, stroke count, descriptive statistics, reading coverage

Cobertura no es comprensión 🖖

La cobertura indica qué proporción de las apariciones de kanji en un texto representa el conjunto que ya conoces. Si aprendes los 1,162 kanji más frecuentes, reconocerás alrededor del 95% de los caracteres kanji de este corpus. Pero una página llena de caracteres familiares puede seguir siendo ilegible si la gramática y el vocabulario son nuevos. La cobertura mide los símbolos que encuentras, no lo que entiendes.

El mismo kanji, dos probabilidades 🖖

"¿Qué probabilidad hay de que un kanji tenga 15 trazos o más?" admite dos respuestas correctas. Si eliges un kanji al azar del diccionario (tipos), los complejos son una porción notable; si eliges una aparición de un texto real (ocurrencias), son mucho más raros, porque los caracteres que lees tienden a ser simples (人, 日, 一). Esta brecha entre tipos y ocurrencias es un muestreo ponderado por frecuencia, el mismo mecanismo de la paradoja de la amistad.

Problemas de ejemplo