Explorateur de fréquence et de probabilité des kanji

combien de kanji couvrent 95 % des caractères d'un texte japonais réel ?

Chargement de la simulation interactive...

À propos de Explorateur de fréquence et de probabilité des kanji

Explorez la fréquence des kanji japonais, la couverture cumulée des lectures, la probabilité de rencontre et les statistiques sur le nombre de traits — les statistiques et les probabilités appliquées au japonais écrit.. Cet outil est classé dans la catégorie Statistiques & Finance et fonctionne sur des équations et des règles standard pour donner des résultats précis.

Ce calculateur comprend des cas préconfigurés : Lire 95 % (connus); Lire 90 % (connus); Les 100 premiers kanji; Chercher 水 (eau); Chercher 人 (personne); Radical de l'eau 氵; P(15 traits et plus); Analyser votre propre texte.

Mots-clés: kanji, japanese, frequency, cumulative coverage, probability, zipf, entropy, stroke count, descriptive statistics, reading coverage

Couverture n'est pas compréhension 🖖

La couverture indique quelle part des occurrences de kanji d'un texte est représentée par l'ensemble que vous connaissez déjà. En apprenant les 1,162 kanji les plus fréquents, vous reconnaîtrez environ 95% des caractères kanji de ce corpus. Mais une page pleine de caractères familiers peut rester illisible si la grammaire et le vocabulaire vous sont inconnus. La couverture mesure les symboles rencontrés, pas votre compréhension.

Un même kanji, deux probabilités 🖖

« Quelle est la probabilité qu'un kanji ait 15 traits ou plus ? » admet deux réponses correctes. En tirant un kanji uniformément dans le dictionnaire (types), les caractères complexes forment une part notable ; en tirant une occurrence dans un texte réel (occurrences), ils sont bien plus rares, car les caractères réellement lus penchent vers le simple (人, 日, 一). Cet écart entre types et occurrences est un échantillonnage pondéré par la fréquence — le mécanisme du paradoxe de l'amitié.

Exemples de problèmes