Comptez les caractères avec et sans espaces, les mots, les mots uniques, les phrases, les paragraphes et les lignes. Temps de lecture estimé et fréquence des mots, calculés en direct dans votre navigateur.
Chaque comptage dont vous avez besoin à partir d'un bloc de texte, en direct pendant que vous tapez. Collez ou tapez du texte pour obtenir les caractères, les mots, les mots uniques, les phrases, les paragraphes, les lignes et un temps de lecture estimé. La liste de fréquence montre quels mots portent réellement le propos, et vous pouvez masquer les mots courants pour voir ceux qui comptent.
Caractères
0
Caractères (sans espaces)
0
Mots
0
Mots uniques
0
Phrases
0
Paragraphes
0
Lignes
0
Temps de lecture
0
Mots les plus fréquents
Compter du texte est moins évident qu'il n'y paraît
Qu'est-ce exactement qu'un mot
Demandez à trois programmes un décompte de mots et vous obtiendrez facilement trois réponses. Le désaccord n'est pas un bug, c'est un problème de définition. Un composé à trait d'union comme "state-of-the-art" est un mot pour un typographe et quatre pour un découpeur naïf. Une apostrophe dans "don't" ne doit pas scinder le mot, tandis qu'une apostrophe utilisée comme guillemet devrait. Les chiffres, les URL et les adresses e-mail invitent chacun une règle différente.
Cet outil traite un mot comme une suite de lettres ou de chiffres, éventuellement prolongée par une apostrophe et d'autres lettres. Comme la correspondance est consciente de l'Unicode, les caractères latins accentués, grecs, cyrilliques et CJK comptent tous comme des lettres plutôt que d'être silencieusement supprimés. La ponctuation entre les suites les sépare, donc "well-known" compte pour deux et "it's" compte pour un. Connaître la règle compte plus que de choisir laquelle, car elle permet de prédire le nombre au lieu de le contester.
Phrases, paragraphes et lignes
La détection des phrases sans modèle de langue est heuristique par nature. La découpe sur les points, points d'interrogation et points d'exclamation fonctionne pour la prose ordinaire et échoue prévisiblement sur les abréviations : "Dr. Smith arrived at 9 a.m." ressemble à trois phrases pour un découpeur naïf. Traitez le nombre de phrases comme une bonne estimation pour le travail de lisibilité plutôt que comme un chiffre exact.
Les paragraphes et lignes sont plus mécaniques mais restent distincts. Une ligne est tout ce qui est séparé par un saut de ligne, donc un fichier à retour à la ligne forcé a beaucoup de lignes et peu de paragraphes. Un paragraphe est un bloc séparé par une ou plusieurs lignes vides, ce qui correspond à la façon dont Markdown et la plupart des éditeurs pensent. Comparer les deux nombres vous dit rapidement si le texte est arrivé à retour à la ligne forcé, ce qui compte quand on colle dans un système qui reformate.
Temps de lecture et fréquence
L'estimation du temps de lecture utilise 200 mots par minute, une moyenne courante pour la lecture silencieuse de prose ordinaire. Les vitesses réelles varient beaucoup : le matériel technique avec échantillons de code est plus lent, le texte marketing familier est plus rapide, et la lecture sur téléphone est plus lente que sur ordinateur de bureau. Utilisez le chiffre pour une comparaison relative, pas comme une promesse à vos lecteurs.
La fréquence des mots est là où l'outil mérite sa place dans l'édition. Trier par nombre révèle des répétitions inconscientes, les mots de béquille qui apparaissent onze fois dans huit cents, et si le sujet que vous vouliez traiter est réellement le nom le plus fréquent. Le bouton « ignore common words » retire les mots fonctionnels de classe fermée tels que les articles, prépositions et pronoms, qui sinon dominent chaque liste dans chaque langue et ne disent rien.
FAQ
Pourquoi votre comptage de mots diffère-t-il de mon traitement de texte ?
Les différents outils définissent les mots différemment, surtout autour des traits d'union, apostrophes et chiffres. Cet outil compte les suites de lettres ou de chiffres, donc "well-known" fait deux mots et "it's" en fait un.
Quelle est la différence entre les deux comptages de caractères ?
Le premier compte chaque caractère y compris espaces, tabulations et sauts de ligne. Le second retire tout espace blanc, ce qui est le chiffre que la plupart des limites de caractères signifient réellement.
Comment le temps de lecture est-il calculé ?
Mots divisés par 200 par minute, une moyenne de lecture silencieuse typique pour la prose ordinaire. Le texte technique avec code est plus lent, donc traitez-le comme une figure de comparaison.
Comment les phrases sont-elles détectées ?
En découpant sur les points, points d'interrogation et points d'exclamation. Des abréviations comme « a.m. » peuvent gonfler le compte, donc c'est une estimation plutôt qu'un nombre exact.
Que retire « ignore common words » ?
Les mots fonctionnels tels que the, and, of, to et les pronoms courants. Ils dominent chaque liste de fréquence et ne disent rien du sujet, donc les masquer fait ressortir les termes significatifs.
Mon texte est-il téléversé quelque part ?
Non. Tout le comptage se fait dans votre navigateur avec JavaScript. Rien n'est envoyé à un serveur, ce qui explique que les chiffres se mettent à jour instantanément pendant que vous tapez.