Calculez le nombre de caractères, le nombre d'octets (UTF-8/ASCII), le nombre de mots et le nombre de lignes.
La longueur d'une chaîne peut être mesurée de différentes manières : nombre de caractères (unités visuelles), nombre d'octets (taille de stockage), nombre de points de code (unités Unicode) ou nombre de graphèmes (caractères perçus par l'utilisateur). Comprendre ces distinctions est crucial lorsque vous travaillez avec du texte international, des bases de données avec des limites de taille ou des API avec des restrictions de caractères.
Le nombre de caractères varie selon l'encodage : un emoji peut contenir visuellement 1 caractère mais 4 octets en UTF-8. Le nombre de mots se divise généralement en espaces. Le nombre de lignes dépend des caractères de nouvelle ligne. Le nombre d'octets reflète la taille réelle du stockage et varie en fonction du codage (UTF-8, UTF-16, etc.).
Les émojis peuvent être composés de plusieurs points de code Unicode. Un emoji familial peut être composé de plusieurs caractères rejoints par des menuisiers de largeur nulle. Différents systèmes les comptent différemment.
Cet outil utilise UTF-8, le codage Web le plus courant. UTF-8 utilise 1 à 4 octets par caractère : ASCII utilise 1 octet, la plupart des autres langages utilisent 2 à 3 octets et les emojis utilisent 4 octets.