In breve: il "conteggio dei caratteri" non è letterale come sembra — un'emoji può essere un solo carattere visibile ma più punti di codice, e ciò che conta come "parola" cambia nelle lingue che non usano gli spazi. Scegliere il contatore sbagliato dà un numero che non corrisponde a quello che una piattaforma applica davvero. Abbina questa guida a Word Frequency, Remove Extra Spaces, AI Hidden Characters e Text Difference.

Character Counter e i contatori di parole risolvono problemi diversi, e le piattaforme applicano limiti diversi: un tweet si misura in caratteri, il conteggio parole di un saggio in parole, e nessuno dei due numeri predice l'altro in modo affidabile.

Approfondimenti: il report Unicode sulla segmentazione del testo (UAX #29) definisce come il testo si divide in "grapheme cluster" (ciò che una persona percepisce come un carattere), e il riferimento MDN su Intl.Segmenter copre l'API del browser che lo implementa correttamente.

Perché un'emoji rompe il conteggio caratteri ingenuo

Un'emoji famiglia (👨‍👩‍👧‍👦) sembra un solo carattere ma in realtà sono quattro emoji persona separate unite da caratteri invisibili zero-width joiner (ZWJ) — un contatore ingenuo che usa .length in JavaScript riporta 11 o più per qualcosa che una persona vede come un solo glifo, perché .length conta le unità di codice UTF-16, non i caratteri visibili.

Un contatore consapevole dei grapheme, costruito su Intl.Segmenter, conta ciò che una persona conterebbe: quella stessa emoji come 1. Questa è la differenza tra un conteggio caratteri che corrisponde al limite reale di una piattaforma e uno che sovra- o sotto-riporta silenziosamente su qualsiasi testo con emoji, lettere accentate o simboli combinati.

Perché il conteggio parole dipende dalla lingua

I contatori di parole che dividono in base agli spazi funzionano bene per italiano, spagnolo o francese — ma cinese, giapponese e tailandese non usano affatto gli spazi tra le parole, quindi un contatore basato sugli spazi restituisce una singola "parola" per un intero paragrafo. Ottenere un conteggio parole significativo in quelle lingue richiede una segmentazione basata su dizionario o statistica reale, non una divisione più semplice.

Anche nelle lingue che separano con gli spazi, i casi limite si accumulano: "dell'" è una parola o due? Un composto con trattino è una parola o due? Strumenti diversi fanno scelte diverse, ed è per questo che lo stesso paragrafo può riportare conteggi parole diversi a seconda di quale contatore usi.

Abbinare il contatore a ciò che viene davvero applicato

  • Limiti dei post sui social media (X/Twitter, SMS) → conteggio caratteri, e consapevole dei grapheme se il testo ha emoji.
  • Meta description, tag title → conteggio caratteri, dato che i motori di ricerca troncano per larghezza in caratteri/pixel, non per parole.
  • Saggi, articoli, minimi di parole per brief di contenuto → conteggio parole.
  • Contenuto CJK (cinese, giapponese, tailandese) → il conteggio caratteri è di solito la metrica significativa, dato che le "parole" non sono ben definite senza spazi.

Un controllo rapido di buon senso

Se il limite di una piattaforma è applicato in caratteri, incolla il testo finale esatto in Character Counter prima di pubblicare — non una stima, la stringa letterale, incluse eventuali emoji o punteggiatura speciale, perché è esattamente lì che gli strumenti di conteggio ingenui divergono da ciò che viene davvero applicato. Se stai invece limando verso un obiettivo di parole, passalo in un contatore parole, poi ricontrolla separatamente il conteggio caratteri se la piattaforma (come una meta description) applica entrambi.

Per testo con problemi di formattazione nascosti che alterano anche i conteggi — spazi extra, segni Unicode invisibili — puliscilo prima con Remove Extra Spaces o AI Hidden Characters, poi conta la versione pulita.