La mayoría de las herramientas de texto hacen cosas sencillas, pero unos pocos detalles deciden si dan la respuesta esperada: cómo se cuenta una "palabra", cómo se puntúa la legibilidad, qué hace que dos líneas sean "la misma" y qué caracteres hay que escapar. Esta guía los explica, con cada ejemplo ejecutado en las propias herramientas del sitio.
Contar palabras y tiempo
Una palabra es una secuencia de letras o dígitos, unida opcionalmente por un apóstrofo o un guion (don't y well-known son una palabra cada una). Las frases terminan en ., !, ? o una línea en blanco. Del recuento de palabras sale el tiempo: la lectura silenciosa promedia unas 238 palabras por minuto y el habla unas 150, así que 1.000 palabras llevan aproximadamente 4,2 minutos de lectura. Use el Contador de Palabras, que cuenta también caracteres, y el Contador de Frecuencia de Palabras para ver qué términos se repiten: en the cat and the hat and the bat, "the" es el 37,5 % de todas las palabras y "and" el 25 %.
Puntuar la legibilidad
La puntuación de facilidad de lectura de Flesch usa solo la longitud de las frases y las sílabas por palabra:
206,835 − 1,015 × (palabras / frases) − 84,6 × (sílabas / palabras)
Cuanto más alta, más fácil: de 90 a 100 es muy fácil, de 60 a 70 lenguaje llano, de 30 a 50 difícil y por debajo de 30 muy difícil. El nivel de Flesch-Kincaid convierte los mismos dos números en un curso escolar de EE. UU.: 0,39 × (palabras / frases) + 11,8 × (sílabas / palabras) − 15,59. Dos ejecuciones reales (con textos en inglés):
| Texto | Palabras | Frases | Sílabas | Facilidad de lectura | Nivel |
|---|---|---|---|---|---|
| "The cat sat on the mat. It was a sunny day, and the cat was happy." | 16 | 2 | 18 | 103,5 (muy fácil) | 0,8 |
| "The committee reviewed the proposal and approved the revised budget." | 10 | 1 | 18 | 44,4 (difícil) | 9,6 |
Las palabras y frases cortas elevan la puntuación. Las sílabas se cuentan con una aproximación, así que tome las puntuaciones como orientación. El Verificador de Legibilidad muestra varios índices a la vez. Apunte a un lenguaje llano: frases más cortas y palabras cotidianas.
Cambiar mayúsculas y minúsculas
La misma frase en los estilos de nombres habituales, útil para código y URL:
| Estilo | Resultado | Uso habitual |
|---|---|---|
camelCase |
wordFrequencyCounter |
Variables de JavaScript |
PascalCase |
WordFrequencyCounter |
Nombres de clase |
snake_case |
word_frequency_counter |
Python y columnas de bases de datos |
kebab-case |
word-frequency-counter |
URL y clases CSS |
SCREAMING_SNAKE_CASE |
WORD_FREQUENCY_COUNTER |
Constantes |
Title Case |
Word Frequency Counter |
Titulares |
Sentence case |
Word frequency counter |
Texto normal |
El Convertidor de Mayúsculas y Minúsculas convierte entre ellos, y para los saltos de línea use el Eliminar Saltos de Línea (Windows termina las líneas con dos caracteres, \r\n, mientras que Linux y macOS usan \n).
Comparar textos
Una comparación por líneas halla la subsecuencia común más larga de líneas y presenta el resto como eliminado o añadido. Comparando tres líneas con una versión revisada de cuatro:
| Texto antiguo | Texto nuevo | Diferencias |
|---|---|---|
red green blue |
red yellow blue black |
red− green+ yellowblue+ black |
Son 2 añadidas, 1 eliminada y 2 sin cambios. Una línea modificada cuenta como una eliminación más una adición. El Comparador de Texto lo muestra en paralelo; para datos estructurados use el Comparador de Diferencias JSON.
Ordenar y quitar duplicados
- El orden importa. El orden alfabético simple pone
10antes de2: el resultado es1, 10, 2. El orden natural compara los números por valor y da1, 2, 10. Use el Ordenar Líneas con el modo que necesite. - Los duplicados dependen de las mayúsculas. De
a,b,a,A, el Eliminar Líneas Duplicadas conserva 3 líneas,a, b, A, pero si se ignoran las mayúsculas solo quedan 2,a, b. - Extraiga lo que necesite. El Extractor de Texto lista los correos, URL, teléfonos o números de un bloque de texto.
Escapar caracteres especiales
Caracteres como las comillas y las barras invertidas significan algo en el código, así que hay que escaparlos cuando son datos. El Escapar y Desescapar Cadenas trata cada lenguaje:
| Lenguaje | Entrada | Escapado |
|---|---|---|
| JSON | He said "hi" más un salto de línea |
He said \"hi\"\n |
| Regex | a.b*c |
a\.b\*c |
| SQL | O'Brien |
O''Brien |
Escapar SQL a mano es el último recurso: use consultas parametrizadas, que evitan por completo la Inyección SQL. Escape para el contexto en que esté; HTML necesita entidades, vea las Entidades HTML.
Texto de relleno
Lorem ipsum es texto ficticio derivado de una obra de Cicerón, usado para llenar maquetas sin distraer con significado. Genere la cantidad que quiera con el Generador de Lorem Ipsum y sustitúyalo por texto real antes de lanzar.
Errores frecuentes
- Fiarse de una puntuación de legibilidad en textos que no son en inglés. Las fórmulas se ajustaron para el inglés.
- Ordenar números como texto. Use el orden natural o numérico.
- Ignorar las diferencias invisibles. Los espacios finales y los distintos finales de línea hacen distintas líneas "idénticas".
- Escapar para el lenguaje equivocado. Una cadena escapada para JSON no es segura para una regex o SQL.