Resultado
Todos los cálculos se hacen localmente en tu navegador: análisis, gráfico, exportación. Si desconectas la red, la página sigue funcionando.
Datos y límites del método
| Método de limpieza | Una expresión regular, no un análisis del DOM — el HTML nunca se conecta a la página |
|---|---|
| Qué cuenta como etiqueta | Cualquier secuencia desde "<" hasta el ">" más cercano |
| Entidades decodificadas | & < > " ' ' |
| Colapso de líneas en blanco | Tres o más saltos de línea seguidos se colapsan a dos |
Cuándo induce a error
- La limpieza usa una expresión regular simple de "desde < hasta el > más cercano", no un analizador HTML completo: un carácter "<" que aparezca en texto plano sin ser el inicio de una etiqueta (por ejemplo, en una expresión matemática como "5 < 10") se trata erróneamente como el inicio de marcado y puede tragarse parte del texto siguiente hasta el próximo ">".
- Solo se decodifica una lista fija de las siete entidades más comunes — entidades numéricas como « o con nombre como ©, — no están en esa lista y quedan en el texto tal cual.
- El contenido de las etiquetas <script> y <style> solo se elimina parcialmente junto con las etiquetas mismas — la etiqueta de apertura y cierre se quita como cualquier otra, pero el código o CSS entre ellas queda como texto plano en vez de eliminarse como un bloque completo.
- El marcado de tablas (<table>, <tr>, <td>) se convierte en un texto continuo sin separadores entre celdas una vez quitadas las etiquetas — la estructura de la tabla no se conserva ni siquiera como espacios o tabulaciones.
Cómo se calcula
La herramienta busca en el texto cada secuencia desde un carácter "<" hasta el ">" más cercano usando una expresión regular y las elimina — esto no es un análisis del DOM, así que el HTML potencialmente inseguro (como scripts) nunca se conecta a la propia página.
Si la decodificación de entidades está activada, tras quitar las etiquetas el texto restante se revisa buscando las siete entidades HTML estándar, y cada una se reemplaza por su carácter correspondiente.
Si el colapso de líneas en blanco está activado, tres o más saltos de línea seguidos (que suelen aparecer donde había etiquetas de bloque como <div> o <p>) se colapsan a dos.
El contador muestra cuántas etiquetas individuales se encontraron y eliminaron — no elementos de marcado, sino coincidencias del patrón "<...>".
Preguntas y respuestas
¿Es seguro pegar el HTML de otra persona en este campo?
Sí, la limpieza no usa innerHTML ni un análisis del DOM — el texto pegado nunca se convierte en marcado ejecutable en la página, se procesa puramente como una cadena de texto.
¿Por qué algo como © sigue apareciendo en el resultado?
Solo se decodifica una lista fija de las siete entidades más comunes (&, <, >, ", ', ', ). Las entidades con nombre y numéricas fuera de esa lista se dejan tal cual.
¿Los scripts y estilos se eliminan por completo?
Solo las etiquetas <script> y <style> en sí. El código entre ellas queda en el resultado como texto plano — la herramienta no reconoce el contenido de esas etiquetas como un bloque único a eliminar.
¿Se envía mi texto a algún sitio?
No, todo el procesamiento se ejecuta en tu navegador.