Resultado
Esta página no tiene parte de servidor en absoluto. La tabla que pegas la procesa JavaScript dentro de tu propio navegador, el gráfico se dibuja en un elemento canvas de tu máquina y el archivo de exportación se arma localmente. Nada se sube, se almacena ni se escribe en ningún registro. Puedes desconectar la red después de cargar la página y todo seguirá funcionando: es la forma más sencilla de comprobarlo tú mismo.
Datos y límites del método
| Método de limpieza | Una expresión regular, no un análisis del DOM — el HTML nunca se conecta a la página |
|---|---|
| Qué cuenta como etiqueta | Cualquier secuencia desde "<" hasta el ">" más cercano |
| Entidades decodificadas | & < > " ' ' |
| Colapso de líneas en blanco | Tres o más saltos de línea seguidos se colapsan a dos |
Cuándo induce a error
- La limpieza usa una expresión regular simple de "desde < hasta el > más cercano", no un analizador HTML completo: un carácter "<" que aparezca en texto plano sin ser el inicio de una etiqueta (por ejemplo, en una expresión matemática como "5 < 10") se trata erróneamente como el inicio de marcado y puede tragarse parte del texto siguiente hasta el próximo ">".
- Solo se decodifica una lista fija de las siete entidades más comunes — entidades numéricas como « o con nombre como ©, — no están en esa lista y quedan en el texto tal cual.
- El contenido de las etiquetas <script> y <style> solo se elimina parcialmente junto con las etiquetas mismas — la etiqueta de apertura y cierre se quita como cualquier otra, pero el código o CSS entre ellas queda como texto plano en vez de eliminarse como un bloque completo.
- El marcado de tablas (<table>, <tr>, <td>) se convierte en un texto continuo sin separadores entre celdas una vez quitadas las etiquetas — la estructura de la tabla no se conserva ni siquiera como espacios o tabulaciones.
Cómo se calcula
La herramienta busca en el texto cada secuencia desde un carácter "<" hasta el ">" más cercano usando una expresión regular y las elimina — esto no es un análisis del DOM, así que el HTML potencialmente inseguro (como scripts) nunca se conecta a la propia página.
Si la decodificación de entidades está activada, tras quitar las etiquetas el texto restante se revisa buscando las siete entidades HTML estándar, y cada una se reemplaza por su carácter correspondiente.
Si el colapso de líneas en blanco está activado, tres o más saltos de línea seguidos (que suelen aparecer donde había etiquetas de bloque como <div> o <p>) se colapsan a dos.
El contador muestra cuántas etiquetas individuales se encontraron y eliminaron — no elementos de marcado, sino coincidencias del patrón "<...>".
Preguntas y respuestas
¿Es seguro pegar el HTML de otra persona en este campo?
Sí, la limpieza no usa innerHTML ni un análisis del DOM — el texto pegado nunca se convierte en marcado ejecutable en la página, se procesa puramente como una cadena de texto.
¿Por qué algo como © sigue apareciendo en el resultado?
Solo se decodifica una lista fija de las siete entidades más comunes (&, <, >, ", ', ', ). Las entidades con nombre y numéricas fuera de esa lista se dejan tal cual.
¿Los scripts y estilos se eliminan por completo?
Solo las etiquetas <script> y <style> en sí. El código entre ellas queda en el resultado como texto plano — la herramienta no reconoce el contenido de esas etiquetas como un bloque único a eliminar.
¿Se envía mi texto a algún sitio?
No, todo el procesamiento se ejecuta en tu navegador.