Resultado
Esta página não tem lado servidor nenhum. A tabela colada é processada por JavaScript dentro do seu próprio navegador, o gráfico é desenhado num elemento canvas da sua máquina e o arquivo de exportação é montado localmente. Nada é enviado, armazenado ou gravado em qualquer log. Você pode desconectar a rede depois que a página carregar e tudo continuará funcionando — é a forma mais simples de verificar você mesmo.
Fatos e limites do método
| Método de limpeza | Uma expressão regular, não uma análise do DOM — o HTML nunca é conectado à página |
|---|---|
| O que conta como tag | Qualquer sequência de "<" até o ">" mais próximo |
| Entidades decodificadas | & < > " ' ' |
| Colapso de linhas em branco | Três ou mais quebras de linha seguidas são colapsadas para duas |
Quando induz ao erro
- A limpeza usa uma expressão regular simples de "de < até o > mais próximo", não um analisador HTML completo: um caractere "<" que aparece em texto simples sem ser o início de uma tag (por exemplo, em uma expressão matemática como "5 < 10") é tratado por engano como início de marcação e pode engolir parte do texto seguinte até o próximo ">".
- Só é decodificada uma lista fixa das sete entidades mais comuns — entidades numéricas como « ou nomeadas como ©, — não estão nessa lista e ficam no texto como estão.
- O conteúdo das tags <script> e <style> só é removido parcialmente junto com as próprias tags — a tag de abertura e fechamento é removida como qualquer outra, mas o código ou CSS entre elas fica como texto simples em vez de ser removido como um bloco inteiro.
- A marcação de tabelas (<table>, <tr>, <td>) vira um texto contínuo sem separadores entre células assim que as tags são removidas — a estrutura da tabela não é preservada nem mesmo como espaços ou tabulações.
Como é calculado
A ferramenta busca no texto cada sequência de um caractere "<" até o ">" mais próximo usando uma expressão regular e as remove — isso não é uma análise do DOM, então HTML potencialmente inseguro (como scripts) nunca é conectado à própria página.
Se a decodificação de entidades estiver ativada, depois de remover as tags, o texto restante é verificado em busca das sete entidades HTML padrão, e cada uma é substituída pelo caractere correspondente.
Se o colapso de linhas em branco estiver ativado, três ou mais quebras de linha seguidas (que costumam aparecer onde havia tags de bloco como <div> ou <p>) são colapsadas para duas.
O contador mostra quantas tags individuais foram encontradas e removidas — não elementos de marcação, mas correspondências do padrão "<...>".
Perguntas e respostas
É seguro colar o HTML de outra pessoa neste campo?
Sim, a limpeza não usa innerHTML nem análise do DOM — o texto colado nunca vira marcação executável na página, é processado puramente como uma string.
Por que algo como © ainda aparece no resultado?
Só é decodificada uma lista fixa das sete entidades mais comuns (&, <, >, ", ', ', ). Entidades nomeadas e numéricas fora dessa lista ficam como estão.
Scripts e estilos são removidos por completo?
Só as próprias tags <script> e <style>. O código entre elas fica no resultado como texto simples — a ferramenta não reconhece o conteúdo dessas tags como um bloco único a remover.
Meu texto é enviado para algum lugar?
Não, todo o processamento roda no seu navegador.