Remover HTML do texto

Esta ferramenta remove as tags de um trecho de HTML e devolve só o texto, como ele aparece na página: parágrafos, títulos e itens de lista viram linhas, e <br> vira quebra de linha. Scripts, estilos e comentários são descartados, e entidades como &amp;, &nbsp; e &aacute; voltam a ser os caracteres que representam.

Atualizado em · Por Leonardo Gaertner

Achou um resultado errado ou tem uma sugestão? Avise por e-mail.

Como usar

  1. Cole o HTML: uma página inteira, um e-mail ou um trecho copiado de um editor.
  2. Confira o texto no resultado. Itens de lista aparecem com um hífen na frente.
  3. Copie o resultado.

Como funciona

Primeiro saem os comentários e o conteúdo de script, style e head, que não aparecem na página. Depois, as tags de bloco, como p, div, h1 a h6, li e tr, viram quebras de linha, para o texto não sair grudado. As demais tags, como b, a e span, são removidas e deixam só o texto de dentro.

As entidades HTML são decodificadas: &lt; volta a ser <, &amp; volta a ser & e &#233; vira é. O espaço não separável (&nbsp;) vira espaço comum, e espaços repetidos e linhas em branco a mais são limpos no fim.

Exemplo

HTML: <p>Pre&ccedil;o: <b>R$ 10</b></p><ul><li>Item um</li><li>Item dois</li></ul>

Texto: Preço: R$ 10

- Item um

- Item dois

Fonte: WHATWG: entidades nomeadas do HTML

Perguntas frequentes

Os links são mantidos?

O texto do link fica, e o endereço sai, porque ele está dentro da tag. Se precisar dos endereços, copie-os do HTML antes de converter.

Posso usar isso para limpar HTML enviado por usuários no meu sistema?

Não confie em remoção de tags para segurança. Para exibir texto de usuários, escape o HTML na saída, e para aceitar HTML, use uma biblioteca de sanitização com lista de tags permitidas, como o DOMPurify.

O HTML que eu colo é executado?

Não. O HTML é tratado como texto e processado no seu navegador, sem ser renderizado: scripts não rodam e imagens não são carregadas.