Limpiador de texto pegado
Los datos se procesan solo en este navegador. Consulta la política de privacidad.
Cómo se usa
- Copia texto de una página web, Word, Google Docs, un correo o Notion y pégalo en el cuadro Pegar. El formato (HTML) se lee tal cual, así que no hace falta pegarlo antes como texto plano.
- Revisa el resultado limpio en la pestaña Leer. Desaparecen anuncios, menús, estilos y restos de Word; se quedan títulos, listas, tablas, enlaces y énfasis.
- Elige el formato que necesitas (Markdown, HTML o Texto) y pulsa Copiar o descarga el archivo. Copiar con formato, en la pestaña Leer, se pega en correos y documentos como texto enriquecido limpio.
- Desactiva las Opciones de limpieza de enlaces, imágenes o tablas si no los quieres; el resultado cambia al instante. Para editar el HTML pegado, usa la pestaña Código HTML.
Ejemplos
Las viñetas de Word se convierten en una lista real
Un párrafo con viñeta copiado de Word es, en HTML, un párrafo normal que empieza con un carácter «·» y varios espacios de no separación. El limpiador lee el nivel de sangría (mso-list level), reconstruye una lista anidada y quita el carácter de viñeta.
Enlaces con parámetros de seguimiento
Los enlaces copiados de boletines y redes sociales suelen llevar parámetros como utm_source. Por defecto solo se eliminan los de seguimiento; los que eligen la página, como id, se conservan.
- Entrada
https://example.com/post?id=7&utm_source=newsletter&fbclid=IwAR0
- Resultado
https://example.com/post?id=7
El problema de «todo en negrita» de Google Docs
El HTML copiado de Google Docs envuelve todo el documento en una etiqueta b con font-weight:normal, por eso los conversores simples ponen todo en negrita. El limpiador quita ese envoltorio y deja en negrita solo el texto que de verdad tiene font-weight:700.
Detalles
Cuando copias texto con formato, el portapapeles guarda HTML además de los caracteres que ves. Desde una web vienen huecos de anuncios, botones para compartir y enlaces de seguimiento; desde Word, estilos que empiezan por mso-, span vacíos y cadenas de ; desde Google Docs, un atributo style larguísimo en cada fragmento de texto. Esta herramienta lee ese HTML dentro de tu navegador y conserva solo la estructura que es contenido: títulos, párrafos, listas, tablas, enlaces, énfasis y código.
La limpieza reconstruye lo permitido en lugar de buscar qué borrar. El HTML pegado nunca se inserta en la página: para la vista previa se crean desde cero solo los elementos de la lista permitida (p, h1–h6, listas, tablas, a, strong, em, code, pre, blockquote, br, hr). Scripts, estilos, iframes y atributos de eventos no pasan nunca; los enlaces solo conservan direcciones http, https y mailto, y las imágenes solo http y https. Las imágenes no se cargan, solo se muestra su dirección, así que los píxeles de seguimiento de los correos no se activan.
Los párrafos con viñetas de Word pasan a ser listas reales, y la negrita o cursiva que Google Docs expresa con estilos pasa a strong y em. Las tablas de maquetación, habituales en los boletines por correo, se deshacen en su contenido, mientras que las tablas de datos reales se convierten en tablas Markdown al estilo de GitHub. Las celdas combinadas (colspan, rowspan) se rellenan con celdas vacías porque las tablas Markdown no admiten combinarlas.
Los anuncios y menús se detectan por elementos como nav, aside y footer, y por nombres de clase como ad, share o related. Un bloque cuyo nombre parece de anuncio pero contiene más de 600 caracteres de texto puede ser el propio artículo, así que se conserva. Si desapareció algo que necesitas, desactiva Quitar anuncios y menús.
Preguntas frecuentes
¿Se envía el contenido pegado a algún servidor?
No. La lectura, la limpieza y la conversión ocurren en tu navegador y la entrada no se guarda en ningún sitio. Al cerrar o recargar la página desaparece.
He pegado y entra como texto plano sin formato.
La aplicación de origen no puso HTML en el portapapeles; algunas aplicaciones y navegadores móviles lo hacen así. Si tienes el HTML original, pégalo en la pestaña Código HTML. El texto plano también se ordena: las líneas en blanco separan párrafos y los saltos simples se mantienen.
¿Por qué no se ven las imágenes?
Las imágenes nunca se cargan; solo se guarda su dirección. Abrir una imagen remota avisa a ese servidor de que la viste y activaría los píxeles de seguimiento de los correos. El Markdown y el HTML resultantes conservan la dirección, así que las imágenes aparecen donde pegues el resultado. Los datos de imagen incrustados (direcciones data:) no se incluyen.
¿Qué variante de Markdown se genera?
CommonMark con tablas de GitHub (GFM). Los saltos de línea dentro de un párrafo usan dos espacios al final y los bloques de código usan vallas de comillas invertidas. Caracteres como * y _ solo se escapan cuando abrirían énfasis o código, así que palabras como snake_case se leen bien.
¿Qué borra la eliminación de parámetros de seguimiento?
Solo los parámetros que empiezan por utm_ y rastreadores de anuncios o correo como fbclid, gclid, msclkid y mc_cid. Los que eligen la página, como id o page, se conservan. Los enlaces de redirección de Google Docs, Outlook y Facebook se convierten en la dirección original.
¿Qué es Copiar con formato?
Copia el resultado limpio como HTML y como texto plano a la vez. Al pegarlo en Gmail, Google Docs o Notion obtienes texto enriquecido limpio con títulos, listas y enlaces; en un editor de texto simple obtienes texto.