CoreUtils
Atrás · Limpiar, convertir y analizar

Corregir Texto Mal Codificado

Repara mojibake como España, información y comillas convertidas en símbolos extraños.

Intenta recuperar texto UTF-8 interpretado erróneamente como Windows-1252 o Latin-1. Compara siempre el resultado antes de sustituir el original.

Cómo reparar caracteres extraños

  1. Pega el texto que muestra secuencias como Ã,  o â€.
  2. Prueba una corrección y usa la doble solo si el contenido fue recodificado dos veces.
  3. Compara nombres propios, símbolos y fragmentos técnicos con el original.

Qué resuelve esta herramienta

El texto conocido como mojibake aparece cuando los mismos bytes se interpretan con una codificación distinta de la utilizada al guardarlos. Un archivo UTF-8 leído como Latin-1 puede transformar España en España y convertir comillas tipográficas en secuencias ilegibles. El error se propaga al copiar datos entre CSV, bases de datos, páginas antiguas, correos y exportaciones.

Esta herramienta reconstruye los bytes visibles y vuelve a interpretarlos como UTF-8. Si la secuencia no forma un texto UTF-8 válido, conserva la entrada para no destruirla. La corrección doble sirve únicamente cuando el contenido atravesó dos conversiones incorrectas. No es un corrector ortográfico y no puede adivinar caracteres que ya fueron sustituidos por signos de interrogación. Conserva una copia del original y verifica cifras, nombres, código y alfabetos distintos antes de utilizar el resultado en producción.

Casos de uso habituales

Archivos CSV

Repara exportaciones que muestran tildes, eñes o comillas como secuencias de varios símbolos.

Bases de datos

Comprueba registros dañados por una importación con charset incorrecto.

Webs antiguas

Recupera fragmentos copiados desde páginas que mezclan UTF-8 y Latin-1.

Correos

Normaliza mensajes cuyos encabezados o cuerpos fueron decodificados de forma incorrecta.

Preguntas frecuentes

¿Qué significa mojibake?

Es texto ilegible producido al decodificar bytes con un juego de caracteres equivocado.

¿Por qué el resultado a veces no cambia?

La entrada puede estar correctamente codificada, usar otro error diferente o contener bytes que ya se perdieron.

¿Debo usar siempre la corrección doble?

No. Solo debe utilizarse cuando una primera corrección todavía deja patrones claros de recodificación.