Cómo diagnosticar emojis ilegibles en un archivo de diario exportado
Si los emojis se ven mal en un diario exportado, determine primero si los caracteres se decodificaron con la codificación incorrecta, si se reemplazaron durante la exportación o si se decodificaron correctamente pero la aplicación o la fuente no pueden mostrarlos. Trabaje sobre un archivo duplicado, conserve los bytes originales y compare el mismo texto en un editor de texto sin formato y en el importador del diario. Cambiar la configuración de codificación puede corregir un error de decodificación; no puede restaurar información que ya ha sido reemplazada o eliminada.
Identificar cómo se ve lo «ilegible»
Observe detenidamente una entrada afectada. Una cadena de caracteres inesperados como `😀` donde debería ir 😀 puede indicar que los bytes UTF-8 se interpretaron utilizando una codificación diferente. Esto se conoce comúnmente como mojibake: los caracteres mostrados son incorrectos porque los bytes se decodificaron bajo supuestos erróneos. Es una pista, no una prueba de qué codificación produjo el archivo.
Un `` visible es diferente. Ese es U+FFFD, el carácter de reemplazo de Unicode, utilizado como sustituto de un carácter que no se puede interpretar. El [glosario](https://www.unicode.org/glossary/#replacement_character) de Unicode lo distingue de un glifo de reemplazo: una fuente o un motor de renderizado pueden mostrar un cuadro cuando no pueden dibujar un carácter, mientras que el carácter subyacente aún puede estar intacto. Si solo algunos emojis aparecen como cuadros, pruebe con otra aplicación o fuente actual antes de cambiar la codificación del archivo.
Preservar una línea de base antes de solucionar el problema
Haga una copia de la exportación y mantenga el original sin cambios. Registre la extensión del nombre de archivo, la aplicación que lo exportó y lo que ve en una frase afectada. Si es posible, compare un emoji conocido del diario con la misma entrada en la aplicación de origen o en una exportación previa. Evite abrir y guardar repetidamente la única copia: un editor de texto puede volver a escribir como bytes el texto recién decodificado, haciendo permanente un experimento de visualización que era reversible.
Abra la copia como texto sin formato en un editor que le permita elegir una codificación. Primero pruebe la codificación documentada por la aplicación de diario; si se desconoce y el archivo es una exportación de texto moderna típica, UTF-8 es un candidato razonable para inspeccionar, no una suposición para sobrescribir el original. Compare el texto afectado y los caracteres ordinarios circundantes bajo cada candidato. Un resultado coherente en todo el archivo es una evidencia más sólida que un emoji que simplemente parece correcto por casualidad.
Probar la decodificación sin reescribir
Cuando al cambiar la vista de codificación del editor la secuencia extraña se convierte en el emoji esperado y el texto circundante también se vuelve legible, es posible que la exportación contenga bytes intactos que se interpretaron incorrectamente. Confírmelo cerrando la copia sin guardar y volviéndola a abrir con la configuración prometedora. Luego, verifique si el flujo de trabajo de importación o apertura de la aplicación de diario ofrece una opción de codificación documentada; prefiera ese flujo de trabajo para cualquier reimportación real.
Las [Preguntas frecuentes sobre Unicode UTF](https://www.unicode.org/faq/utf_bom.html) explican que las secuencias de bytes UTF-8 mal formadas pueden desencadenar un error o manejarse con un marcador como U+FFFD. Eso significa que un decodificador puede haber reemplazado ya una entrada no válida al mostrarla o importarla. Cambiar la codificación después de ese paso no necesariamente recuperará los bytes originales. No utilice opciones de «reparación» o conversión que reemplacen silenciosamente caracteres no decodificables en su única copia.
Separar los problemas de codificación de los glifos faltantes
Si el emoji aparece correctamente en otro visor, conserve esa comparación como evidencia antes de modificar el archivo. Evite reescribir la exportación simplemente para cambiar su apariencia.
Si la misma posición contiene U+FFFD o un signo de interrogación literal en todos los visores, compárelo con el diario de origen o con una exportación anterior. Un sustituto almacenado en el archivo no se puede restaurar cambiando la fuente. La recuperación depende de que otra copia conserve el carácter.
Tratar CSV y JSON como rutas de importación diferentes
Una extensión `.csv` no le indica qué codificación de caracteres se utilizó, y los programas de hojas de cálculo pueden aplicar configuraciones de importación. Para Excel de escritorio, Microsoft documenta la importación de texto a través de **Datos > Desde texto/CSV** y el Asistente para importar texto en su [guía de importación/exportación de texto y CSV](https://support.microsoft.com/en-us/excel/get-started/import-or-export-text-txt-or-csv-files). Utilice la vista previa antes de cargar: verifique los emojis, los límites de filas y columnas y el texto adyacente. Una vista previa correcta es evidencia de que la ruta de importación seleccionada lee el archivo según lo previsto; no es una razón para sobrescribir el archivo de origen.
Para JSON, conserve el archivo y utilice un importador compatible con JSON en lugar de tratarlo como CSV. La [especificación JSON RFC 8259](https://www.rfc-editor.org/rfc/rfc8259#section-8.1) requiere UTF-8 para el JSON intercambiado entre sistemas fuera de un ecosistema cerrado. También explica que las cadenas JSON pueden representar caracteres directamente o con secuencias de escape. Ver un escape como `\\u263A` no es automáticamente una corrupción; un analizador de JSON debería interpretar los escapes válidos. Si el JSON no es válido o el importador informa un error de análisis, deténgase y conserve el archivo exacto en lugar de editar signos de puntuación o bytes por tanteo.
Decidir si reintentar, volver a exportar o detenerse
Siga esta secuencia: (1) compare el diario de origen con la exportación; (2) inspeccione un duplicado utilizando la codificación esperada y una vista UTF-8 si corresponde; (3) revise otro visor para comprobar el comportamiento ante glifos faltantes; (4) obtenga una vista previa del archivo a través del importador correcto de CSV o JSON; y (5) vuelva a intentar la exportación con una codificación de texto documentada si el origen aún muestra el emoji correctamente. Cambie una variable a la vez y mantenga cada resultado por separado.
Si ninguna vista o importador revela el carácter original y el archivo solo contiene caracteres de reemplazo u otros datos sustituidos, no prometa una recuperación mediante recodificación. Cambiar la configuración de decodificación no puede deducir qué emoji se descartó. Busque otra exportación, una copia de seguridad o la entrada intacta del diario, luego exporte nuevamente a un archivo nuevo y verifique su vista previa antes de confiar en él.
