Cara Mendiagnosis Emoji yang Rusak dalam File Ekspor Buku Harian
Jika emoji tampak salah dalam ekspor buku harian, pertama-tama tentukan apakah karakter tersebut didekodekan dengan encoding yang salah, digantikan selama ekspor, atau didekodekan dengan benar tetapi tidak dapat ditampilkan oleh aplikasi atau font. Kerjakan pada file duplikat, pertahankan byte asli, dan bandingkan teks yang sama di editor teks biasa serta pengimpor buku harian. Mengubah pengaturan encoding dapat memperbaiki ketidakcocokan dekode; ini tidak dapat memulihkan informasi yang sudah digantikan atau dihapus.
Mengidentifikasi seperti apa tampilan “rusak”
Perhatikan baik-baik satu entri yang terpengaruh. Rangkaian karakter yang tidak terduga seperti `😀` di tempat yang seharusnya berisi 😀 dapat mengindikasikan bahwa byte UTF-8 ditafsirkan menggunakan encoding yang berbeda. Ini umumnya disebut mojibake: karakter yang ditampilkan salah karena byte didekodekan berdasarkan asumsi yang keliru. Ini merupakan petunjuk, bukan bukti pasti tentang encoding mana yang menghasilkan file tersebut.
Karakter `` yang terlihat memiliki arti berbeda. Itu adalah U+FFFD, karakter pengganti Unicode, yang digunakan sebagai pengganti karakter yang tidak dapat ditafsirkan. [Glosarium](https://www.unicode.org/glossary/#replacement_character) Unicode membedakannya dari glif pengganti: font atau perender mungkin menampilkan kotak saat tidak dapat menggambar suatu karakter, sementara karakter yang mendasarinya mungkin masih utuh. Jika hanya beberapa emoji yang muncul sebagai kotak, periksa aplikasi atau font terkini lainnya sebelum mengubah encoding file.
Menjaga dasar baseline sebelum pemecahan masalah
Buat salinan file ekspor dan simpan file aslinya tanpa perubahan. Catat ekstensi nama file, aplikasi yang mengekspornya, dan apa yang Anda lihat untuk satu frasa yang terpengaruh. Jika memungkinkan, bandingkan emoji yang diketahui dari buku harian dengan entri yang sama di aplikasi sumber atau ekspor sebelumnya. Hindari membuka dan menyimpan satu-satunya salinan berulang kali: editor teks mungkin menuliskan kembali teks yang baru didekodekan sebagai byte, membuat eksperimen tampilan yang seharusnya dapat dibalik menjadi permanen.
Buka salinan sebagai teks biasa di editor yang memungkinkan Anda memilih encoding. Pertama, coba encoding yang terdokumentasi oleh aplikasi buku harian; jika tidak diketahui dan file tersebut merupakan ekspor teks modern yang umum, UTF-8 adalah kandidat yang wajar untuk diperiksa, bukan asumsi untuk ditimpa ke file asli. Bandingkan teks yang terpengaruh dan karakter biasa di sekitarnya di bawah setiap kandidat. Hasil yang koheren di seluruh file adalah bukti yang lebih kuat daripada satu emoji yang kebetulan terlihat benar.
Menguji dekode tanpa menulis ulang
Ketika mengubah tampilan encoding editor membuat urutan aneh tersebut menjadi emoji yang diharapkan dan teks di sekitarnya juga menjadi terbaca, ekspor tersebut mungkin berisi byte utuh yang ditafsirkan secara tidak tepat. Konfirmasikan dengan menutup salinan tanpa menyimpan dan membukanya kembali dengan pengaturan yang menjanjikan tersebut. Kemudian periksa apakah alur kerja impor atau pembukaan aplikasi buku harian menawarkan pilihan encoding yang terdokumentasi; utamakan alur kerja tersebut untuk setiap impor ulang yang sebenarnya.
[FAQ Unicode UTF](https://www.unicode.org/faq/utf_bom.html) menjelaskan bahwa urutan byte UTF-8 yang salah bentuk dapat memicu kesalahan atau ditangani dengan penanda seperti U+FFFD. Itu berarti dekoder mungkin telah mengganti input yang tidak valid saat menampilkan atau mengimpornya. Beralih encoding setelah langkah tersebut belum tentu memulihkan byte asli. Jangan gunakan opsi “perbaikan” atau konversi yang secara diam-diam menggantikan karakter yang tidak dapat didekodekan pada satu-satunya salinan Anda.
Memisahkan masalah encoding dari glif yang hilang
Jika emoji muncul dengan benar di penampil lain, simpan perbandingan tersebut sebagai bukti sebelum mengubah file. Hindari menulis ulang file ekspor hanya untuk mengubah tampilannya.
Jika posisi yang sama berisi U+FFFD atau tanda tanya harfiah di berbagai penampil, bandingkan dengan buku harian sumber atau ekspor yang lebih lama. Karakter pengganti yang tersimpan dalam file tidak dapat dipulihkan dengan mengubah font. Pemulihan bergantung pada adanya salinan lain yang masih mempertahankan karakter tersebut.
Memperlakukan CSV dan JSON sebagai jalur impor yang berbeda
Ekstensi `.csv` tidak memberi tahu Anda encoding karakter mana yang digunakan, dan program spreadsheet dapat menerapkan pengaturan impor. Untuk Excel desktop, Microsoft mendokumentasikan pengimporan teks melalui **Data > Dari Teks/CSV** dan Wizard Impor Teks dalam [panduan impor/ekspor teks dan CSV](https://support.microsoft.com/en-us/excel/get-started/import-or-export-text-txt-or-csv-files)-nya. Gunakan pratinjau sebelum memuat: verifikasi emoji, batas baris dan kolom, serta teks di sekitarnya. Pratinjau yang benar adalah bukti bahwa jalur impor yang dipilih membaca file sebagaimana mestinya; ini bukan alasan untuk menimpa sumber aslinya.
Untuk JSON, pertahankan file tersebut dan gunakan pengimpor yang memahami JSON daripada memperlakukannya sebagai CSV. [Spesifikasi RFC 8259 JSON](https://www.rfc-editor.org/rfc/rfc8259#section-8.1) mewajibkan UTF-8 untuk JSON yang dipertukarkan antar-sistem di luar ekosistem tertutup. Ini juga menjelaskan bahwa string JSON dapat mewakili karakter secara langsung atau dengan karakter escape. Melihat escape seperti `\\u263A` tidak serta-merta merupakan kerusakan; parser JSON seharusnya menafsirkan karakter escape yang valid. Jika JSON tidak valid atau pengimpor melaporkan kesalahan penguraian, hentikan proses dan simpan file persis apa adanya daripada menyunting tanda baca atau byte berdasarkan tebakan.
Memutuskan untuk mencoba lagi, mengekspor ulang, atau berhenti
Gunakan urutan ini: (1) bandingkan buku harian sumber dengan file ekspor; (2) periksa duplikat menggunakan encoding yang diharapkan dan tampilan UTF-8 jika sesuai; (3) periksa penampil lain untuk perilaku glif yang hilang; (4) tinjau pratinjau file melalui pengimpor CSV atau JSON yang benar; dan (5) coba ekspor ulang dengan encoding teks yang terdokumentasi jika sumber masih menampilkan emoji dengan benar. Ubah satu variabel pada satu waktu dan pisahkan setiap hasil.
Jika tidak ada tampilan atau pengimpor yang mengungkap karakter asli, dan file tersebut hanya berisi karakter pengganti atau data substitusi lainnya, jangan menjanjikan pemulihan dengan mengodekan ulang. Mengubah pengaturan decoding tidak dapat menyimpulkan emoji mana yang telah dibuang. Carilah ekspor lain, cadangan, atau entri buku harian yang utuh, lalu ekspor kembali ke file baru dan verifikasi pratinjaunya sebelum mengandalkannya.
