Fehlerhafte Emojis in einer exportierten Tagebuchdatei diagnostizieren
Wenn Emojis in einem exportierten Tagebuch fehlerhaft dargestellt werden, stellen Sie zunächst fest, ob die Zeichen mit der falschen Kodierung dekodiert, beim Export ersetzt oder korrekt dekodiert wurden, aber von der App oder Schriftart nicht dargestellt werden können. Arbeiten Sie an einer Dateikopie, bewahren Sie die ursprünglichen Bytes auf und vergleichen Sie denselben Text in einem reinen Texteditor sowie im Tagebuch-Importprogramm. Das Ändern einer Kodierungseinstellung kann Dekodierungsfehler beheben; bereits ersetzte oder gelöschte Informationen lassen sich damit jedoch nicht wiederherstellen.
Erkennen, wie „Zeichensalat“ aussieht
Sehen Sie sich einen betroffenen Eintrag genau an. Eine Folge unerwarteter Zeichen wie `😀`, wo eigentlich 😀 stehen sollte, kann darauf hindeuten, dass UTF-8-Bytes mit einer anderen Kodierung interpretiert wurden. Dies wird gemeinhin als Mojibake bezeichnet: Die angezeigten Zeichen sind fehlerhaft, weil die Bytes unter falschen Annahmen dekodiert wurden. Es ist ein Indiz, aber kein Beweis dafür, welche Kodierung die Datei erzeugt hat.
Ein sichtbares `` ist etwas anderes. Das ist U+FFFD, das Ersetzungszeichen von Unicode, das als Ersatz für ein Zeichen verwendet wird, das nicht interpretiert werden kann. Das [Glossar](https://www.unicode.org/glossary/#replacement_character) von Unicode unterscheidet dies von einer Ersatzglyphe: Eine Schriftart oder Rendering-Engine zeigt möglicherweise ein Kästchen an, wenn sie ein Zeichen nicht zeichnen kann, während das zugrunde liegende Zeichen intakt sein kann. Wenn nur manche Emojis als Kästchen erscheinen, testen Sie eine andere moderne App oder Schriftart, bevor Sie die Kodierung der Datei ändern.
Vor der Fehlerbehebung eine Ausgangsbasis sichern
Erstellen Sie eine Kopie des Exports und lassen Sie das Original unverändert. Notieren Sie die Dateiendung, die exportierende App und den sichtbaren Inhalt für eine betroffene Textstelle. Vergleichen Sie nach Möglichkeit ein bekanntes Emoji aus dem Tagebuch mit demselben Eintrag in der Quell-App oder einem früheren Export. Vermeiden Sie es, die einzige Kopie wiederholt zu öffnen und zu speichern: Ein Texteditor schreibt neu dekodierten Text möglicherweise als Bytes zurück, wodurch ein reversibles Anzeigeexperiment dauerhaft gespeichert wird.
Öffnen Sie die Kopie als Klartext in einem Editor, bei dem Sie die Zeichenkodierung frei wählen können. Probieren Sie zuerst die von der Tagebuch-App dokumentierte Kodierung aus; ist sie unbekannt und handelt es sich um einen typischen modernen Textexport, ist UTF-8 ein sinnvoller Kandidat zur Überprüfung – aber keine Annahme, mit der das Original überschrieben werden sollte. Vergleichen Sie den betroffenen Text und die umgebenden Standardzeichen unter jedem Kandidaten. Ein konsistentes Ergebnis in der gesamten Datei ist ein stärkerer Beleg als ein einzelnes Emoji, das zufällig richtig aussieht.
Dekodierung testen, ohne die Datei zu überschreiben
Wenn durch das Ändern der Kodierungsansicht im Editor die seltsame Zeichenfolge zum erwarteten Emoji wird und auch der umgebende Text lesbar ist, enthält der Export möglicherweise intakte Bytes, die falsch interpretiert wurden. Bestätigen Sie dies, indem Sie die Kopie ohne Speichern schließen und mit der vielversprechenden Einstellung erneut öffnen. Prüfen Sie anschließend, ob der Import- oder Öffnen-Dialog der Tagebuch-App eine dokumentierte Kodierungsoption bietet; bevorzugen Sie diesen Arbeitsablauf für jeden tatsächlichen Neuimport.
Die [Unicode UTF FAQ](https://www.unicode.org/faq/utf_bom.html) erklärt, dass fehlerhafte UTF-8-Byte-Sequenzen einen Fehler auslösen oder durch einen Platzhalter wie U+FFFD behandelt werden können. Das bedeutet, dass ein Decoder ungültige Eingaben bereits beim Anzeigen oder Importieren ersetzt haben kann. Ein nachträgliches Wechseln der Kodierung stellt die ursprünglichen Bytes nicht zwingend wieder her. Nutzen Sie auf Ihrer einzigen Kopie keine „Reparatur“- oder Konvertierungsoptionen, die nicht dekodierbare Zeichen stillschweigend ersetzen.
Kodierungsprobleme von fehlenden Glyphen unterscheiden
Wird das Emoji in einem anderen Anzeigeprogramm korrekt dargestellt, halten Sie diesen Vergleich als Beleg fest, bevor Sie die Datei ändern. Vermeiden Sie es, den Export nur umzuschreiben, um das visuelle Erscheinungsbild anzupassen.
Wenn dieselbe Position in allen Programmen U+FFFD oder ein wörtliches Fragezeichen enthält, vergleichen Sie die Stelle mit dem Quelltagebuch oder einem früheren Export. Ein in der Datei gespeicherter Ersatz lässt sich nicht durch Wechseln der Schriftart wiederherstellen. Die Rettung hängt davon ab, ob das Zeichen in einer anderen Kopie noch vorhanden ist.
CSV und JSON als unterschiedliche Importpfade behandeln
Eine `.csv`-Dateiendung gibt keinen Aufschluss über die verwendete Zeichenkodierung, und Tabellenkalkulationsprogramme wenden unter Umständen eigene Importeinstellungen an. Für Excel Desktop dokumentiert Microsoft den Textimport über **Daten > Aus Text/CSV** sowie den Textkonvertierungs-Assistenten in seinem [Leitfaden zum Importieren und Exportieren von Text- und CSV-Dateien](https://support.microsoft.com/en-us/excel/get-started/import-or-export-text-txt-or-csv-files). Nutzen Sie die Vorschau vor dem Laden: Überprüfen Sie Emojis, Zeilen- und Spaltengrenzen sowie angrenzenden Text. Eine korrekte Vorschau belegt, dass der gewählte Importpfad die Datei wie vorgesehen liest; sie ist kein Grund, die Quelldatei zu überschreiben.
Bewahren Sie bei JSON die Datei unverändert auf und verwenden Sie einen JSON-fähigen Importer, anstatt sie wie eine CSV-Datei zu behandeln. Die [JSON-Spezifikation RFC 8259](https://www.rfc-editor.org/rfc/rfc8259#section-8.1) schreibt UTF-8 für JSON vor, das zwischen Systemen außerhalb eines geschlossenen Ökosystems ausgetauscht wird. Sie erklärt zudem, dass JSON-Strings Zeichen direkt oder als Escape-Sequenzen darstellen können. Eine Escape-Sequenz wie `\u263A` ist nicht automatisch eine Beschädigung; ein JSON-Parser sollte gültige Escape-Sequenzen interpretieren. Wenn das JSON ungültig ist oder der Importer einen Parsing-Fehler meldet, stoppen Sie den Vorgang und behalten Sie die exakte Datei bei, anstatt Satzzeichen oder Bytes auf gut Glück zu bearbeiten.
Entscheiden: Wiederholen, neu exportieren oder abbrechen
Nutzen Sie diese Reihenfolge: (1) Vergleichen Sie das Quelltagebuch mit dem Export; (2) überprüfen Sie ein Duplikat mit der erwarteten Kodierung und gegebenenfalls in einer UTF-8-Ansicht; (3) prüfen Sie ein anderes Anzeigeprogramm auf Anzeichen fehlender Glyphen; (4) prüfen Sie die Datei in der Vorschau des korrekten CSV- oder JSON-Importers; und (5) wiederholen Sie den Export mit einer dokumentierten Textkodierung, falls die Quelle die Emojis noch korrekt anzeigt. Ändern Sie jeweils nur eine Variable und halten Sie jedes Ergebnis separat fest.
Wenn keine Ansicht und kein Importer das ursprüngliche Zeichen anzeigt und die Datei nur Ersetzungszeichen oder andere Ersatzdaten enthält, versprechen Sie sich keine Rettung durch Neukodierung. Durch das Ändern von Dekodierungseinstellungen lässt sich nicht herleiten, welches Emoji verworfen wurde. Suchen Sie nach einem anderen Export, einem Backup oder dem intakten Tagebucheintrag, exportieren Sie dann erneut in eine neue Datei und überprüfen Sie deren Vorschau, bevor Sie sich darauf verlassen.
