Metlivi Blog

Das Gedächtnis eines KI-Chat-Tools mit harmlosen Details testen

Wenn Sie möchten, dass sich ein KI-Chat-Tool zwischen Sitzungen an eine harmlose Präferenz erinnert, testen Sie ein kleines Detail in einem fiktiven Projekt und prüfen Sie anschließend, ob Sie es einsehen und entfernen können. Ein nützlicher Test unterscheidet das, was das Tool aus der aktuellen Konversation weiterträgt, von dem, was es für die spätere Verwendung speichert oder ableitet. Die Ergebnisse zeigen, wie sich dieses Tool zu diesem Zeitpunkt in Ihrem Konto verhalten hat; sie beweisen kein fehlerfreies Erinnerungsvermögen in jedem Chat.

24. September 20266 Min. LesezeitLesen, Kunst & KulturVon Metlivi Editorial Team
Abschnitt 1

Was bedeutet „Gedächtnis“ bei einem KI-Chat-Tool?

Ein Chat-Tool kann die Nachrichten in der Konversation, die Sie gerade führen, als Kontext verwenden. Das hilft ihm, auf frühere Details im selben Thread zu reagieren. Einige Tools können auch Informationen aus früheren Konversationen, gespeicherten Gedächtniseinträgen, benutzerdefinierten Anweisungen, Dateien oder verbundenen Diensten nutzen. Welche Quellen verfügbar sind, hängt vom Produkt und den Kontoeinstellungen ab.

Die Memory-FAQ von OpenAI unterscheidet zwischen gespeicherten Erinnerungen und Informationen, auf die aus dem Chat-Verlauf verwiesen wird. Gespeicherte Erinnerungen werden getrennt vom ursprünglichen Chat abgelegt, sodass das bloße Löschen eines Chats nicht zwangsläufig eine zugehörige gespeicherte Erinnerung löscht. Der Verweis auf den Chat-Verlauf kann, sofern verfügbar und aktiviert, auf relevante Informationen aus vergangenen Konversationen zurückgreifen. OpenAI weist außerdem darauf hin, dass Speicherfunktionen und Steuerelemente je nach Tarif, Region, Plattform und Workspace-Einstellungen variieren können.

Diese Unterschiede sind bei einem Kontinuitätstest von Bedeutung. Ein Tool scheint sich möglicherweise zu erinnern, weil die ursprüngliche Konversation noch offen ist, weil es auf einen früheren Chat verweisen kann oder weil es eine Erinnerung gespeichert hat. Diese Verhaltensweisen sind unterschiedlich, und eine einzelne erfolgreiche Antwort verrät Ihnen nicht, welche Quelle das Detail geliefert hat.

Abschnitt 2

Einen Test mit harmlosen Präferenzen durchführen

Verwenden Sie ein fiktives Projekt und eine unbedenkliche Präferenz, wie zum Beispiel: „Für mein fiktives Projekt ‚Paper Kite‘ bevorzuge ich kurze Namen für Entwurfsabschnitte.“ Verwenden Sie keine persönlichen, sensiblen oder vertraulichen Informationen. Das Ziel ist es, eine einfache Präferenz zu testen und nicht zu sehen, ob das Tool einen komplizierten Verlauf rekonstruieren kann.

Überprüfen Sie zuerst die Steuerelemente. Öffnen Sie die Speicher- oder Personalisierungseinstellungen des Tools. Notieren Sie, ob die Speicherfunktion verfügbar und aktiviert ist und was die Benutzeroberfläche darüber aussagt, was sie verwenden kann. Wenn Sie das Testdetail nicht speichern möchten, brechen Sie hier ab oder verwenden Sie einen Modus, den das Produkt als nicht personalisiert ausweist. OpenAI gibt an, dass der temporäre Chat keine Erinnerungen erstellt oder aktualisiert, obwohl Auswahlmöglichkeiten und Verfügbarkeit variieren können; siehe dazu die Hinweise zum temporären Chat.
Geben Sie die Präferenz einmal an. Formulieren Sie die fiktive Präferenz in einer neuen Konversation ganz klar. Wenn das Tool fragt, ob diese gespeichert werden soll, entscheiden Sie, ob Sie dies zulassen möchten. Vermeiden Sie zusätzliche Details, die die Interpretation des Ergebnisses erschweren.
Beenden Sie diese Konversation. Starten Sie einen separaten Chat, idealerweise ohne den ursprünglichen Austausch hineinzukopieren. Bitten Sie um eine kurze Reihe von Entwurfsabschnittsnamen für Paper Kite. Wiederholen Sie die Präferenz in Ihrer neuen Eingabeaufforderung nicht.
Beobachten Sie das Ergebnis und fragen Sie dann, woher das Detail stammt. Hat der Vorschlag Ihre Präferenz widergespiegelt? Wenn das Tool Speicherquellen oder eine Speicherzusammenfassung anbietet, prüfen Sie diese. Eine passende Antwort allein beweist noch nicht, dass eine gespeicherte Erinnerung die Ursache war; das Modell könnte geraten haben, oder das Produkt verwendet früheren Chat-Kontext.
Ändern oder entfernen Sie das Detail und testen Sie erneut. Korrigieren oder löschen Sie die Präferenz über die Ihnen zur Verfügung stehenden Steuerelemente. Wiederholen Sie die neutrale Anfrage in einem weiteren neuen Chat. Halten Sie fest, was sich geändert hat und was laut Benutzeroberfläche entfernt wurde. Betrachten Sie eine einzelne Antwort nicht als Beweis dafür, dass jede Kopie oder Quelle gelöscht wurde.
Abschnitt 3

Das Ergebnis ohne vorschnelle Schlüsse auswerten

Ein einfaches Protokoll sorgt dafür, dass der Test aussagekräftig bleibt:

Wenn das Tool die Präferenz übersieht, beweist das allein noch nicht, dass das Gedächtnis fehlerhaft ist: Der Speicher ist möglicherweise deaktiviert, nicht verfügbar, auf einen bestimmten Bereich beschränkt oder kann diese Quelle im neuen Chat nicht verwenden. Trifft es die Präferenz korrekt, zeigt dies nicht, dass es andere Details zuverlässig abrufen wird. Halten Sie das Fazit eng gefasst: „In dieser Konfiguration hat es diese Präferenz in einen neuen Chat übernommen (oder eben nicht).“

Für einen saubereren Test wiederholen Sie den Vorgang mit einer zweiten harmlosen Präferenz bei einem anderen fiktiven Projekt, wobei Sie jeweils nur eine Bedingung ändern. Vergleichen Sie beispielsweise einen normalen neuen Chat nur dann mit einem projektspezifischen Chat, wenn das Produkt erklärt, dass sich diese Kontexte unterschiedlich verhalten. Notieren Sie jedes Mal das Setup; andernfalls können unterschiedliche Einstellungen die Ergebnisse widersprüchlich erscheinen lassen.

Prüfpunkt: Setup; Zu notieren: Produkt, Kontokontext und ob die Speichersteuerung aktiviert war
Prüfpunkt: Testdetail; Zu notieren: Die von Ihnen angegebene fiktive Präferenz
Prüfpunkt: Ergebnis im neuen Chat; Zu notieren: Ob die Antwort die Präferenz widerspiegelte, ignorierte oder ihr widersprach
Prüfpunkt: Angezeigte Quelle; Zu notieren: Jeder Speichereintrag, vorherige Chat oder jede andere von der Benutzeroberfläche identifizierte Quelle
Prüfpunkt: Überprüfung der Steuerung; Zu notieren: Was Sie anzeigen, bearbeiten, deaktivieren oder löschen konnten
Prüfpunkt: Nachtest; Zu notieren: Was geschah, nachdem Sie das Detail geändert oder entfernt hatten
Abschnitt 4

Überprüfen, was Sie anzeigen, bearbeiten und löschen können

Bevor Sie sich auf das Gedächtnis verlassen, suchen Sie die tatsächlichen Steuerelemente des Tools und prüfen Sie drei separate Aktionen:

Lesen Sie den Wortlaut genau. In den FAQs von OpenAI heißt es beispielsweise, dass die Bitte an ChatGPT, etwas nicht zu erwähnen, zwar die Personalisierung ändert, die ursprüngliche Quelle jedoch nicht löscht. Zudem wird erklärt, dass das Entfernen gespeicherter Informationen möglicherweise das Löschen sowohl der gespeicherten Erinnerung als auch des Chats erfordert, in dem sie erstmals geteilt wurde; andere Quellen wie Dateien oder verbundene Apps erfordern möglicherweise separate Schritte. Das Deaktivieren einer Speicherfunktion ist nicht immer dasselbe wie das Löschen früherer Chats oder gespeicherter Details. Befolgen Sie die aktuellen Anweisungen in den Memory-FAQs des Produkts, da sich die verfügbaren Steuerelemente je nach Konto unterscheiden können.

Die Steuerelemente variieren auch je nach Chat-Tool. In der offiziellen FAQ von Tolan heißt es, dass Konversationen in der App protokolliert und zur Erstellung des Speichers verwendet werden, und es wird die Kontolöschung über die Profileinstellungen der App beschrieben. Das ist eine produktspezifische Beschreibung, keine allgemeine Regel für KI-Chat-Tools. Überprüfen Sie den Dienst, den Sie tatsächlich nutzen, anstatt davon auszugehen, dass die Speicher- und Löschsteuerelemente eines anderen Produkts gelten.

Anzeigen: Gibt es eine Liste, Zusammenfassung oder Quellenansicht, die zeigt, welche Informationen Antworten personalisieren können? Kann angezeigt werden, welche Quelle zu einer Antwort beigetragen hat?
Bearbeiten: Können Sie eine veraltete Präferenz korrigieren oder das Tool anweisen, sie nicht zu verwenden? Ändert dies nur die künftige Personalisierung oder auch die zugrundeliegende Quelle?
Löschen: Können Sie eine gespeicherte Erinnerung, die Konversation, in der Sie sie angegeben haben, und jede andere relevante Quelle separat entfernen? Was geschieht laut Produktangaben, wenn Sie das Gedächtnis deaktivieren?
Abschnitt 5

Ein praktischer Standard für Kontinuität und Kontrolle

Eine Speicherfunktion lässt sich leichter bewerten, wenn Sie einen kleinen Test durchführen, sehen können, welche Informationen möglicherweise verwendet werden, diese bei Fehlern korrigieren und einen klaren Weg finden, sie zu entfernen. Betrachten Sie das Ergebnis als Beleg für eine Präferenz in einem Setup, nicht als Versprechen eines verlässlichen Erinnerungsvermögens. Wenn die Steuerelemente nicht deutlich machen, was gespeichert wird oder wie es entfernt werden kann, vermeiden Sie es, Informationen im Gedächtnis abzulegen, bis Sie die aktuellen Hinweise des Produkts verstanden haben.

Die sinnvolle Frage lautet nicht einfach: „Erinnert sich dieses Chat-Tool?“ Sie lautet vielmehr: „Kann es eine unbedenkliche Präferenz in eine neue Konversation übertragen, kann ich sehen, was es verwendet hat, und kann ich diese Informationen über die mir zur Verfügung stehenden Steuerelemente ändern oder entfernen?“

Abschnitt 6

Quellen und Geltungsbereich

Die zitierten Quellen stützen die Definitionen und die eingrenzenden Hinweise. Bei den Beispielen handelt es sich um redaktionelle Veranschaulichungen; sich ändernde Produktdetails sollten auf den aktuellen offiziellen Seiten überprüft werden. Ein bestimmtes Ergebnis wird nicht zugesichert.

OpenAI Memory FAQ: https://help.openai.com/en/articles/8590148-memory-faq
OpenAI Temporary Chat FAQ: https://help.openai.com/en/articles/8914046-temporary-chat
Offizielle FAQ von Tolan: https://www.tolans.com/faq
Weitere Artikel

Dieses Thema weiter erkunden