Wie das ChatGPT-Gedächtnis funktioniert

Wie das ChatGPT-Gedächtnis funktioniert: ein technischer Deep Dive.

ChatGPT kann antworten, als würde es Sie kennen – aber es ist kein Modell, das Sie „gelernt“ hat. Die Personalisierung erfolgt zur Inferenzzeit: relevantes Gedächtnis wird abgerufen und zusammen mit Ihrem Prompt in das Kontextfenster eingefügt, wie eine verborgene Notiz, die das Modell liest, bevor es antwortet. Dieser Leitfaden führt durch die zwei Gedächtnisebenen, wo das Gedächtnis liegt, wie es abgerufen wird und warum das Modell niemals für Sie neu trainiert wird.

Schnelle Antwort

Gedächtnis ist Abruf + Einfügen, nicht Neutraining

ChatGPT trainiert kein privates Modell mit Ihren Daten nach. Es speichert Fakten und Signale serverseitig und zieht dann, in dem Moment, in dem Sie einen Prompt senden, die relevanten Teile in das Kontextfenster des Modells, sodass die Antwort an ihnen ausgerichtet ist.

EbeneWas sie speichertWie sie das Modell erreicht
Gespeicherte ErinnerungenExplizite, bearbeitbare Fakten – Name, Rolle, Tonfall, Präferenzen. Verhalten sich wie automatisch verwaltete benutzerdefinierte Anweisungen.Relevante Einträge werden abgerufen und in das Kontextfenster eingefügt.
Bezug auf den ChatverlaufImplizite Muster aus Ihren früheren Gesprächen (eingeführt am 10. April 2025). Keine bearbeitbare Liste.Relevante Signale werden auf dieselbe Weise dem Kontext hinzugefügt – aber Sie können sie nicht sehen oder bearbeiten.
Das BasismodellDie gemeinsamen Modellgewichte, für jeden Nutzer identisch.Unverändert. Es liest schlicht, welches Gedächtnis als Teil der Eingabe eingefügt wird.

Die genaue Implementierung von Abruf und Einfügen ist proprietär bei OpenAI. Bestätigen Sie das aktuelle Verhalten stets in OpenAIs Memory-FAQ.

Schritt für Schritt

Was von Ihrer Nachricht bis zur Antwort des Modells geschieht

Hier ist die konzeptionelle Pipeline. Die genauen internen Abläufe sind nicht veröffentlicht, aber die Grundform entspricht der Funktionsweise der Personalisierung zur Inferenzzeit.

01

Ein Fakt wird erfasst

Während Sie chatten, kann ChatGPT einen dauerhaften Fakt extrahieren („Ich bin Vegetarier“, „Ich leite ein kleines Team“) und ihn in die gespeicherten Erinnerungen schreiben – automatisch oder wenn Sie „Merke dir das“ sagen. Andere Interaktionen hinterlassen lediglich eine Spur in Ihrem Chatverlauf.

02

Es wird serverseitig gespeichert

Gespeicherte Fakten und der Verlauf werden auf den Servern von OpenAI vorgehalten, mit Ihrem Konto verknüpft – nicht auf Ihrem Gerät. Deshalb folgt Ihnen Ihr Gedächtnis über mehrere Geräte hinweg, wenn Sie sich anmelden.

03

Der Abruf wählt das Relevante aus

Wenn Sie einen Prompt senden, wählt ein Abrufschritt das Gedächtnis aus, das für genau diesen Prompt relevant ist, statt alles zu laden. Das endliche Kontextfenster begrenzt, wie viel herangezogen werden kann.

04

Das Modell richtet seine Antwort aus

Das ausgewählte Gedächtnis wird wie eine verborgene Systemnotiz in das Kontextfenster eingefügt. Das Modell liest es zusammen mit Ihrer Nachricht und antwortet, als würde es sich an Sie „erinnern“ – während seine Basisgewichte exakt gleich bleiben.

Häufige Fragen zur Funktionsweise

Warum sich das Gedächtnis so verhält, wie es sich verhält

FrageWas Sie wissen sollten
Warum aktualisiert es sich sofort?Weil nichts neu trainiert wird. Fügen Sie eine gespeicherte Erinnerung hinzu oder löschen Sie sie, und der nächste Prompt ruft einfach den neuen Stand ab – es gibt keinen Trainingsschritt des Modells, auf den man warten müsste.
Warum „vergisst“ es manchmal?Ein Fakt wurde möglicherweise nie gespeichert, der Abruf hat ihn vielleicht nicht als relevant eingestuft, das Kontextfenster hatte möglicherweise keinen Platz, oder das Gedächtnis ist aus. Siehe Gedächtnis funktioniert nicht.
Kann ich sehen, was es einfügt?Sie können die Liste der gespeicherten Erinnerungen ansehen, aber nicht die Ebene des Bezugs auf den Chatverlauf und nicht die genaue Einfügung pro Antwort. Siehe die zwei Ebenen im Vergleich.
Wie viel kann es fassen?Das gespeicherte Gedächtnis hat eine endliche Kapazität, und das Kontextfenster begrenzt, wie viel pro Antwort verwendet wird. Siehe Gedächtnisgrenzen.

Eine Anmerkung zur Architektur

Ein Modell, ein Satz Server – oder viele?

Da das Einfügen des Gedächtnisses Ihren persönlichen Kontext an die Server eines einzigen Anbieters bindet, sammelt sich alles, was Sie ChatGPT mitteilen, an einem Ort an. Wenn Sie diesen Kontext lieber über mehrere Tools verteilen möchten – und entscheiden möchten, welches Modell welchen Prompt sieht – ermöglicht Ihnen ein Multi-Modell-Arbeitsbereich genau das, während Sie sensible Themen in gedächtnisfreien Sitzungen halten.

Alles in einem

MultipleChat AI

multiplechat.ai

Nutzen Sie ChatGPT, Claude, Gemini und andere Modelle an einem Ort – wählen Sie, wohin jede Eingabe geht, statt alles einem einzigen Assistenten zu überlassen.

Datenschutz zuerst: MultipleChat speichert Ihre Chats nicht im Gedächtnis und gibt Ihre Daten weder an die Modellanbieter weiter noch lässt es sie damit trainieren. Weitere datenschutzorientierte Optionen sind Duck.ai, Proton Lumo, Brave Leo und Kagi Assistant; für volle lokale Kontrolle behalten selbst gehostete Tools wie Ollama oder Jan alles auf Ihrem Gerät.

OpenAI

ChatGPT

chatgpt.com

Bietet temporären Chat (kein Verlauf, nicht für das Training verwendet), eine Trainings-Abwahl unter Einstellungen → Datenkontrollen und ein bearbeitbares Gedächtnis. Standardmäßig können Verbraucher-Chats zur Verbesserung der Modelle verwendet werden, sofern Sie dies nicht abwählen – überprüfen Sie dies im Hilfecenter von OpenAI.

Anthropic

Claude

claude.ai

Anthropic bietet Ihnen Daten- und Trainingskontrollen und hat bei Verbraucher-Chats historisch eine datenschutzbewusste Haltung eingenommen, doch die Trainings- und Aufbewahrungseinstellungen haben sich im Laufe der Zeit geändert – prüfen Sie Ihre aktuellen Datenschutzeinstellungen in der App.

Google

Gemini

gemini.google.com

Mit der Gemini-Apps-Aktivität können Sie den Verlauf pausieren und vergangene Aktivitäten löschen, doch stichprobenartig ausgewählte Unterhaltungen können von Menschen überprüft werden – teilen Sie daher keine vertraulichen Informationen. Überprüfen Sie Ihre Aktivitätseinstellungen.

Microsoft

Copilot

copilot.microsoft.com

Microsoft 365 Copilot (für Unternehmen) verwendet die Daten Ihrer Organisation nicht zum Trainieren von Modellen und bietet zusätzlich Enterprise Data Protection; der Verbraucher-Copilot verfügt über ein Datenschutz-Dashboard, um Ihren Verlauf zu überprüfen und zu löschen. Prüfen Sie die aktuellen Microsoft-Richtlinien.

Perplexity

Perplexity

perplexity.ai

Perplexity verfügt über eine Einstellung zur "KI-Datenaufbewahrung", die Sie deaktivieren können, damit Ihre Suchanfragen nicht zur Verbesserung der Modelle verwendet werden, sowie über Datenkontrollen auf Kontoebene. Bestätigen Sie die aktuellen Optionen in den Einstellungen.

FAQ

Wie das ChatGPT-Gedächtnis funktioniert – technische Fragen

Die Mechanik: Abruf, Einfügen, Speicherung und warum das Modell niemals für Sie neu trainiert wird.

Wie funktioniert das ChatGPT-Gedächtnis technisch?

Das ChatGPT-Gedächtnis arbeitet zur Inferenzzeit, nicht durch ein Neutraining des Modells. ChatGPT hält zwei Gedächtnisebenen auf den Servern von OpenAI vor: gespeicherte Erinnerungen (explizite, bearbeitbare Fakten) und den Bezug auf den Chatverlauf (implizite Signale aus Ihren früheren Chats). Wenn Sie einen Prompt senden, wählt ein Abrufschritt die für diesen Prompt relevantesten Erinnerungen aus und fügt sie zusammen mit Ihrer Nachricht in das Kontextfenster des Modells ein, wie eine verborgene Systemnotiz. Das Modell richtet seine Antwort dann an diesem zusätzlichen Kontext aus. Die genaue Implementierung ist proprietär, prüfen Sie Details daher im Hilfecenter von OpenAI.

Wird das Modell für jeden Nutzer neu trainiert?

Nein. Die Gewichte des Basismodells werden für einzelne Nutzer nicht verändert. Die Personalisierung erfolgt zur Inferenzzeit: relevante gespeicherte Erinnerungen und Signale aus früheren Gesprächen werden zusammen mit Ihrem Prompt in das Kontextfenster eingefügt, sodass das Modell sie als Teil der Eingabe liest. Deshalb kann sich das Gedächtnis sofort aktualisieren, wenn Sie einen Fakt hinzufügen oder löschen – am zugrunde liegenden Modell wird nichts neu trainiert.

Was sind die zwei Ebenen des ChatGPT-Gedächtnisses?

Gespeicherte Erinnerungen sind explizite Fakten, die ChatGPT über Sie speichert, etwa Ihren Namen, Ihre Rolle und Ihre Präferenzen. Sie sind nachvollziehbar: Sie können jede einzelne ansehen, bearbeiten und löschen, und sie verhalten sich wie automatisch verwaltete benutzerdefinierte Anweisungen. Der Bezug auf den Chatverlauf, eingeführt am 10. April 2025, ist ein impliziter Rückgriff auf Muster aus Ihren früheren Gesprächen; er hat keine sichtbare, bearbeitbare Liste, nur einen Schalter. Beide werden unter Einstellungen → Personalisierung → Gedächtnis gesteuert.

Wie wird das Gedächtnis in das Kontextfenster eingefügt?

Konzeptionell wählt ein Abrufsystem die gespeicherten Erinnerungen und Chatverlaufs-Signale aus, die für Ihren aktuellen Prompt relevant sind, und fügt sie in das Kontextfenster des Modells ein, wie eine zusätzliche Systemnotiz, die das Modell lesen kann, Sie aber in der Regel nicht sehen. Das Modell erzeugt seine Antwort dann ausgerichtet sowohl an Ihrer Nachricht als auch an diesem eingefügten Kontext. Der genaue Mechanismus wird von OpenAI nicht veröffentlicht.

Ruft ChatGPT jedes Mal alle meine Erinnerungen ab?

Nicht zwangsläufig. Der Abruf soll Erinnerungen auswählen, die für den aktuellen Prompt relevant sind, statt alles auf einmal zu laden, und das Kontextfenster hat eine endliche Größe, die begrenzt, wie viel Gedächtnis eingefügt werden kann. Das ist ein Grund, weshalb ein gespeicherter Fakt nicht immer auftaucht – er wurde möglicherweise nicht als relevant eingestuft, oder es war kein Platz dafür. Das genaue Verhalten ist proprietär, prüfen Sie es daher im Hilfecenter von OpenAI.

Wo wird das ChatGPT-Gedächtnis gespeichert?

Das Gedächtnis wird auf den Servern von OpenAI gespeichert und ist mit Ihrem Konto verknüpft, nicht lokal auf Ihrem Gerät. Das bedeutet, dass es Ihnen über mehrere Geräte hinweg folgen kann, wenn Sie sich anmelden, und dass die Verwaltung oder Löschung über Ihre Kontoeinstellungen erfolgt statt auf dem Gerät. Sehen Sie in der Dokumentation von OpenAI nach, um aktuelle Details zu Speicherung und Aufbewahrung zu erhalten.

Wie entscheidet ChatGPT, was im Gedächtnis gespeichert wird?

Während Sie chatten, kann ChatGPT dauerhafte Fakten extrahieren, die es wert scheinen, gespeichert zu werden – zum Beispiel, dass Sie Vegetarier sind oder dass Sie in Python programmieren – und sie automatisch in Ihre gespeicherten Erinnerungen schreiben. Sie können auch ausdrücklich „Merke dir das“ sagen, um einen Fakt hinzuzufügen. Die Auswahllogik ist proprietär, aber Sie können stets überprüfen, was in der Liste der gespeicherten Erinnerungen gespeichert wurde, und es bearbeiten oder löschen.

Warum scheint ChatGPT manchmal etwas zu vergessen?

Mehrere technische Gründe sind möglich: Der relevante Fakt wurde möglicherweise nie gespeichert, der Abruf hat ihn vielleicht nicht als relevant für Ihren Prompt eingestuft, das Kontextfenster hatte möglicherweise keinen Platz dafür, oder das Gedächtnis ist ausgeschaltet. Die Kapazität für gespeicherte Erinnerungen ist ebenfalls endlich, sodass ältere Erinnerungen verdichtet oder verworfen werden können. Ein Blick in die Liste der gespeicherten Erinnerungen zeigt, was tatsächlich gespeichert ist.

Kann ich sehen, welches Gedächtnis ChatGPT in einen Chat einfügt?

Sie können die vollständige Liste der gespeicherten Erinnerungen unter Einstellungen → Personalisierung → Gedächtnis sehen, aber Sie können die Ebene des Bezugs auf den Chatverlauf nicht sehen, da diese keine sichtbare Liste hat. Der genaue eingefügte Kontext für eine bestimmte Antwort wird Ihnen nicht angezeigt. Sie können also die expliziten Erinnerungen prüfen, nicht aber die impliziten Signale oder die genaue Einfügung pro Nachricht.

Begrenzt das Kontextfenster, wie viel Gedächtnis ChatGPT nutzt?

Ja. Das Modell kann nur eine endliche Menge an Text auf einmal lesen – sein Kontextfenster – und jegliches eingefügte Gedächtnis muss zusammen mit Ihrem Prompt und dem Gespräch in dieses Budget passen. Dies ist eine andere Grenze als die, wie viel Gedächtnis Sie insgesamt speichern können, und es ist ein Grund, weshalb nicht das gesamte gespeicherte Gedächtnis in jeder Antwort verwendet wird.