Como funciona a memória do ChatGPT

Como funciona a memória do ChatGPT: uma análise técnica aprofundada.

O ChatGPT pode responder como se o conhecesse — mas não é um modelo que o "aprendeu". A personalização acontece no momento da inferência: a memória relevante é recuperada e injetada na janela de contexto juntamente com o seu pedido, como uma nota oculta que o modelo lê antes de responder. Este guia percorre as duas camadas de memória, onde a memória reside, como é recuperada e porque o modelo nunca é treinado de novo para si.

Resposta rápida

A memória é recuperação + injeção, não retreino

O ChatGPT não afina um modelo privado com os seus dados. Armazena factos e sinais no servidor e, no momento em que envia um pedido, traz as partes relevantes para a janela de contexto do modelo para que a resposta seja condicionada por elas.

CamadaO que armazenaComo chega ao modelo
Memórias guardadasFactos explícitos e editáveis — nome, função, tom, preferências. Comportam-se como instruções personalizadas geridas automaticamente.As entradas relevantes são recuperadas e injetadas na janela de contexto.
Referência ao histórico de conversasPadrões implícitos das suas conversas anteriores (lançada a 10 de abril de 2025). Sem lista editável.Os sinais relevantes são adicionados ao contexto da mesma forma — mas não os pode ver nem editar.
O modelo baseOs pesos partilhados do modelo, idênticos para todos os utilizadores.Inalterado. Apenas lê a memória que for injetada como parte da entrada.

A implementação exata de recuperação e injeção é proprietária da OpenAI. Confirme sempre o comportamento atual na Memory FAQ da OpenAI.

Passo a passo

O que acontece da sua mensagem à resposta do modelo

Eis o pipeline conceptual. Os detalhes internos precisos não são publicados, mas a forma é consistente com a maneira como a personalização no momento da inferência funciona.

01

Um facto é captado

Enquanto conversa, o ChatGPT pode extrair um facto duradouro ("Sou vegetariano", "Giro uma pequena equipa") e escrevê-lo nas memórias guardadas — automaticamente, ou quando diz "remember this". Outras interações deixam apenas um vestígio no seu histórico de conversas.

02

É armazenado no servidor

Os factos guardados e o histórico ficam nos servidores da OpenAI, associados à sua conta — não no seu dispositivo. É por isso que a sua memória o acompanha entre dispositivos quando inicia sessão.

03

A recuperação seleciona o que é relevante

Quando envia um pedido, um passo de recuperação escolhe a memória que é relevante para esse pedido específico, em vez de carregar tudo. A janela de contexto finita limita a quantidade que pode ser trazida.

04

O modelo condiciona a sua resposta

A memória selecionada é injetada na janela de contexto como uma nota de sistema oculta. O modelo lê-a juntamente com a sua mensagem e responde como se "se lembrasse" de si — enquanto os seus pesos base permanecem exatamente iguais.

Perguntas comuns sobre a mecânica

Porque é que a memória se comporta como se comporta

PerguntaO que saber
Porque é que se atualiza instantaneamente?Porque nada é treinado de novo. Adicione ou elimine uma memória guardada e o próximo pedido simplesmente recupera o novo estado — não há um passo de treino do modelo pelo qual esperar.
Porque é que às vezes "esquece"?Um facto pode nunca ter sido guardado, a recuperação pode não tê-lo considerado relevante, a janela de contexto pode não ter tido espaço, ou a memória pode estar desativada. Veja memória não funciona.
Posso ver o que ele injeta?Pode ver a lista de memórias guardadas, mas não a camada de referência ao histórico de conversas nem a injeção exata por resposta. Veja as duas camadas comparadas.
Quanto consegue reter?A memória guardada tem uma capacidade finita e a janela de contexto limita o quanto é usado por resposta. Veja limites da memória.

Uma nota sobre arquitetura

Um modelo, um conjunto de servidores — ou muitos?

Como a injeção de memória liga o seu contexto pessoal aos servidores de um único fornecedor, tudo o que diz ao ChatGPT acumula-se num só lugar. Se preferir manter esse contexto distribuído por várias ferramentas — e decidir que modelo vê que pedido — um espaço de trabalho multimodelo permite-lhe fazê-lo, enquanto mantém os temas sensíveis em sessões sem memória.

Tudo num só

MultipleChat AI

multiplechat.ai

Use ChatGPT, Claude, Gemini e outros modelos num só lugar — escolha para onde vai cada pedido em vez de alimentar tudo a um único assistente.

Privacidade em primeiro lugar: O MultipleChat não guarda as suas conversas na memória e não partilha os seus dados com os fornecedores de modelos nem lhes permite treinar com eles. Outras opções focadas na privacidade incluem o Duck.ai, o Proton Lumo, o Brave Leo e o Kagi Assistant; para controlo local total, ferramentas auto-hospedadas como o Ollama ou o Jan mantêm tudo no seu dispositivo.

OpenAI

ChatGPT

chatgpt.com

Oferece Conversa Temporária (sem histórico, não usada para treino), uma opção de recusa de treino em Definições → Controlos de Dados e memória editável. Por predefinição, as conversas de consumidores podem ser usadas para melhorar os modelos, a menos que recuse — verifique no centro de ajuda da OpenAI.

Anthropic

Claude

claude.ai

A Anthropic dá-lhe controlos de dados e de treino e historicamente adotou uma postura atenta à privacidade nas conversas de consumidores, mas as suas definições de treino e retenção têm mudado ao longo do tempo — verifique as suas definições de privacidade atuais na aplicação.

Google

Gemini

gemini.google.com

A Atividade das Apps Gemini permite-lhe pausar o histórico e eliminar atividade anterior, mas conversas amostradas podem ser revistas por humanos, por isso evite partilhar informação confidencial. Reveja os seus controlos de Atividade.

Microsoft

Copilot

copilot.microsoft.com

O Microsoft 365 Copilot (empresarial) não usa os dados da sua organização para treinar modelos e acrescenta Proteção de Dados Empresariais; o Copilot para consumidores tem um painel de privacidade para rever e eliminar o seu histórico. Verifique as políticas atuais da Microsoft.

Perplexity

Perplexity

perplexity.ai

A Perplexity tem uma definição de "retenção de dados de IA" que pode desativar para que as suas pesquisas não sejam usadas para melhorar os seus modelos, além de controlos de dados ao nível da conta. Confirme as opções atuais nas definições.

FAQ

Como funciona a memória do ChatGPT — perguntas técnicas

A mecânica: recuperação, injeção, armazenamento e porque o modelo nunca é treinado de novo para si.

Como funciona tecnicamente a memória do ChatGPT?

A memória do ChatGPT funciona no momento da inferência, não através do treino do modelo. O ChatGPT mantém duas camadas de memória nos servidores da OpenAI: memórias guardadas (factos explícitos e editáveis) e referência ao histórico de conversas (sinais implícitos das suas conversas anteriores). Quando envia um pedido, um passo de recuperação seleciona a memória mais relevante para esse pedido e adiciona-a à janela de contexto do modelo juntamente com a sua mensagem, como uma nota de sistema oculta. O modelo condiciona então a sua resposta com base nesse contexto adicionado. A implementação exata é proprietária, por isso confirme os detalhes no centro de ajuda da OpenAI.

O modelo é treinado de novo para cada utilizador?

Não. Os pesos do modelo base não são alterados para utilizadores individuais. A personalização acontece no momento da inferência: as memórias guardadas relevantes e os sinais das conversas anteriores são injetados na janela de contexto com o seu pedido, para que o modelo os leia como parte da entrada. É por isso que a memória pode atualizar-se instantaneamente quando adiciona ou elimina um facto — nada no modelo subjacente é treinado de novo.

Quais são as duas camadas da memória do ChatGPT?

As memórias guardadas são factos explícitos que o ChatGPT armazena sobre si, como o seu nome, função e preferências. São auditáveis: pode ver, editar e eliminar cada um, e comportam-se como instruções personalizadas geridas automaticamente. A referência ao histórico de conversas, lançada a 10 de abril de 2025, é uma recuperação implícita de padrões das suas conversas anteriores; não tem lista visível e editável, apenas um interruptor. Ambas são controladas em Definições → Personalização → Memória.

Como é a memória adicionada à janela de contexto?

Conceptualmente, um sistema de recuperação escolhe as memórias guardadas e os sinais do histórico de conversas que são relevantes para o seu pedido atual e insere-os na janela de contexto do modelo, como uma nota de sistema adicional que o modelo pode ler mas que normalmente não vê. O modelo gera então a sua resposta condicionada tanto pela sua mensagem como por esse contexto injetado. O mecanismo preciso não é publicado pela OpenAI.

O ChatGPT recupera todas as minhas memórias de cada vez?

Não necessariamente. A recuperação destina-se a selecionar a memória que é relevante para o pedido atual, em vez de carregar tudo de uma só vez, e a janela de contexto tem um tamanho finito que limita a quantidade de memória que pode ser injetada. Essa é uma das razões pelas quais um facto armazenado nem sempre surge — pode não ter sido considerado relevante, ou pode não haver espaço para ele. O comportamento exato é proprietário, por isso verifique no centro de ajuda da OpenAI.

Onde é armazenada a memória do ChatGPT?

A memória é armazenada nos servidores da OpenAI e associada à sua conta, não guardada localmente no seu dispositivo. Isto significa que pode acompanhá-lo entre dispositivos quando inicia sessão, e que a sua gestão ou eliminação acontece através das definições da sua conta e não no dispositivo. Consulte a documentação da OpenAI para conhecer os detalhes atuais de armazenamento e retenção.

Como decide o ChatGPT o que guardar na memória?

Enquanto conversa, o ChatGPT pode extrair factos duradouros que pareçam valer a pena recordar — por exemplo, que é vegetariano ou que programa em Python — e escrevê-los automaticamente nas suas memórias guardadas. Também pode dizer explicitamente "remember this" para adicionar um facto. A lógica de seleção é proprietária, mas pode sempre rever o que foi guardado na lista de memórias guardadas e editá-lo ou eliminá-lo.

Porque é que o ChatGPT às vezes parece esquecer?

Vários motivos técnicos são possíveis: o facto relevante pode nunca ter sido guardado, a recuperação pode não tê-lo considerado relevante para o seu pedido, a janela de contexto pode não ter tido espaço para ele, ou a memória pode estar desativada. A capacidade da memória guardada também é finita, pelo que memórias mais antigas podem ser condensadas ou descartadas. Rever a lista de memórias guardadas mostra o que está efetivamente armazenado.

Posso ver a memória que o ChatGPT injeta numa conversa?

Pode ver a lista completa de memórias guardadas em Definições → Personalização → Memória, mas não pode ver a camada de referência ao histórico de conversas, que não tem lista visível. O contexto exato injetado em qualquer resposta não lhe é mostrado. Por isso, pode auditar as memórias explícitas, mas não os sinais implícitos nem a injeção precisa por mensagem.

A janela de contexto limita a quantidade de memória que o ChatGPT usa?

Sim. O modelo só consegue ler uma quantidade finita de texto de cada vez — a sua janela de contexto — e qualquer memória que seja injetada tem de caber dentro desse limite, juntamente com o seu pedido e a conversa. Este é um limite separado da quantidade de memória que pode armazenar no total, e é uma das razões pelas quais nem toda a memória armazenada é usada em cada resposta.