Modelos de linguagem são, por construção, sem estado: esquecem tudo quando a janela de contexto termina. A Engrama Labs desenvolve a camada de persistência e recuperação que falta — memória episódica com procedência, consolidação por recorrência e verificação de saída.
Recuperar por similaridade é resolvido. O que continua aberto é decidir o que merece ser guardado, com que granularidade, e como impedir que o próprio sistema contamine a própria memória. Trabalhamos em quatro frentes.
Fato durável e cena vivida exigem critérios opostos: um julga por permanência, outro por saliência. Separá-los é o que permite lembrar de um episódio sem transformar toda troca em lembrança.
Todo fato guarda a citação literal que o originou. Sem trecho verificável na conversa, o dado não entra — é a barreira contra o sistema inventar uma preferência e depois acreditar nela.
Cena recuperada repetidamente deixa de depender de busca e passa a estar sempre presente. Aproxima o comportamento do sistema da consolidação de memória em vez de um índice estático.
Seis eixos contínuos que decaem no tempo e se atualizam por avaliação da conversa, com piso e teto derivados do vínculo — e não do humor do momento.
Doze verificadores independentes examinam a resposta antes da publicação e podem devolvê-la para reescrita. Instrução no prompt falha silenciosamente; verificação da saída, não.
Cada limiar é medido contra conversa real, nunca escolhido a priori. O corte de recuperação semântica foi para 0.48 depois que 0.38 passou a recusar acertos legítimos.
Cada estágio é medido em produção. Os destacados fazem chamada de modelo; os âmbar podem rejeitar a resposta pronta e devolvê-la para reescrita.
Um sistema que guarda tudo com o mesmo peso não lembra de nada em particular. A hierarquia — e o critério de promoção de uma camada para a seguinte — é o objeto central da nossa pesquisa.
O que é verdade sobre a pessoa. Cada item guarda a citação que o originou e a data — sem procedência, não entra.
O que aconteceu, com data e a frase literal dita na hora. Exige raridade estrutural: sem isso toda troca vira lembrança.
A cena recuperada três vezes deixa de depender de busca. É a diferença entre lembrar quando o assunto puxa e simplesmente saber.
Depois da resposta publicada, oito processos assíncronos continuam: extração de memória · episódios · ficha · reflexão emocional · reflexão de segunda ordem · resumo · neutralização · mídia
Sistema de referência onde a arquitetura é validada em uso contínuo. Opera por WhatsApp desde 2026, com cronograma autônomo, iniciativa de conversa e recuperação de episódios a semanas de distância.