Engrama Labs
Pesquisa aplicada · São Carlos, Brasil

Memória de longo prazo para agentes conversacionais.

Modelos de linguagem são, por construção, sem estado: esquecem tudo quando a janela de contexto termina. A Engrama Labs desenvolve a camada de persistência e recuperação que falta — memória episódica com procedência, consolidação por recorrência e verificação de saída.

turno #4821 · em curso whatsapp
    total 0.00s 0 chamadas de modelo
    3
    camadas de memória
    12
    verificadores de saída
    1536
    dimensões por vetor
    972
    casos de teste
    1
    sistema em operação
    Linhas de pesquisa

    O problema não é gerar. É lembrar
    o que importa, e só o que importa.

    Recuperar por similaridade é resolvido. O que continua aberto é decidir o que merece ser guardado, com que granularidade, e como impedir que o próprio sistema contamine a própria memória. Trabalhamos em quatro frentes.

    01

    Granularidade da memória

    Fato durável e cena vivida exigem critérios opostos: um julga por permanência, outro por saliência. Separá-los é o que permite lembrar de um episódio sem transformar toda troca em lembrança.

    02

    Procedência e evidência

    Todo fato guarda a citação literal que o originou. Sem trecho verificável na conversa, o dado não entra — é a barreira contra o sistema inventar uma preferência e depois acreditar nela.

    03

    Consolidação por recorrência

    Cena recuperada repetidamente deixa de depender de busca e passa a estar sempre presente. Aproxima o comportamento do sistema da consolidação de memória em vez de um índice estático.

    04

    Estado afetivo persistente

    Seis eixos contínuos que decaem no tempo e se atualizam por avaliação da conversa, com piso e teto derivados do vínculo — e não do humor do momento.

    05

    Verificação de saída

    Doze verificadores independentes examinam a resposta antes da publicação e podem devolvê-la para reescrita. Instrução no prompt falha silenciosamente; verificação da saída, não.

    06

    Calibração empírica

    Cada limiar é medido contra conversa real, nunca escolhido a priori. O corte de recuperação semântica foi para 0.48 depois que 0.38 passou a recusar acertos legítimos.

    Método · arquitetura de um turno

    Catorze estágios instrumentados

    Cada estágio é medido em produção. Os destacados fazem chamada de modelo; os âmbar podem rejeitar a resposta pronta e devolvê-la para reescrita.

    01sinais
    02memórias
    03episódios
    04entendimento
    05política
    06atriz
    07validação
    08revalidação
    09direito de turno
    10reescrita
    11tamanho
    12integridade
    13int. reescrita
    14int. revisão
    chamada de modelo porteiro: pode recusar e devolver recuperação local
    Recuperação semânticacosseno
    0.203"fazendo café de manhã"
    0.391"deitada de madrugada"
    0.403"no ônibus pro trabalho"
    0.462"uma selfie sorrindo"
    0.641"segurando um gato" — recusa
    corte0.48 / 0.60 calibrado
    Estado afetivopersistente
    likingvínculo, com piso e teto
    patiencedecai e se recupera
    interessemeia-vida exponencial
    valencehumor do momento
    arousalativação
    affectionafeto acumulado
    Modelo de memória

    Três camadas, e a promoção entre elas

    Um sistema que guarda tudo com o mesmo peso não lembra de nada em particular. A hierarquia — e o critério de promoção de uma camada para a seguinte — é o objeto central da nossa pesquisa.

    01 · SEMÂNTICA

    Fatos

    O que é verdade sobre a pessoa. Cada item guarda a citação que o originou e a data — sem procedência, não entra.

    02 · EPISÓDICA

    Cenas

    O que aconteceu, com data e a frase literal dita na hora. Exige raridade estrutural: sem isso toda troca vira lembrança.

    03 · CANON

    História

    A cena recuperada três vezes deixa de depender de busca. É a diferença entre lembrar quando o assunto puxa e simplesmente saber.

    Depois da resposta publicada, oito processos assíncronos continuam: extração de memória · episódios · ficha · reflexão emocional · reflexão de segunda ordem · resumo · neutralização · mídia

    Nina
    Nina · em operação
    Sistema em operação

    Nina

    Sistema de referência onde a arquitetura é validada em uso contínuo. Opera por WhatsApp desde 2026, com cronograma autônomo, iniciativa de conversa e recuperação de episódios a semanas de distância.

    canalWhatsApp, sem aplicativo
    memóriasemântica + episódica + canon
    vida própriacronograma horário
    Conhecer Nina