Memória e contexto
Mantendo histórias longas coerentes além da janela de contexto.
Com a memória ativada, o trecho mais antigo de um chat longo é compactado em um resumo contínuo e sai do prompt. O uso de tokens fica estável conforme a história cresce.
O resumo roda em modelos gratuitos rápidos, em segundo plano, para você continuar conversando. O resumo atual acompanha a conversa em um bloco de sistema.
O chat recente é convertido em embeddings e comparado com mensagens antigas e candidatos de lore. As correspondências mais próximas são injetadas como contexto de fundo, então detalhes antigos reaparecem quando são relevantes.
Ativação opcional por conversa. Um classificador pequeno decide se sua mensagem precisa de fatos atualizados. Só então uma busca real roda e entra no contexto.
Motor e tamanho de contexto são configuráveis no painel de configurações. A busca na web está disponível em contas pagas.
Memória e busca na web são chaves por conversa na gaveta de configurações. Os presets guardam os padrões para chats novos. A configuração de modelo utilitário escolhe qual modelo faz o trabalho em segundo plano.