Sessoes e Memoria

Sessoes

Como as Sessoes Funcionam

Toda conversa com um agente acontece em uma sessao. Sessoes sao identificadas por chaves que codificam o contexto -- qual agente, qual canal, qual chat.

Sessoes mantem uma transcricao completa (JSONL append-only) de todas as mensagens, chamadas de ferramentas e resultados. Esta transcricao e o que da contexto aos agentes sobre a conversa em andamento.

Chaves de Sessao

Sessoes sao roteadas automaticamente com base no contexto:

Padrao Significado
agent:main:main Conversa direta principal
agent:<id>:<channel>:group:<id> Chat de grupo em um canal especifico
agent:<id>:<channel>:channel:<id> Conversa de canal/sala
cron:<jobId> Execucao de job agendado
hook:<uuid> Execucao acionada por webhook

Ciclo de Vida da Sessao

Rastreamento de Tokens

Sessoes rastreiam uso acumulado de tokens (entrada, saida, leitura de cache, escrita de cache) para monitoramento de custos e gestao de janela de contexto.


Compactacao

O Que E Compactacao?

Quando uma conversa se aproxima do limite da janela de contexto do modelo, Neotask a compacta -- resumindo mensagens antigas em uma visao geral condensada e iniciando uma nova sessao com esse resumo mais mensagens recentes.

Como Funciona

  1. Deteccao -- Monitora uso de contexto (gatilho padrao: 80% da janela de contexto)
  2. Sumarizacao -- Mensagens antigas sao resumidas em uma entrada de compactacao
  3. Nova sessao -- Uma sessao nova comeca com o resumo injetado no topo
  4. Preservacao -- Transcricoes antigas sao preservadas para historico mas nao mais carregadas no contexto

Configuracao

Compactacao Manual

Voce pode acionar compactacao manualmente a qualquer momento com o comando /compact. Isso e util quando voce quer resetar o contexto sem perder informacoes importantes.


Memoria

Memoria do Agente

Cada agente tem um sistema de memoria para persistir informacoes importantes entre sessoes:

Busca Vetorial

Neotask suporta busca por similaridade vetorial sobre a memoria do agente:

  1. Indexacao -- Arquivos de memoria sao indexados usando embeddings
  2. Busca -- Agentes consultam a memoria com linguagem natural ("O que o usuario disse sobre suas preferencias de API?")
  3. Recuperacao -- Memorias relevantes sao retornadas classificadas por similaridade

Plugin de Memoria (LanceDB)

O plugin de memoria LanceDB fornece armazenamento vetorial avancado:

Recuperacao Automatica

No inicio da sessao, memorias relevantes podem ser automaticamente recuperadas e injetadas no contexto do agente. Isso da continuidade aos agentes entre sessoes sem carregar historicos inteiros de conversa.


Persistencia de Sessao

Todos os dados de sessao sao armazenados localmente:

Limpeza