Skip to content

perf(caveman): melhorias no modo caveman e otimizações gerais #1104

Description

@ElioNeto

Melhorias no Modo Caveman e Otimizações Gerais

Motivação

O modo Caveman permite que o agente se comunique com poucos tokens, reduzindo custos e latência. Precisamos melhorá-lo e também aplicar otimizações gerais identificadas durante a análise de performance.

Propostas

Melhorias no Caveman

  • Implementar níveis mais granulares de compressão (lite, medium, full, ultra)
  • Preservar nomes de arquivo, comandos e identificadores mesmo em ultra
  • Dicionário de abreviações configurável por projeto
  • Modo "caveman treinado" — aprende padrões de comunicação do usuário
  • Reconstrução inteligente: expandir abreviações na saída para o usuário
  • Métricas de economia (tokens economizados vs. loss de informação)

Otimizações Gerais

  • Revisar uso de structuredClone em caminhos quentes (ex: processor.ts, compaction.ts)
  • Reduzir alocações desnecessárias no loop principal de mensagens
  • Cache de snapshot diffs entre steps consecutivos
  • Lazy loading de parts na paginação de mensagens
  • Pool de conexões para providers (reutilizar HTTP client)
  • Revisar JSON.parse/JSON.stringify em caminhos críticos (ex: sync events)
  • Profile de startup: identificar e reduzir init síncrono desnecessário

Memória

  • Limitar retenção de partes de ferramentas na memória após compactação
  • GC proativo para snapshots antigos
  • Stream de mensagens com backpressure

Critérios de Aceite

  • Modo caveman ultra reduz tokens em 70%+ vs full
  • Identificadores e paths são sempre preservados
  • Sem regression de performance nos modos não-caveman
  • Testes de compressão/descompressão
  • Benchmark de economia de tokens

Metadata

Metadata

Assignees

No one assigned

    Labels

    enhancementNew feature or request

    Projects

    No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions