Visão geral
O Hermes Knowledge Engine (HKE) é um Institutional Memory Compiler: sua única responsabilidade é transformar um arquivo MBOX em representação estrutural compilada, determinística e auditável. A mesma entrada sempre produz a mesma saída — não há IA, LLM, embeddings ou modelos estatísticos em nenhuma etapa da compilação.
O que o HKE não é
Para deixar o escopo claro, o HKE explicitamente não é:
| Não é | Por quê |
|---|---|
| Sistema RAG | Compilação é diferente de recuperação acoplada a geração |
| Mecanismo de busca | Busca é responsabilidade do Hermes (Retriever) |
| Indexador de e-mails | O HKE materializa estruturas em camadas representacionais |
| Banco de e-mails | O PostgreSQL é persistência — não identidade do projeto |
| Sistema baseado em IA | IA não compila — só consome a memória já compilada |
Arquitetura em camadas
O compilador é organizado em camadas, cada uma resolvendo um único nível de abstração — nenhuma camada tenta compreender um e-mail inteiro de uma vez. O entendimento completo da memória institucional emerge da composição de todas as camadas.
| Camada | Nome | Status |
|---|---|---|
| 0 | Extractor estrutural (RIR) | Congelada |
| 1 | Communication Graph Builder (CIR) | Congelada |
| 2 | Context Builder (CTXR) | Implementada |
| 3–9 | Entity / Relationship / Event / … / Schema | Planejadas |
"Congelada" quer dizer que o algoritmo e o contrato daquela camada estão travados — evolução futura acontece só nas camadas seguintes, nunca reabrindo uma camada já congelada. A Camada 2 já tem duas versões em paralelo: uma versão padrão e uma versão opcional com retomada de execução após interrupções (resumable), usada para cargas de trabalho longas.
Princípios
| Princípio | Regra |
|---|---|
| Compilador, não busca | O HKE compila memória — não recupera respostas para perguntas |
| Determinismo total | Compilação sem IA — os resultados são sempre reprodutíveis |
| Camada única | Cada camada resolve um único nível de abstração |
| Multi-pass convergente | Quantas passagens forem necessárias, até não haver mais mudanças |
| Qualidade acima de tempo | Dezenas de passagens são aceitáveis se garantirem qualidade |
| Algoritmo define o banco | O schema emerge da descoberta — nunca é pré-definido |
| Acervo imutável | O MBOX de origem nunca é alterado |
| Auditabilidade | Toda descoberta é rastreável até a fonte original |
Fronteira com o Hermes
O HKE e o Hermes são projetos separados, sem comunicação em tempo de execução entre eles. A fronteira entre os dois é o banco de dados: o HKE compila e exporta a memória institucional; o Hermes consome essa memória através de um Retriever para responder perguntas com IA. Nada do que o HKE faz depende do Hermes, e o Hermes nunca reprocessa arquivos MBOX diretamente.
| HKE | Hermes | |
|---|---|---|
| Papel | Compilar evidências em estruturas | Interpretar estruturas para quem pergunta |
| Uso de IA | Proibido na compilação | LLM na fase de resposta |
| Produz | Representação intermediária, agrupamentos, rastreabilidade | Significado, respostas, explicações |
Privacidade e governança
O HKE classifica a sensibilidade do conteúdo como metadado durante a compilação, mas não aplica políticas de acesso, anonimização ou LGPD — essa responsabilidade é do Hermes e da governança institucional que o rodeia, através de um componente de capacidades separado que decide o que pode ou não ser exposto em cada contexto. O HKE preserva a informação da fonte de forma estruturada; quem decide o que é seguro mostrar é uma camada posterior, fora do escopo do compilador.
