Dados

Da fonte à decisão,
em três camadas.

Cada conector é definido por configuração declarativa, não por código. O dado bruto é preservado de forma imutável, o que permite reprocessar quando uma regra de negócio muda, em vez de perder histórico.

Conectores

592 sistemas no catálogo de integração.

Um formulário de credenciais, o armazenamento do segredo em cofre, sincronização incremental e reprocessamento seguro. A partir da ativação, os dados passam a ser carregados na camada unificada.

592no catálogo
107curados por domínio
59certificados
10em produção na Luby
4desenvolvidos pela Luby

Fontes em produção

  • HubSpot
  • Jira
  • InHire
  • Google Drive
  • Gmail / Workspace
  • Google Calendar
  • Google Analytics 4
  • Trello
  • LinkedIn Ads
  • LinkedIn Pages
  • Instagram

HubSpot, Jira, InHire e Google Calendar são conectores desenvolvidos internamente, por exigirem tratamento específico de paginação, controle de cursor e volume que um conector genérico não contempla.

Catálogo curado, por domínio

  • Ads & Marketing · 15
  • Dev & Projetos · 14
  • Finanças / ERP · 12
  • Bancos & BI · 11
  • CRM & Vendas · 10
  • Comunicação · 9
  • Social & Conteúdo · 8
  • E-commerce · 7
  • Arquivos & Storage · 6
  • Analytics de produto · 5
  • RH / ATS · 5
  • Suporte · 4

O motor de ingestão utiliza licenças open source permissivas em todo o caminho crítico. Não há restrição contratual à revenda do produto nem à oferta de conectores aos seus próprios clientes.

Pipelines de normalização

Bruto, normalizado e consolidado.

Bruto

O conteúdo exatamente como foi recebido da fonte, particionado por cliente e por origem, em formato imutável e incremental. Reexecutar uma sincronização não duplica registros, e as versões anteriores permanecem disponíveis.

Normalizado

Entidades canônicas, idempotentes por origem. É a camada das chaves de identidade — documentos com validação de dígito verificador, endereços de e-mail normalizados, telefones em formato internacional e perfis profissionais. As mesmas regras são aplicadas na transformação e nos testes.

Consolidado

Tabelas servidas pela plataforma, com isolamento por cliente aplicado no banco de dados: CRM, talentos e projetos. É a camada que os aplicativos e a busca consultam, com um registro por origem e recarga sem duplicação.

Resolução de identidades como domínio próprio

Aproximadamente 70% do esforço de unificação consiste em determinar que dois registros representam a mesma entidade. A plataforma trata isso com modelo de dados dedicado: candidatos a unificação, procedência por campo, sobreposição manual com histórico e reversão completa.

O aplicativo Auditoria de Dados permite que um especialista revise e classifique os pares, calibrando o modelo. As regras de precedência são explícitas: prevalece o sistema responsável pelo campo, campos vazios são completados por fontes complementares, e a decisão humana prevalece sobre ambas, com data e autor registrados.

Completude verificada, não presumida

Uma sincronização não é considerada bem-sucedida quando a quantidade de registros carregados é inferior à contagem apurada na própria origem. A divergência interrompe o processo e sinaliza a falha, em vez de registrar conclusão com dados parciais.

O aplicativo de Data Lake apresenta a contagem, o marcador de posição e o histórico completo de cada execução, permitindo auditar o que foi carregado e quando.

O resultado é um indicador de utilização único, consistente entre o financeiro, o apontamento de horas e o contrato — com linhagem rastreável até a fonte, a data e o conector que o originou.