— serviços / escopo —
Três formas de trabalhar com a camada de dados
Cada serviço tem escopo, prazo e entregável definidos. Escolha o que faz sentido para onde o projeto está agora — não para onde vai estar em dois anos.
Voltar ao InícioComo estruturamos o trabalho
Todo engajamento Terravox começa com um mapeamento claro: quais fontes existem, o que cada campo significa no negócio, e quais transformações são necessárias antes que os dados possam ser usados com confiança.
A partir disso, o trabalho segue um protocolo fixo — inventário, contratos de schema, código versionado, testes automáticos, entrega com documentação. Cada etapa tem artefato verificável.
Inventário de fontes
Contratos de schema
Código versionado
Testes automáticos
Construção de Pipeline de Dados
Engajamento de engenharia que constrói as camadas de ingestão, limpeza e entrega que uma equipe de modelagem precisa antes de qualquer treinamento. Desenvolvido para empresas com dados distribuídos em ERP, CRM e planilhas — especialmente varejo, logística e manufatura.
O que está incluído:
- Inventário de fontes e negociação de acesso
- Jobs de ingestão incremental com retry e alertas
- Contratos de schema versionados
- Deduplicação e resolução de entidades
- Testes de qualidade em cada carga
- Serving layer consultável pela equipe de analytics
- Infrastructure-as-code na nuvem do cliente
- Documentação de handover + 2 semanas de operação pareada
Etapas do projeto:
- Mapeamento de fontes e definição de escopo
- Contratos de schema e modelagem da camada de staging
- Desenvolvimento dos jobs de ingestão
- Testes de qualidade e deduplicação
- Serving layer e documentação
- Operação pareada e handover
Auditoria de Qualidade de Dados
Avaliação que produz um quadro baseado em evidências sobre se os dados da empresa sustentam os projetos que estão sendo planejados. Frequentemente contratada antes de assinar com um fornecedor de modelagem ou iniciar um pipeline.
O que está incluído:
- Perfilamento de até 15 tabelas
- Medição de completude, frescor e drift de cardinalidade
- Integridade referencial entre tabelas
- Identificação de quebras silenciosas em jobs existentes
- Notebooks reproduzíveis para que o cliente re-rode cada verificação
- Parecer escrito sobre viabilidade de cada caso de uso planejado
Etapas:
- Levantamento de tabelas e definição de métricas
- Perfilamento e execução dos checks de qualidade
- Análise de viabilidade por caso de uso
- Entrega dos notebooks e do parecer final
Sessão Técnica de Modelagem de Esquema
Sessão de trabalho com a equipe de dados do cliente para resolver uma questão específica de esquema ou modelagem em que estão travados. Para equipes que precisam de uma segunda opinião, não de um engajamento completo.
Tópicos cobertos:
- Dimensional versus normalizado para o caso real da equipe
- Tratamento de registros tardios e corrigidos
- Estratégia de particionamento contra padrões reais de query
- Convenções de nomenclatura que sobrevivem à rotatividade
- Resumo escrito das decisões tomadas e raciocínio por trás
— nota —
A sessão é conduzida remotamente com compartilhamento de tela, contra o repositório real do cliente. O pagamento é feito antes da data agendada. O resumo escrito é entregue em até dois dias úteis após a sessão.
Qual serviço faz sentido agora?
A tabela abaixo ajuda a identificar o serviço certo para o momento atual do projeto.
| Critério | Pipeline | Auditoria | Sessão Técnica |
|---|---|---|---|
| Melhor para | Empresas prontas para construir infraestrutura | Avaliar viabilidade antes de investimento maior | Equipes com decisão específica travada |
| Duração | 10–14 semanas | 3 semanas | 4 horas |
| Código entregue | (notebooks) | — | |
| Parecer escrito | |||
| Operação pareada | (2 semanas) | — | — |
| Preço | R$ 5.500 | R$ 2.680 | R$ 780 |
Padrões que atravessam todos os serviços
Segurança e privacidade na camada de dados
Campos sensíveis são identificados e tratados desde a ingestão. Controles de acesso são definidos junto com a arquitetura.
Métricas de qualidade mensuráveis
Completude, frescor, cardinalidade e integridade referencial são medidos e reportados — não avaliados subjetivamente.
Suporte técnico direto
Durante o período de operação pareada, dúvidas chegam diretamente à engenheira ou engenheiro que construiu o pipeline.
Boas práticas de engenharia de dados
Seguimos padrões consolidados de dbt, Airflow e modelagem dimensional. Nada de abordagem proprietária que cria dependência.
Compatível com a stack do cliente
Trabalhamos com as ferramentas que o cliente já usa — AWS, GCP, Azure, Databricks, Redshift, BigQuery. A escolha é do cliente.
Documentação de raciocínio, não só de resultado
Cada decisão técnica relevante é registrada com o raciocínio por trás. O entregável é o projeto — não a dependência de quem o fez.
Preço fixo por escopo fechado
sessão técnica
Modelagem de Esquema
por sessão de 4 horas
- Sessão remota com screen sharing
- Contra o repositório real do cliente
- Resumo escrito pós-sessão
auditoria
Qualidade de Dados
por auditoria de 3 semanas
- Até 15 tabelas perfiladas
- Notebooks reproduzíveis
- Parecer de viabilidade por caso de uso
pipeline completo
Construção de Pipeline
por engajamento de 10–14 semanas
- Ingestão, limpeza e serving layer
- IaC na nuvem do cliente
- Testes automáticos em cada carga
- 2 semanas de operação pareada
— contato —
Ainda em dúvida sobre qual serviço faz sentido?
Descreva onde o projeto está agora e o que está travando. A partir disso indicamos o caminho mais direto.
Falar com a Equipe