
Labrynth AI
Data Engineer · Data Acquisition & Ingestion
Construo os dois lados da inteligência regulatória: a ingestão que transforma documentos em conhecimento estruturado e os produtos de dados do RTI que convertem evidência pública em índices defensáveis.
Labrynth / IA regulatória
Construindo a camada de ingestão por trás do GraphRAG
Meu foco principal é uma plataforma de ingestão capaz de receber documentos regulatórios heterogêneos e transformá-los em conhecimento estruturado e rastreável para busca e raciocínio.
- Desenhei o pipeline de ingestão ponta a ponta que converte qualquer material de origem em grafos de conhecimento estruturados, com proveniência para GraphRAG e respostas regulatórias auditáveis.
- Atuei em toda a stack do produto — APIs Django, workflows assíncronos com Celery, PostgreSQL/Supabase, Neo4j, integração com frontend, autenticação e contratos de dados — levando a ingestão do pipeline até a experiência do usuário.
- Construí estágios de validação e QA ao redor da extração assistida por IA para manter documentos, entidades, relações e citações inspecionáveis, em vez de virar um depósito opaco de embeddings.
- Dei suporte à infraestrutura e entrega em produção com Docker, Kubernetes, Redis, object storage, monitoramento e as interfaces usadas por times internos e clientes.
Red Tape Index / índices como serviço
Responsável pelo caminho da fonte pública ao índice publicado
Ajudei a construir o RTI como produto de dados ponta a ponta: aquisição global, infraestrutura cloud, metodologia estatística, APIs, autenticação, dashboards e a camada visual usada para explicar os resultados.
- Implementei a fundação cloud em Terraform e AWS: orquestração Prefect em ECS/Fargate, armazenamento no S3, limites de IAM, workers containerizados, Postgres/Supabase, retries, monitoramento e deployments reproduzíveis.
- Operei mais de 2 bilhões de requisições de produção adquirindo dados governamentais e setoriais nas Américas, Europa e Oceania a partir de APIs, PDFs, planilhas, dashboards e portais renderizados no navegador.
- Criei metodologias de índices em conjunto com data scientists, aplicando normalização estatística, pesos, agregação, análise de sensibilidade e scoring bronze → silver → gold reproduzível, com proveniência completa.
- Construí superfícies de produto no backend e frontend: APIs de dados, autenticação AWS Cognito/SES, account gates, rankings, dashboards analíticos e visualizações interativas para estudos de data centers, permissões, patentes, mídia e regulação.
- Transformei registros públicos heterogêneos em produtos de dados versionados, com fontes, transformações, scores e afirmações publicadas testáveis de ponta a ponta.
O crawler dorme. É quando a fonte muda de schema.


