Launch Legends
Solidus Labs
Engenheiro de Dados Sênior - Infra
Sobre a Solidus Labs
Na Solidus, estamos moldando os mercados financeiros de amanhã, fornecendo tecnologia de ponta para vigilância de negociações que protege investidores, aumenta a transparência e garante a conformidade regulatória em ativos financeiros tradicionais, predição e mercados de cripto.
Com mais de 20 anos de experiência no desenvolvimento de FinTech de nível Wall Street, nossa equipe entrega soluções inovadoras nas quais instituições financeiras e reguladores em todo o mundo confiam para detectar, investigar e relatar manipulação de mercado, crimes financeiros e fraudes. Com sede em Wall Street, e escritórios em Singapura, Tel Aviv e Londres, protegemos milhões de entidades de varejo e institucionais globalmente, monitorando mais de um trilhão de eventos por dia.
A Vaga
Estamos procurando um Engenheiro de Software experiente em Engenharia de Dados. Alguém proficiente na construção de pipelines de dados robustos, escaláveis, de fácil manutenção e com monitoramento completo em ambientes de nuvem.
Como uma startup ambiciosa em um espaço extremamente dinâmico, nos orgulhamos de ser independentes, responsáveis e organizados, com uma atitude proativa e disposição para nos dedicarmos ao trabalho do dia a dia que pode sair do nosso escopo oficial, mantendo o foco em nossos objetivos e na visão geral.
Responsabilidades
- Projetar e otimizar a camada de dados do ClickHouse - incluindo motores de tabela, estratégias de particionamento, visualizações materializadas e políticas de armazenamento - para garantir alto desempenho em escala de bilhões de eventos.
- Gerenciar o dimensionamento dos clusters ClickHouse, decisões de topologia e planejamento de capacidade para ingestão em tempo real e cargas de trabalho em lote T+1, equilibrando custo, latência e throughput.
- Impulsionar estratégias de confiabilidade e desduplicação de dados dentro do ClickHouse, aproveitando recursos em nível de motor (ReplacingMergeTree, CollapsingMergeTree, etc.) e controles em nível de pipeline para garantir a completude e consistência dos dados.
- Estabelecer e melhorar continuamente o monitoramento, alertas e observabilidade para a camada ClickHouse — cobrindo saúde da replicação, desempenho de merges, latência de consultas e utilização de recursos.
- Atuar como autoridade interna em ClickHouse, orientando equipes de engenharia em toda a organização sobre otimização de consultas, melhores práticas de modelagem de dados e uso eficiente de construtos específicos do ClickHouse.
- Atuar como principal ponto de contato com a equipe de fornecedores do ClickHouse — triando problemas, incorporando feedback do produto, avaliando novos recursos e traduzindo orientações do fornecedor em melhorias acionáveis para nossa implantação.
- Colaborar com consumidores downstream (análise, ML, produto) para entender os padrões de acesso e refinar continuamente como os dados são armazenados e servidos — melhorando o desempenho de consultas, design de schema e formatos de dados para diversas necessidades de clientes.
- Definir e impor padrões de versionamento e governança de schema no ambiente ClickHouse, garantindo que a evolução do schema não comprometa a confiabilidade do pipeline ou a compatibilidade com os consumidores.
Responsabilidades null
Requisitos
- Bacharelado em Ciência da Computação.
- Sólida experiência como engenheiro de software com pelo menos 5+ anos de experiência prática com Java, Rust ou Python.
- 8+ anos em engenharia de dados e desenvolvimento de pipelines de dados em ambientes de produção de alto volume e baixa latência.
- Experiência trabalhando em sistemas de baixa latência e tempo real processando bilhões de eventos por dia.
- Profundo conhecimento prático em ClickHouse — incluindo arquitetura de cluster, seleção de motores de tabela, replicação, sharding e otimização de consultas. Experiência em interagir com a equipe de fornecedores ou comunidade ClickHouse é um grande diferencial.
- Proficiência em todo o ecossistema de engenharia de dados: Apache Kafka, Spark, Airflow, Kubernetes, Redis, Snowflake e tecnologias de cache.
- Habilidades de nível expert em SQL e otimização de consultas, com forte ênfase em padrões específicos do ClickHouse — visualizações materializadas, projeções, TTLs e ajuste de merge tree.
- Experiência com ferramentas de monitoramento e observabilidade (Prometheus, Grafana ou similar), com capacidade de definir e gerenciar métricas de saúde operacional para uma implantação ClickHouse.
- Curiosidade, capacidade de trabalhar de forma independente e um histórico comprovado de identificação proativa e implementação de soluções.
- Excelentes habilidades de comunicação verbal e escrita, incluindo a capacidade de orientar e influenciar engenheiros de diferentes equipes em um ambiente remoto.
