Data Engineer
O que é particionamento e distribuição (sharding)?
dict1 = { (1, 2), [3, 4, 5] : 0 } var = 1, 2
Fale sobre uma tarefa interessante na empresa nos últimos 2,5 anos, por exemplo, relacionada com o ClickHouse.
Conte um exemplo em que utilizou inteligência artificial para automatizar processos rotineiros.
Qual é a diferença entre ACID e a teoria CAP?
Compare as abordagens ETL e ELT: qual é a diferença e quando cada uma delas é aplicada?
Como trabalhavam com 1C: extraíam dados diretamente do banco de dados, através de um barramento ou de outra forma?
Já se deparou com o erro ClickHouse `Too many parts` ao inserir? Como resolveu?
Quais campos técnicos foram utilizados em satellites, links e hubs Data Vault?
Pergunta nº 1 Qual a quantidade de registros que a consulta retornará com inner, left, right, full join de duas tabelas ao unir pelo atributo id t1 t2 | id | | id | |-----| |-----| | 1 | | 1 | | 2 | | 1 | | 3 | | 3 | | 0 | | 5 | | NULL| | NULL| | NULL| inner: left: right: full outer:
Armazenaram os resultados de visualizações tabulares em Parquet ou de outra forma no S3?
Como organizar o carregamento de dados no ClickHouse numa grande tabela PostgreSQL, na qual novas entradas com uma chave primária monotonicamente crescente chegam constantemente?
Quanto tempo trabalhou com Spark no total e quão profundamente se envolveu nele?
O que faz o parâmetro depends_on_past no Airflow?
O que acontece no PostgreSQL após executar uma consulta SELECT * FROM [tabela]?
Por que decidiu colocar a ordenação numa CTE separada? Por que não foi possível usá-la diretamente na primeira CTE?
Como determinaram que a entrada já existe e que não é necessário gravá-la novamente?
NULL mais 5 — quanto será?
Com que formatos de ficheiros trabalhou?
Que tipos de JOIN físicos existem no Spark?