Welke volgorde of compressietype wordt gebruikt in Parquet?
Data Engineer
Naast de API, welke andere methoden en protocollen hebt u gebruikt om met gegevensbronnen te werken?
Heb je ingestion-processen voor OpenMetadata geschreven die bronnen scannen?
Waarom is er voor Parquet gekozen in plaats van ORC?
Hoe werkten ze met 1C: haalden ze gegevens rechtstreeks uit de database, via een bus of op een andere manier?
Wat gebeurde er toen de datakwaliteitsbeperking werd geactiveerd: waarschuwing, crash, herstart?
Waarvoor dienen de "mappen"/voorvoegsels in S3 naast het gemak?
Welke technische velden werden gebruikt in satellites, links en hubs Data Vault?
Heeft u de resultaten van tabelweergaven opgeslagen in Parquet of op een andere manier in S3?
Heeft u met FTP gewerkt om bestanden of gegevens via het portaal te verkrijgen?
Heb je tags ingesteld in S3 op buckets of objecten?
Hoe hebben jullie vastgesteld dat de invoer al bestaat en niet opnieuw hoeft te worden opgeslagen?
Met welke bestandsindelingen hebt u gewerkt?