Az API-n kívül milyen más módszerekkel és protokollokkal dolgozott az adatforrásokkal?
Data Engineer
Írtál ingestion folyamatokat az OpenMetadata számára, amelyek forrásokat szkennelnek?
Milyen sorrendet vagy tömörítési típust használ a Parquet?
Hogyan dolgoztak a 1C-vel: közvetlenül az adatbázisból szereztek adatokat, vagy egy buszon keresztül vagy más módon?
Mi történt, amikor az adatok minőségi korlátozása aktiválódott: figyelmeztetés, leállás, újraindítás?
Miért a Parquet-ot használták az ORC helyett?
Miért vannak az S3-ban "mappák"/előtagok a kényelem mellett?
Milyen technikai mezőket használtak a satellites, links és hubs Data Vault-ban?
Tárolták az eredményeket táblázatos nézetekből Parquet vagy más módon az S3-ban?
Dolgozott-e FTP-vel fájlok vagy adatok beszerzése érdekében a portálon keresztül?
Beállítottál címkéket az S3-ban a vödrökön vagy az objektumokon?
Hogyan határozták meg, hogy a bejegyzés már létezik, és nem kell újra rögzíteni?
Milyen fájlformátumokkal dolgozott?