Data Engineer
Erzählen Sie von einer interessanten Aufgabe im Unternehmen in den letzten 2,5 Jahren, zum Beispiel im Zusammenhang mit ClickHouse.
Erzähle ein Beispiel, bei dem du künstliche Intelligenz zur Automatisierung routinemäßiger Prozesse eingesetzt hast.
Mit eigenen Worten, was ist ein FULL JOIN?
Was ist der Unterschied zwischen ACID und dem CAP-Theorem?
Vergleichen Sie die Ansätze ETL und ELT: Was ist der Unterschied und wann wird jeder von ihnen angewendet?
Haben Sie beim Einfügen den Fehler ClickHouse `Too many parts` erlebt? Wie haben Sie ihn gelöst?
Welche technischen Felder wurden in Satelliten, Links und Hubs Data Vault verwendet?
Frage Nr. 1 Wie viele Datensätze gibt die Abfrage mit inner, left, right, full join von zwei Tabellen zurück, wenn sie nach dem Attribut id verbunden werden t1 t2 | id | | id | |-----| |-----| | 1 | | 1 | | 2 | | 1 | | 3 | | 3 | | 0 | | 5 | | NULL| | NULL| | NULL| inner: left: right: full outer:
Haben Sie die Ergebnisse tabellarischer Ansichten in Parquet oder anders in S3 gespeichert?
Wofür ist die Zeilengruppe in der Struktur der Parquet-Datei verantwortlich?
Wie organisiert man das Laden von Daten in ClickHouse bei einer großen PostgreSQL-Tabelle, in die ständig neue Einträge mit einem monoton wachsendem Primärschlüssel kommen?
Wie viel Zeit haben Sie insgesamt mit Spark gearbeitet und wie tief sind Sie darin eingetaucht?
Was bewirkt der Parameter depends_on_past in Airflow?
Wie arbeiteten sie mit 1C: Holten sie Daten direkt aus der Datenbank, über eine Bus-Verbindung oder auf andere Weise?
NULL plus 5 — wie viel wird das sein?
Mit welchen Dateiformaten haben Sie gearbeitet?
Welche Arten von physischen JOINs gibt es in Spark?
Erzählen Sie mir von sich: Erfahrungen, Aufgaben, Funktionen oder Errungenschaften, auf die Sie stolz sind.
Haben Sie Erfahrung mit FastAPI?
Wozu dienen "Ordner"/Präfixe in S3 neben der Bequemlichkeit?