Greenplum-тан ClickHouse-қа материализацияланған көріністі көшіру кезінде деректерді қалай тасымалдауға болады?
Data Engineer
4 адамнан тұратын командада сіздің рөліңіз қандай болды, ал 3-4 жылдан кейін мансабыңызды қалай көресіз, қандай мақсаттар қойдыңыз?
Барлығы жүктеулердің шамамен саны — жоғарғы деңгейлі жұмыс орындары, ағындар қанша болды?
Python-ды қаншалықты жақсы білесіз?
CTE-де жадының жоғары тұтынуы кезінде деректерге не болады?
Тарихи деректердің үлкен қоймасын көлемі мен объектілер бойынша қолмен қолдау қаншалықты қиын болды?
Сұраулар бойынша, деректермен не болады, соның ішінде қандай түрлерінің қосылуы — қандай қосылу түрлерін көре аламыз?
Біз метадеректерді енгіземіз, және ол осы метадеректер негізінде ағынды құрады — бұл ескі жүйелерден жоспарланған жүйеге ағымдарды жылдам көшіруге қалай көмектеседі?
ClickHouse-те қандай оқу түрі пайдаланылады?
Kafka-дан ClickHouse-қа деректерді нақты уақыттағы есеп беру үшін ағынды түрде қалай жүктеуге болады?
Аналитикалық функциялармен (терезе функциялары) қалай жұмыс істедіңіз?
4 адамнан тұратын командада жетекші болды ма, әлде басқа біреу басқарды ма?
Kafka-мен жұмыс істеуде қиындық жоқ, негізгісі — деректерді өңдеу — қандай нюанстарды ескеру керек?
Greenplum және Trino деректерін ClickHouse-қа қалай жеткізуге болады?
Greenplum-да ACID сақтала ма?
Деректер қоймасы Data Vault схемасы бойынша салынған ба — оны да дамыту және қолдау жасадыңыз ба? Хабтар мен сілтемелерді қолмен қосқан ба?
Сізде Data Science және үлкен деректерді өңдеу тәжірибесі бар — Rust тілінде жазылған, көп ағынды, Pandas-қа қарағанда өте жылдам кітапхана бар. Мұндай кітапханалар туралы білесіз бе?
Greenplum OLTP пе, әлде OLAP пе?
CTE мен подзапрос арасындағы айырмашылық қандай?
Қазіргі уақытта жұмыс ұсыныстарыңыз бар ма?