ClickHouse-də DDL/CREATE TABLE üçün hansı əlavə parametrləri bilirsiniz, bunlar nəyə təsir edir və hansı hallarda istifadə olunur?
Data Engineer
Məlumatların vitrinə qeyri-bərabər paylanmasını necə həyata keçirmək olar: ilkində 50% və digər ikisində 25%?
Klastrdə cədvəllər necə yaradılıb və ZooKeeper səbəbindən bir şardda nüsxə çatışmazlığı problemi necə həll olunub?
Sorğu çox uzun çəkəndə və tam skan etdikdə optimallaşdırma problemlərini necə həll etdiniz? Belə bir yeni vəzifəyə necə yanaşırsınız?
Parquet'i dəqiq necə oxuyurdunuz?
ClickHouse-də Materialized View hansı hallarda məlumatları qaçırmaq və ya əksinə, onları təkrarlamaq mümkündür?
İşə əlavə edərkən ClickHouse `Too many parts` xətası ilə rastlaşdınızmı? Necə həll etdiniz?
Hansı Python kitabxanaları ilə işlədiniz?
Shardlar arasında məlumatların kənarlaşması haqqında daha ətraflı məlumat verin: necə müəyyən edildi və müvafiq funksiya/mexanizm necə istifadə olundu?
ClickHouse-də UDF (İstifadəçi Təyin Edilmiş Funksiyalar) ilə tanışsınızmı, onlarla işlədinizmi?
Müştəri ID-yə görə məlumatların kənarlaşmasını necə düzəltdiniz, bir müştəri digərlərindən əhəmiyyətli dərəcədə böyük olduqda? Hansı variantlar mövcuddur?
ClickHouse-də Distributed mühərrikin hansı parametrləri ilə tanışsınız?
Məlumatların birləşdirilməsi hansı sahələrdə baş verdi və vitrinada təkrarlamalar necə aradan qaldırıldı?
Yeni MV-ni işə salmadan əvvəl mövcud olan məlumatları düzgün doldurmaq üçün Materialized View zəncirini ReplacingMergeTree aralıq cədvəli vasitəsilə necə idarə edərdiniz?
Hansı Airflow versiyası ilə işlədiniz?
Monoton şəkildə artan birincil açar ilə daim yeni qeydlər gələn böyük PostgreSQL cədvəlində ClickHouse-a məlumat yükləməsini necə təşkil etmək olar?
ReplicatedQueue ilə tanışsınız? Onunla işləmə təcrübəniz varmı?