Data Engineer
Tooge näide, millal õnnestus meeskonna protsesse või tööriistu parandada.
Struktuur tabelite, mis on näidatud pildil, on loodud. On vaja täita pildil näidatud päring. Millist join tüüpi tuleb kasutada [...]-i asemel, et tulemusena type = 'table_aw' kirjetel oleks täidetud veerg 'naming', ja type = 'table2' kirjetel — veerg 'serial_number'? create table multirelation( type varchar not null, entity_id integer not null ); create table table_aw( id integer primary key, naming varchar not null ); create table table2( id integer primary key, serial_number varchar not null ); -- tabelite struktuur select m.type,m.entity_id, ta.naming, t2.serial_number from multirelation m [...] join table_aw ta on m.entity_id = ta.id and m.type='table_aw' [...] join table2 t2 on m.entity_id = t2.id and m.type='table2'; -- päring Jäta tühjaks inner cross right left
Mis juhtus ja kuidas töö tagasi saada?
Meie teema on väga struktureeritud, puu kujuline, andmed on toored — kuidas neid töödelda?
Mis vahe on Greenplum ja PostgreSQL vahel?
Millise palgaga sa loodad?
Millised on Set ja List omadused ja erinevused Pythonis? Lisaks jõudlusele, millised teised omadused on olemas?
Millist tüüpi tüüp on Pythonis kasutusel: statiline või dünaamiline?
Meil on klientide tabel (id, nimi, aadress jne), tooted (id, nimi jne), toote liikumine (siin on meil klienti id, toode, kuupäev, kogus, summa), peame leidma, millised tooted müüdi 1. jaanuaril, ainult unikaalsed, ning samuti näitama ostja nime ja...
Kas sul on kogemusi Docker-piltidega, keskkonna seadistamisel virtuaalmasinas?
Näitaval ekraanil on kaks andmestruktuuri; millises neist otsing väärtuse 2 on kiirem ja miks?
SELECT client_id, ФИО, SUM(suma) AS total_amount FROM clients JOIN transactions ON clients.client_id = transactions.client_id WHERE дата = '2025-05-01' GROUP BY client_id, ФИО;
[nimi] küsis: Kuidas rakendada andmete säilitamist ainult 2 aasta jooksul ClickHouse'is?
Kuidas ühendada kahte tabelit SQL-is?
git submodule update --init
Milline töövorm on sinu jaoks mugavam — kontor, hübriid või kaugtöö? Meil on kaks kontorit, Kutuzovskaja ja Tula.
Kas EXPLAINi täitmise plaan alati vastab sellele, mis tegelikult toimub?
Kuidas tagada mobiilklientile sama tellimuste juurdepääs, kuid väiksema väljade kogumiga? Mis on BFF?
Sul on päring, mis töötab halvasti, on aeglane või kukub kokku — kuidas seda optimeerida?
Rääkige meile rohkem andmete kallutatusest shardide vahel: kuidas seda määratleti ja kuidas kasutati vastavat funktsiooni/mekhanismi?