Data Analyst
Was ist der Hauptunterschied zwischen Fensterfunktionen und Aggregatfunktionen mit GROUP BY?
Wie fügt man in DataFrame ein Feld mit einem berechneten Wert basierend auf einem vorhandenen Feld hinzu?
Wie lässt man nur Kategorien übrig, deren Gesamtumsatz mehr als 100 Rubel beträgt?
Im Raum befinden sich drei Glühbirnen und draußen drei Schalter. Alle sind ausgeschaltet, und man kann nur einmal in den Raum gehen. Wie kann man herausfinden, welcher Schalter jede Lampe steuert?
Erzählen Sie mir von Ihrem Team: Wie viele Personen sind darin und welche Fachleute gehören dazu?
Was ist der Unterschied zwischen HAVING und WHERE?
Es ist notwendig, eine Abfrage zu schreiben, die den Gesamtumsatz pro Kategorie zurückgibt: |prod_cat |total_amt | |Kategorie 1|80 | |Kategorie 2|84 | |Kategorie 3|270 | Es gibt eine Tabelle mit Abonnenten, die Einträge zu unterschiedlichen Zeiten enthält. Das Hochladedatum des Eintrags ist im Feld raw_dt definiert: select * from abnt |id |msisdn |tarif_plan_id|account_id|raw_dt | |1 |[phone]|4375 |4979 |[phone]| |1 |[phone]|5842 |4979 |[phone]| |2 |[phone]|5842 |589783|[phone]| |2 |[phone]|4563 |5326 |[phone]| |2 |[phone]|4563 |0832 |[phone]| |3 |[phone]|4563 |0832 |[phone]| |3 |[phone]|5495 |7485 |[phone]| |3 |[phone]|4563 |0832 |[phone]| |3 |[phone]|4563 |0832 |[phone]| Es ist notwendig, eine Abfrage zu schreiben, die die vorletzte hochgeladene Eintragung nach Schlüssel id zurückgibt: |id |msisdn |tarif_plan_id|account_id|raw_dt | |1 |[phone]|5842 |4979 |[phone]| |2 |[phone]|4563 |0832 |[phone]| |3 |[phone]|4563 |0832 |[phone]| Es gibt eine Tabelle mit Abonnenten mit Änderungsverlauf. Jeder Eintrag für einen Abonnenten ist im Zeitraum von valid_from_dt bis valid_to_dt gültig. Wenn ein Eintrag geschlossen wird, beginnt der nächste am selben Datum. Es darf nur einen aktiven Eintrag pro Abonnent im Intervall [valid_from_dt, valid_to_dt] geben. select * from abnt |id |valid_from_dt|valid_to_dt|msisdn |tarif_plan_id|account_id| |1 |[phone] |[phone] |[phone]|4375 |4979 | |2 |[phone] |[phone] |[phone]|5842 |589783| |2 |[phone] |[phone] |[phone]|4563 |5326 | |3 |[phone] |[phone] |[phone]|4563 |0832 | Es ist notwendig, eine Abfrage zu schreiben, die die Datensätze mit einer inkorrekten Abschlussdatum zurückgibt: |id |valid_from_dt|valid_to_dt|msisdn |tarif_plan_id|account_id| |2 |[phone] |[phone] |[phone]|5842 |4979 | |2 |[phone] |[phone] |[phone]|4563 |5326 | mit ranked as ( select msisdn, tarif_plan_id, account_id, raw_dt, row_number() over (partition by id order by raw_dt desc) as rn ) select id, msisdn, tarif_plan_id, account_id, raw_dt from ranked where rn = 2 order by id
Es ist notwendig, eine Abfrage zu schreiben, die den vorletzten geladenen Eintrag nach dem Schlüssel id zurückgibt: |id |msisdn |tarif_plan_id|account_id|raw_dt | |------------|-----------|-------------|----------|-----------| |[phone]|5842 |4979 |[phone]| |[phone]|4563 |0832 |[phone]| |[phone]|4563 |0832 |[phone]| Es gibt eine Tabelle mit Abonnenten und Änderungsverlauf. Jeder Eintrag pro Abonnent ist im Zeitraum von valid_from_dt bis valid_to_dt gültig. Wenn ein Eintrag geschlossen wird, beginnt der nächste am selben Datum. Für jeden Abonnenten sollte nur ein aktiver Eintrag im Intervall [valid_from_dt, valid_to_dt] vorhanden sein. select * from abnt |id|valid_from_dt|valid_to_dt|msisdn |tarif_plan_id|account_id| |--|-------------|-----------|-------------|-------------|----------| |1 |[phone] |[phone] |[phone] |4375 |4979 | |1 |[phone] |[phone] |[phone] |5842 |4979 | |2 |[phone] |[phone] |[phone] |4563 |5326 | |2 |[phone] |[phone] |[phone] |4563 |0832 | Es ist notwendig, eine Abfrage zu schreiben, die die Datensätze mit inkorrektem Abschlussdatum zurückgibt. |id|valid_from_dt|valid_to_dt|msisdn |tarif_plan_id|account_id| |--|-------------|-----------|-------------|-------------|----------| |1 |[phone] |[phone] |[phone] |5842 |4979 | |2 |[phone] |[phone] |[phone] |4563 |5326 |
Haben Sie Fragen an uns?
Wie ordnet man den Verkauf von Produkten, die keiner Kategorie zugeordnet werden können, der Kategorie "Sonstiges" zu?
Wie aggregiert man Werte nach einem Feld und einem Indikator in Pandas?
Wie filtert man einen DataFrame nach einer Bedingung?
Schlagen Sie einen Algorithmus vor, um den Geburtstag des Teilnehmers zu bestimmen, basierend nur auf dem Anruf- und SMS-Protokoll: eingehende und ausgehende Nummern, Datum-Uhrzeit, Dauer und Ereignistyp.
Wie erklären Sie Mitarbeitern mit ziemlich traditionellen Ansichten die Notwendigkeit von Innovationen und Automatisierung?
Haben Sie einen Zeitrahmen für den Umzug nach Moskau, oder ist das an die Jobsuche gebunden?
Berichten Sie uns mehr über Ihr Interesse an KI-Agenten und Automatisierung – insbesondere über Ihre Erfahrung bei einem KI-Chatbot-Projekt: Wie die Kommunikation mit dem Kunden und den Entwicklern aufgebaut wurde.
Es werden die Tabellen product (Informationen darüber, zu welcher Kategorie das Produkt in einem angegebenen Datumsintervall gehört) und sale (Verkaufsdaten des Produkts mit Verkaufsdatum, Preis pro Einheit und gekaufter Menge) vorgestellt: select * from product |prod_nm |prod_cat |eff_dt |exp_dt | |--------|---------|-----------|-----------| |Produkt 1|Kategorie 1|[phone]|[phone]| |Produkt 1|Kategorie 2|[phone]|[phone]| |Produkt 2|Kategorie 3|[phone]|[phone]| select * from sale |sale_dt |prod_nm |price|cnt| |----------|---------|-----|---| |[phone]|Produkt 1|10 |5 | |[phone]|Produkt 1|15 |2 | |[phone]|Produkt 4|15 |2 | |[phone]|Produkt 3|15 |2 | |[phone]|Produkt 2|10.9 |300| |[phone]|Produkt 1|12.7 |7 | Es ist notwendig, eine Abfrage zu schreiben, die den Gesamtumsatz pro Kategorie zurückgibt: |prod_cat |total_amt| |----------|---------| |Kategorie 1|80 | |Kategorie 2|84 | |Kategorie 3|270 |
[Name] erzählen Sie uns von sich und was Sie machen.
Was ist der Unterschied zwischen den Fensterfunktionen ROW_NUMBER, RANK und DENSE_RANK?
Erzählen Sie mir von einem typischen Arbeitstag und dem Kommunikationsvolumen mit dem Team (unter Berücksichtigung, dass das Support-Team etwa 10-12 Personen umfasst).