Aide à l'entretien
Préparation à l'entretien
CV
Recherche d'emploi
Ressources
Abonnement
FR
Telegram
Connexion
Ouvrir le menu
Aide à l'entretien
Assistant IA
Extension du navigateur
Ressources
Télécharger
FAQ / Aide
Préparation à l'entretien
Banque de questions
Banque d'entretiens
Entretiens simulés
Mentors
Ressources
FAQ / Aide
Recherche d'emploi
Automatisation de la recherche d'emploi
Analyse du marché
Offres d'emploi sur Telegram
Ressources
Carrières
Blogue
FAQ / Documentation
TelegramBlog
Telegram Assistance
Juridique
Remboursement
Conditions
Confidentialité
Ayants droit
Retour aux questions
Banque de questions
Data Engineer - Développeur
Question
Middle
depuis interview.utils import get_clickhouse_client from airflow import DAG from airflow.operators.python import PythonOperator from airflow.sensors.external_task import ExternalTaskSensor from datetime import datetime import pandas as pd import clickhouse_driver import os CLICKHOUSE_CLIENT = get_clickhouse_client() default_args = { "start_date": datetime(2024, 1, 1) } with DAG( dag_id="datamarts.daily_revenue_per_country", default_args=default_args, schedule_interval="@daily", catchup=False ) as dag: transactions_sensor = S3KeySensor( task_id="transactions_sensor", bucket_key="data/transactions_{}.csv".format(datetime.now().strftime("%Y-%m-%d")), bucket_name="my-bucket", aws_conn_id="aws_default", timeout=600, poke_interval=30, mode="poke" ) def extract_from_s3(**kwargs): df = pd.read_csv("s3://my-bucket/data/transactions_{}.csv".format(datetime.now().strftime("%Y-%m-%d"))) kwargs["ti"].xcom_push(key="df", value=df.to_dict()) def load_to_raw_table(**kwargs): df = pd.DataFrame(kwargs["ti"].xcom_pull(task_ids="extract", key="df")) rows = [tuple(r) for r in df[["transaction_id", "user_id", "amount", "created_at"]].to_numpy()] CLICKHOUSE_CLIENT.execute( ... )
Marquer comme terminé
Précédent
Suivant