Machine Learning / AI
Quais são as abordagens modernas para dados tabulares (CatBoost, LightGBM, XGBoost, deep tabular)?
O que é o InstructBLIP?
Que tarefas resolvem as GNN no design molecular (parentes do AlphaFold)?
Como pode um analista de sistemas verificar a disponibilidade de rede de um endpoint?
Como combinar dois DataFrames por coluna se as colunas têm nomes diferentes?
Quais métricas existem para avaliar a classificação, especialmente em casos de desequilíbrio de classes?
Quanto tempo levou o projeto?
Quando é adequado usar um cross-encoder e quando um bi-encoder na pesquisa?
Qual é a complexidade dos algoritmos de ordenação?
Que implementações de gradient boosting conheces?
Como o Kafka pode ser útil nesta arquitetura?
O que é Wide&Deep e por que misturar memorização e generalização?
Como determinar a direção da mudança de x na descida do gradiente?
Por que motivo escalar as características e quais os métodos de escalonamento existentes?
Como funcionam as árvores de decisão?
Quais são os operadores Airflow mais populares?
Como avalias o teu nível de trabalho com SQL?
Conta-me, o que é uma tarefa de classificação?
Que tarefas o AutoML resolve mal (dados pequenos, conhecimentos de domínio não padrão)?
Como organizar a recolha automática de dados e o treino com Airflow?