Machine Learning / AI
# Formule e escreva a definição do que é roc auc. # Como se calcula o score roc auc? # Escreva uma função que calcula roc_auc_score de acordo com a definição escrita. # E para um número arbitrário de classes com uma ordem de prioridade dada? # O modelo funciona da seguinte forma # y_score[i] >= limiar -> y_pred[i] = 1 # y_score[i] < limiar -> y_pred[i] = 0 def test_roc_aur_score(): y_true = [0, 0, 0, 1, 0, 0] y_score = [0.2, 0.4, 0.31, 0.6, 0.3, 0.7] res_metric = roc_auc_score(y_true, y_score) assert res_metric == 0.8 y_true = [0, 1, 0, 0, 0, 1] y_score = [0.7, 0.6, 0.31, 0.31, 0.3, 0.2] res_metric = roc_auc_score(y_true, y_score) assert res_metric == 0.375 y_true = [0, 0, 0, 1, 0, 0] y_score = [0.2, 0.4, 0.31, 0.8, 0.3, 0.7] res_metric = roc_auc_score(y_true, y_score) assert res_metric == 1 y_true = [0, 0, 0, 0, 0, 0] y_score = [0.2, 0.4, 0.31, 0.8, 0.3, 0.7] res_metric = roc_auc_score(y_true, y_score) assert res_metric == 0 # Testes bônus para múltiplas classes y_true = [0, 1, 0, 0.5, 0, 1] y_score = [0.7, 0.6, 0.31, 0.31, 0.3, 0.2] res_metric = roc_auc_score(y_true, y_score) assert res_metric == 0. y_true = [0, 0.1, 0.2, 0.3, 0.4, 0.6] y_score = [0, 0.1, 0.2, 0.3, 0.4, 0.6] res_metric = roc_auc_score(y_true, y_score) assert res_metric == 1
Qual foi o tamanho do fragmento e houve sobreposição?
O espaço é considerado um caractere na tarefa?
Qual linguagem de programação é usada para pipelines e microsserviços?
O que é o desenho de descontinuidade por regressão?
O que é o gradiente de política e qual é o teorema do gradiente de política?
Que exemplos de feature engineering realizaste nos teus projetos?
O que é protobuf e como é utilizado no gRPC?
O que é atenção por consulta agrupada (GQA) e para que serve?
Houve outras dificuldades técnicas com as alucinações?
Em que áreas trabalhou com ML? Foi necessário treinar modelos e, se sim, quais arquiteturas?
Após a nova versão do modelo, a avaliação média de qualidade aumentou, mas os editores dizem que as respostas sobre temas jurídicos e financeiros ficaram significativamente piores. Qual visualização você faria primeiro para decidir se deve parar a publicação?
Fala sobre Adam e RMSProp.
Fala sobre a sua experiência de trabalho remoto — foi totalmente remoto ou havia escritórios?
Como escolher o tamanho do vetor de embeddings?
O que é o critério da porta da frente?
Qual é a diferença entre segmentação semântica, de instância e panóptica?
Como funciona a floresta aleatória e como são construídas as árvores no conjunto?
Qual foi a maior fonte de erros?
Como é que a liberdade criativa se relacionava com os resultados comerciais no trabalho?