Machine Learning / AI
Tarefa SQL: encontrar vendedores que em 2022 atenderam a vários clientes de uma mesma cidade
Quem tem um campo receptivo maior: duas convoluções consecutivas de 3x3 ou uma convolução de 5x5?
Como construir um modelo baseado em séries temporais com métricas e heurísticas?
Quais são as métricas de qualidade de geração (FID, IS, KID, CLIPScore)?
Como classificar a emissão de um novo ou antigo identificador?
Como escolheram o modelo para as embeddings? Houve filtragens de documentos e uma etapa de re-ranking?
O que é o RAG multimodal e como fazer um índice de imagens?
O que é validação de esquema no pipeline de ML?
Como implementar o treino do modelo XGBoost com dados que não cabem na memória?
Como organizar pipelines e deploy de modelos em produção?
O que é o teste A/B bayesiano?
a = [1, 2, 3] b = [1, 2, 3] c = a print(a == b) print(a is b) print(a is c) class A: def __init__(self): print("A init") class B(A): def __init__(self): print("B init") super().__init__() class C(A): def __init__(self): print("C init") super().__init__() class D(B, C): def __init__(self): print("D init") super().__init__() d = D()
Quais tipos de dados em Python são modificáveis de list, set, dict?
Fala sobre os teus projetos: o que fizeste especificamente, em detalhes técnicos?
Fale sobre o gradiente descendente: como funciona e quais são as suas modificações (SGD, Momentum, Adam)?
Após o ID do token e as embeddings, o que exatamente entra no decodificador: qual é a forma das representações, como a informação posicional é adicionada e o que acontece a seguir?
Como classificar a idade por intervalos de 5 anos?
Deixamos o boosting como modelo, ou como?
Quais são as suas preferências ou restrições em relação a projetos e áreas temáticas?
Qual foi o seu papel no projeto?