Machine Learning / AI
Quais são as técnicas de deduplicação de dados no pipeline?
O que é viés de seleção e viés de sobrevivência?
Como agrupar corretamente os dados por categorias de salário sem linhas duplicadas?
São utilizadas estatísticas do batch ou parâmetros guardados na normalização em batch na inferência?
O que são as perdas GIoU, DIoU, CIoU?
Como deve ser o contrato de integração entre a PBX virtual e o CRM?
Projete um sistema de avaliação da relevância dos resultados de pesquisa com LLM-judge.
Qual é a diferença entre AutoML para dados tabulares e CV/NLP?
Quais são as características do treino em grandes mosaicos satelitais (memória, E/S)?
É possível usar dados comportamentais do site para melhorar a classificação de produtos?
O que significa cada componente na função de perda do Faster R-CNN: loss_classifier, loss_objectness, loss_rpn, loss_bbox?
O que faz na sua atual posição de trabalho?
O que é um codec neural (Encodec, SoundStream)?
O que é a perda CTC e onde ela é aplicada em ASR?
É possível transmitir o número de telefone no corpo de uma solicitação POST para obter dados do usuário?
Fale sobre o LongRAG e a sua ideia de unidades de pesquisa longas.
O que é a correção pontual?
O que é o BigBird e que tipos de atenção ele combina?
Quais são as técnicas para trabalhar com dados muito dispersos?
Como escolher de forma otimizada a característica e o limiar para divisão em árvores de decisão?