Machine Learning / AI
Qual modelo e abordagem escolher para processar áudio de uma conferência (fala-para-texto, diarização)?
O que é uma operação de fold? Quais são as suas propriedades? Como pode ser representada como uma multiplicação matricial (im2col)?
Qual é a diferença entre multitarefa e multiprocessamento em Python, quando usar cada um?
O que é Apache Beam / Dataflow?
Como avaliar a qualidade de um LLM ajustado no domínio do usuário?
Que características são usadas nos modelos de fala (MFCC, espectrograma mel)?
O que é a noção de gráficos computacionais?
Como lidar com o problema do crescimento do contexto ao manter uma conversa ativa com o usuário?
O que são as abordagens pointwise, pairwise e listwise em aprendizagem para classificação?
É possível encontrar os parâmetros de regressão linear analiticamente, em vez de por descida de gradiente?
Como verificar eficazmente a existência de um par espelho de pontos com um x oposto?
O que é o aprendizado por reforço em sistemas de recomendação?
Quais são as abordagens modernas para dados tabulares (CatBoost, LightGBM, XGBoost, deep tabular)?
Quais são as características do treino em grandes mosaicos satelitais (memória, E/S)?
O que é o modo DART no boosting?
O que é SentencePiece e por que é necessário para línguas sem delimitadores explícitos?
Que transformadores conhece para tarefas de Visão Computacional (ViT, Swin, DeiT, DETR, BEiT)?
Qual é a diferença entre QLoRA e LoRA?
Como reduzir a alucinação em perguntas abertas?
Qual é a diferença entre bases de dados relacionais e não relacionais?