O que é ajuste de prompt e onde é aplicado?
Machine Learning / AI
O que são embeddings quantizados e como eles são aplicados na pesquisa de produtos?
Explique a fórmula de atenção por produto escalar escalado. Por que dividir por sqrt(d_k)?
Quais são as métricas de qualidade de geração em RAG (fidelidade, relevância da resposta, precisão/recall do contexto)?
Qual é a diferença entre modelos de linguagem autorregressivos e mascarados?
O que é o ajuste fino supervisionado (SFT)? Que dados são necessários?
O que são os Modelos de Difusão Latente (Difusão Estável)?
O que é o compromisso entre exploração e exploração e como é implementado (amostragem de Thompson, epsilon-greedy)?
O que regula o parâmetro temperature?
Projete um sistema de moderação de conteúdo UGC (texto + imagens).
O que é busca em feixe e por que ela é raramente usada para geração aberta?
O que é o BLIP-2 e qual é o papel do Q-Former?
O que é um refiner no SDXL e qual é o seu papel?
O que é a quantização de produto (PQ) e quais são as suas perdas de qualidade?