Em que os pooling mean/max diferem do pooling aprendível?
Machine Learning / AI
Como escolher o tamanho do vetor de embeddings?
Quais são as limitações do Whisper e como contorná-las (long-form, alucinações)?
O que é NSP (previsão da próxima frase) e por que o RoBERTa a abandonou?
Quais formatos de compressão (binário, quantização escalar) existem no VDB?
O que é meta-prompting e quais são os seus casos de uso?
O que é o LoRA e por que funciona (hipótese de baixo rank)?
O que é cross-encoder QA e qual é o formato de entrada?
Por que é necessário bias=False nos camadas Lineares em LLMs modernos?
Projete um sistema de assistente de voz com baixa latência (<500ms) de ponta a ponta.
O que é busca em feixe e por que ela é raramente usada para geração aberta?
Qual é o papel dos filtros payload na base vetorial?
O que é o DocVQA e quais modelos são populares lá?
O que é a filter bubble e como ela é detectada?
Qual é a ideia do algoritmo Byte Pair Encoding (BPE)? Descreva as etapas de treino.