O que é o comprimento do contexto e por que é difícil de expandir?
Machine Learning / AI
Que técnicas de compressão de prompts conhece (LLMLingua)?
O que é o sobreajuste e como combatê-lo?
Quais são as causas do sobreajuste?
Que métodos podem ser utilizados para melhorar o modelo?
O que é autocorrelação e autocorrelação parcial (ACF, PACF)?
Como avaliar o tempo médio de resposta do serviço com um grande volume de logs que não cabem na memória?
Como escolher os dados para estimar a mediana: passagem sequencial ou amostragem aleatória?
Quais são os tipos de regularização e como eles funcionam?
O que é um buffer de reprodução de experiência e para que serve?
Por que os pesos do modelo podem ficar grandes e por que é necessário reduzi-los com regularização?
O que é a visualização do espaço de características de um modelo CV com t-SNE/UMAP?
O que é Medusa e cabeças de previsão multi-token?
Como organizar a conteinerização e a implantação de modelos?
O que é calibragem e por que é importante para a justiça?
Fale sobre a tarefa de tradução automática. O que é sequence-to-sequence?
Que tipos de erros existem nos protocolos médicos e como classificá-los?
Projete um sistema de OCR + NLP para processar digitalizações de contratos.
O que é a função de sobrevivência S(t)?
O que é o NCCL e do que é responsável?