Machine Learning / AI
Fala-me sobre o LoRA: o que é, como é treinado e como funciona na inferência?
Como rastrearam todo o sistema multiagente — em que etapas surgem erros, latência, etc.?
Como dividir os dados em grupos usando funções de janela em SQL?
Tem um pequeno conjunto de dados com críticas de filmes em russo e a sua etiqueta binária de tonalidade (rótulos: 0 — negativo, 1 — positivo). A sua tarefa é implementar um pipeline completo em 15 minutos para treinar um modelo simples de classificação de texto sem usar codificadores pré-treinados como BERT, e mostrar a precisão (accuracy) nestes dados. reviews = [ "Este filme é simplesmente incrível!", "Atuação horrível e enredo entediante.", "Gostei de cada momento!", "O pior filme que já vi.", "Ótimo trabalho de direção e história maravilhosa.", "Insoportavelmente entediante e previsível." ] labels = [1, 0, 1, 0, 1, 0]
Como são resolvidas as colisões em um set? Quais métodos de resolução de colisões existem?
Fala-me sobre o gradiente descendente: que tipos existem?
Fale-nos sobre a sua revisão de carreira: tipos de funções, indústrias, projetos-chave.
Explique os termos 'conjunto de treino' e 'conjunto de teste' no contexto do aprendizagem automática.
Como escolheu o limiar de 0,6?
Por que está procurando um novo emprego e por que saiu dos empregos anteriores?
Quais seriam os critérios de seleção se chegarem várias ofertas?
Tens experiência com PyTorch, que tarefas realizaste com ele?
Neste esquema, se o utilizador escrever a palavra « olá », ela irá para o RAG e receberá uma resposta através do RAG com a palavra « olá ». Como podemos ver/prevenir isso?
O seu papel na equipa é exclusivamente desenvolvimento?
Fale sobre o algoritmo K-means e seus variantes avançadas (K-means++).
Fale-nos sobre o projeto de avaliação da qualidade do trabalho dos despachantes: quais modelos foram utilizados, como foram comparados com o roteiro de referência?
Conte-nos mais sobre o cache KV: como funciona e de onde vem, começando pela arquitetura Transformer.
Conheces JOIN, LEFT JOIN, RIGHT JOIN?
Como trabalharam com as consultas no armazenamento vetorial (Qdrant) e seu impacto na latência do agente?
Como avaliou o sistema multiagente? Quais métricas foram usadas?