Hogyan használjuk a BERT-et egy SQuAD-stílusú QA feladatban?
Machine Learning / AI
Milyen jellemzőket használnak a klasszikus NLP-modellekben (TF-IDF, n-gramok, karakter n-gramok)?
Hogyan csökkenthető a KV-cache mérete (GQA, MQA, csúszó ablak)?
Milyen feladatokat old meg a Deepgram, és milyen API-funkciói vannak?
Milyen problémák vannak a gyakorlatban az RLHF-nél (reward hacking, mode collapse)?
Hogyan válasszuk ki a kvantálási formátumot CPU vs GPU inference-hez?
Mi az a sampled softmax, és mi az előnye a számítás szempontjából?
Mi az az EfficientDet?
Melyek az HNSW hiperparaméterei fontosak (M, efConstruction, efSearch)?
Mi a különbség a sparse retrieval (BM25) és a dense között?
Milyen streaming inference technikák vannak az STT-hez (chunked attention, look-ahead)?
Mi az a class activation map (CAM) és Grad-CAM?
Mi az a DeepSORT és ByteTrack több objektum követésére?
Hasonlítsa össze a osztályozást, helymeghatározást és detektálást.
Milyen jellemzői vannak a valós idejű videófelismerésnek (TensorRT, batch=1)?