Ako hodnotiť kvalitu retrievera? Odkiaľ vziať kolekciu dokumentov na hodnotenie metrík?
Machine Learning / AI
Čo je vLLM a na čo sa používa?
Máte malý súbor údajov s recenziami filmov v ruštine a ich binárnym označením sentimentu (značky: 0 — negatívne, 1 — pozitívne). Vašou úlohou je implementovať kompletný pipeline za 15 minút na trénovanie jednoduchého modelu klasifikácie textu bez použitia hotových encoderov ako BERT a zobraziť presnosť (accuracy) na týchto dátach. reviews = [ "Tento film je jednoducho úžasný!", "Hrozné herecké výkony a nudný dej.", "Každú chvíľu som si užil!", "Najhorší film, ktorý som videl.", "Skvelá réžia a úžasný príbeh.", "Neznesiteľne nudný a predvídateľný." ] labels = [1, 0, 1, 0, 1, 0]
Čím sa líši Tensor Parallel Size od Data Parallel Size v vLLM?
Čo je RAG a aký základný problém rieši?
Aký parameter v modeli embedovania určuje maximálny počet tokenov na vstupe? Čo sa stane, ak zadáte viac tokenov ako je limit?
Ako vpliva štirikratno povečanje velikosti batch na hitrost učenja in zakaj? Kako deluje nazaj propagacija?
Povedz mi o sebe a svojom skúsenosťou
Čo je model vloženia a čo je token?
Čo je kvantizácia modelu a čo sa deje s váhami pri jej použití v vLLM?
Ako sa z vektorovej databázy získavajú údaje na základe používateľského dopytu?
Čo sa stane, ak zadáte v LLM kontext s 120 000 tokenmi pri limite 60 000?
Ako bolo organizované vyhľadávanie informácií vo vektorovej databáze? Prečo ste použili Qdrant?
Čo je LangGraph, na čo sa používa, ako sa implementujú vetvenia a podmienkové prechody? Čím sa líšia nástroje od uzlov?