Kaip įvertinti retriverio kokybę? Iš kur gauti dokumentų kolekciją metrikų įvertinimui?
Machine Learning / AI
Kas yra vLLM ir kam jis naudojamas?
Turite mažą duomenų rinkinį su filmų apžvalgomis rusų kalba ir jų dvejetainiu tonų žymeniu (žymės: 0 — neigiamas, 1 — teigiamas). Jūsų užduotis yra įgyvendinti pilną pipeline per 15 minučių, norint apmokyti paprastą teksto klasifikavimo modelį be naudoti paruoštų koduotojų kaip BERT, ir parodyti tikslumą (accuracy) šiuose duomenyse. reviews = [ "Šis filmas yra tiesiog nuostabus!", "Baisi aktorių žaidimas ir nuobodus siužetas.", "Man patiko kiekviena akimirka!", "Blogiausias filmas, kurį mačiau.", "Puikus režisieriaus darbas ir nuostabi istorija.", "Neįmanomai nuobodu ir iš anksto numatomas." ] labels = [1, 0, 1, 0, 1, 0]
Kuo skiriasi Tensor Parallel Size ir Data Parallel Size vLLM?
Kas yra RAG ir kokią pagrindinę problemą jis sprendžia?
Koks parametras embedding modelyje nustato maksimalų tokenų skaičių įėjime? Kas nutiks, jei įvesite daugiau tokenų nei limitas?
Kaip keturgubai padidėjęs batch dydis veikia mokymosi greitį ir kodėl? Kaip veikia atgalinė sklaida?
Papaskink man apie save ir savo patirtį
Kas yra embedding modelis ir kas yra tokenas?
Kaip iš vektorinės bazės išgaunami duomenys pagal naudotojo užklausą?
Kas yra modelio kvantizacija ir kas vyksta su svoriais ją taikant vLLM?
Kas nutiks, jei LLM pateiksite 120 000 žodžių kontekstą su 60 000 ribojimu?
Kaip buvo organizuotas informacijos paieška vektorinėje bazėje? Kodėl naudota Qdrant?
Kas yra LangGraph, kam jis naudojamas, kaip įgyvendinami šakos ir sąlyginiai perėjimai? Kuo skiriasi įrankiai nuo mazgų?