Machine Learning / AI
Užduotis: 1000 dokumentų yra 10 beveik vienodų (skiriasi tik skaičius viduryje — skambučio kaina skirtinguose regionuose). Kaip tai paveiks RAG ir kaip išspręsti problemą?
Ar yra darbo paieškos terminai? Su kokiomis įmonėmis dar bendraujate?
Yra 100 monetų, iš kurių viena yra netikra — su dviem ereliais abiejose pusėse. Atsitiktinai pasirenkame monetą, ją metame ir iškrenta erelis. Kokia tikimybė, kad moneta yra netikra? Paaiškinkite sprendimą (naudodami Bayeso formulę).
Kokius koeficientus taikant L2 reguliavimas XGBoost?
Kaip sukurti agentą, kuris atsako vartotojui remiantis transakcinės bazės duomenimis: kokia technologijų krūva ir architektūra yra reikalinga, ir ar verta taikyti daugiagentystę?
Kas yra Kafka?
Papaskinkite apie savo pirmą darbo vietą: su kokiomis užduotimis ir projektais teko dirbti, kokius įrankius naudojote?
Papaskinkite apie savo įdomiausią projektą NLP ir LLM srityje, įskaitant architektūrą ir sprendimo įvertinimą.
Kas yra duomenų nutekėjimas ir iš kur jis kyla?
Kiek aktyviai šiuo metu ieškote ir kodėl svarstote naujus pasiūlymus?
Ar darbo grafikas (nuotolinis darbas, nuo pirmadienio iki penktadienio nuo 10:00 iki 19:00 Maskvos laiku) bus patogus?
Jei vykdymas pakeitė būseną, bet LLM to nemato, kaip techniškai atnaujinami būsenos ir metaduomenys?
Kas vyksta Precision/Recall, kai sumažėja klasifikatoriaus slenkstis?
Kaip sukurti kokybišką klausimų ir atsakymų rinkinį sistemos įvertinimui?
Kuo matuojamos modelio pasirinkimo metrikos (koks duomenų rinkinys)?
Kodėl NumPy-те reshape atliekama?
Kodėl pasirinkote būtent du agentus? Kodėl ne vieną ar daugiau?
Papaskink apie komandą: žmonių skaičius, vaidmenys, procesai, užduočių paskirstymas.
Ar galima išspręsti klasifikacijos uždavinį naudojant linijinę regresiją (be sigmoidės)?
Yra daug hiperparametrų optimizatoriui, 10 000 eksperimentų, mažai laiko, bet daug išteklių. Kokie požiūriai yra geriausi optimaliam deriniui rasti?