Machine Learning / AI
Mis juhtub, kui dekooderile sisestate 10k tokeni pikkuse järjestuse, samal ajal kui mudel oli treenitud 9k peal?
Millised on omadused (features) ja mis on ülesande eesmärk?
Mis on judge LLM ja millised on tema bias-probleemid (pikkuse bias, positsiooni bias)?
Kas on usaldus puu klassifikatsiooni suhtes?
Mis on ConvNeXt ja miks see saavutas ViT kvaliteedi?
Milliseid äri- ja vastametrikaid mõõta, et hinnata toote reklaami vidjetit?
Mis on juhusliku metsa idee ja miks see töötab?
Mis on parent-document retriever ja milleks see on vajalik?
Millal valida ainult encoder, ainult decoder või encoder-decoder ülesande jaoks?
Mis on retrieval-augmented generation KG peal?
Millised närvivõrkude omadused muudavad need masinõppe ülesannete jaoks võimsaks?
Mis on BART ja mis on denoising autoencoderi idee seq2seq jaoks?
Kuidas arvutada throughput vs latency LLM-teeninduses?
Kuidas kasutada koostööl põhinevaid meetodeid soovituste tegemiseks, mis põhinevad embedditel?
Kuidas sa rakendaksid tehisintellekti assistenti andmebaasidele (ClickHouse), mis suudab vastata küsimustele, genereerida ja täita SQL-päringuid? Millist tehnoloogiapagasid ja komponente kasutaksid?
Mis on mudeli pööramise rünnak?
Mis on Pearl'i do-calculus?
Kuidas jagasite valimi treeningu ja testimiseks?
Mis on RM3 päringute laiendamine?
Mis on empiiriline Bayes?