Sobes.tech

Machine Learning / AI

Tooge näide, kui BatchNorm vale kasutamine `eval()` režiimis viis ennustustes vigadeni.

Senior
160

Kas on praegu suurte tehnoloogiaettevõtete, näiteks Yandexi või Alfa, intervjuud?

Senior
158

Practical task An SQL query on 80 million messages creates duplicates after JOIN. Which action is best to start first? - Check the cardinality of the JOIN, keys, and execution plan before optimization. - Create an index on one join field. - Export the result to CSV and remove duplicates in Python. - Always add DISTINCT to all columns. - Add DISTINCT after verifying the result on a sample. - Check the join keys and the uniqueness of both tables.

Senior
157

Praktiline ülesanne Milline artefaktide kogum võimaldab ausalt taastada kahe LoRA käivitamise võrdluse? - Ainult lõplik kvaliteetdiagramm. - Commit koos koodiga ja lõpliku metrika ekraanipildiga. - Katse kood ja konfiguratsioonifail. - Kood, andmete hash, põhimudel, LoRA konfiguratsioon, sõltuvused ja käivitamise käsk. - Ainult link Git'i harule. - Kood, LoRA parameetrid, põhimudeli versioon ja sõltuvused.

Senior
157

Kuidas tavaliselt haldate sellistes katsetes andmete ja mudelite versioone?

Senior
156

Kas plaanite jätkata Filipiinidel või kolida teise riiki?

Senior
155

Pärast uue mudeli versiooni suurenes keskmine kvaliteedi hinnang, kuid toimetajad ütlevad, et vastused juriidilistel ja finantsküsimustel on oluliselt halvenenud. Millist visualiseerimist teeksite esimesena, et otsustada, kas peatada väljaandmine?

Senior
154

Kas saaksite üksikasjalikumalt rääkida, mis täpselt tundus teile "survestav" küsimustes ja kuidas see mõjutas teie suhtumist intervjuusse?

Senior
152

Kas teil on kogemusi töötada täielikult inglise keelt kõnelevates meeskondades?

Senior
152

Kas teil on kogemusi tehisintellekti intervjuudega?

Senior
150

Kas teil on pakkumisi käes või lõppfaasid teistes ettevõtetes?

Senior
149

Kuidas hindaksite kvantitatiivselt heitmete mõju mudeli metrikatele, näiteks täpsus või F1-skoor?

Senior
148

Kuidas optimeeriksite ühendusvõtmete indekseid, et vähendada duplikaate ja kiirendada päringut?

Senior
143

Kujutame ette, et töötate PyTorch mudeliga ja pärast selle üleviimist hindamise režiimi eval() näete, et fikseeritud 10 000 näite testkomplekti metrikad muutuvad iga käivitamisega. Te fikseerite juhuslike arvugeneraatorite algseisundi korduvuse tagamiseks: kus veel võib olla muutuste allikas peidetud? Selgitage Dropout, BatchNorm ja torch.no_grad() rolli ning nimetage metrikad, mille abil kontrollite tulemuste stabiilsust, kasutades nende jaoks määratud lävendi väärtusi.

Senior
141

Hinnake oma inglise keelt eraldi lugemise/kirjutamise ja vestluse osas CEFR tasemetel.

Senior
140

Praktiline ülesanne AI soovitab treenida LoRA kõigil 2 miljonil mittepuhtal dialoogil. Milline on kandidaadi kõige küpsem vastus? - Usaldada AI-d: suur korpus kompenseerib vead ise. - Esiteks muuta prompti, mitte andmeid. - Treenida LoRA puhastatud osas ja võrrelda seda põhimudeliga. - Enne treeningut kontrollida juhuslikku märgistamise näidist. - Esiteks kontrollida andmeid ja kvaliteeti teemade kaupa eraldi komplektis, seejärel piiratud ulatuses treenida LoRA. - Treenida kogu korpuse peal, kuid vähendada LoRA järku.

Senior
138

Kuidas te kasutaksite täpselt `EXPLAIN`-i, et tuvastada selle päringuga seotud jõudlusprobleeme?

Senior
138

Milline formaliseerimise vorm on teile kõige mugavam: GPH, IP või TК?

Senior
137

Dialoogide tabelis on 80 miljonit sõnumit, ja analüütiline päring hindamise komplektile kestab 25 minutit ning mõnikord tagastab duplikaatpaarid küsimus-vastus. Mida te kõigepealt parandaksite ja miks?

Senior
135

Küsimuste loomisel on suur keelemudel raskesti säilitama stiili haruldastel teemadel. Tehisintellekti-assistent soovitab kohe käivitada LoRA kogu ajaloolise korpuse 2 miljoni dialoogiga, kuid märgistamine on osaliselt mürarikas. Kus sa ei usaldaks seda nõu ja mida eelistaksid esimesena?

Senior
133
/2