Machine Learning / AI
Mi az a 3D párhuzamosság (adat + tensor + pipeline)?
Milyen feladatokat tartasz ideálisnak, és mivel szeretnél foglalkozni?
Hogyan közelítsük meg az objektumdetektálási feladatot erős adatkiegyensúlyozatlansággal?
Mesélj, hogyan van kialakítva az együttműködés a külföldi céggel az IP kapcsán — jogi személy a RF-ben vagy hogyan van felépítve?
Mi az a safety classifier a párbeszéd kimeneténél?
Hogyan értékelte a támogatási jegyek osztályozási rendszerének készenlétét a telepítéshez?
Figyelembe vették-e a szezonális hatást, mivel csak három hónapot vettél?
Hogyan valósítható meg egy számláló életidejével a Redis-ben az automatik híváselutasítás feladathoz?
Mi az a párhuzamosság az inferenciában?
Mesélj a RAG-ben lévő hibrid lekérdezésről — melyik modellt választottad a sűrű vektorokhoz?
Beszélj a tesztekről (smoke, funkcionális, e2e)
Hozzá lehet adni egy mezőt a táblához a SELECT lekérdezés helyett?
Hogyan futtassunk egy nagy modellt gyenge hardveren?
Hogyan számoljuk ki a kérdések közötti koszinusz hasonlóságot?
Ez valahogy kapcsolódott a fejlesztéshez vagy valamihez, amin dolgoztál?
Gyakorlati feladat Milyen artefaktumkészlet teszi lehetővé két LoRA futtatásának őszinte összehasonlítását? - Csak a végső minőségi táblázat. - Kód és a végső metrika képernyőképe a commitban. - Kód és a kísérlet konfigurációs fájlja. - Kód, adathash, alapmodell, LoRA konfiguráció, függőségek és indítási parancs. - Csak link a Git ágára. - Kód, LoRA paraméterek, az alapmodell verziója és függőségek.
Miért ad jobb eredményt a BERT szövegosztályozási feladatokban, mint a TF-IDF és a logisztikus regresszió?
Milyen jellemzői vannak a PII-val való munkának az adatkészlet elkészítése során?
Hogyan hozzunk létre és tanítsunk egy osztályozót a PyTorch-ban?
Hogyan működik a tokenizálás? Miért használnak subword-tokeneket a teljes szavak helyett?