Machine Learning / AI
Parquet sxemalarının xüsusiyyətləri nələrdir və niyə ML üçün effektivdirlər?
OCR-nin post-emalı nədir (leksikon, dil modeli yenidən qiymətləndirmə)?
Padding maskası nədir və niyə diqqətdə nəzərə alınmalıdır?
LLM routeri nədir və niyə müxtəlif modellərə sorğular göndərmək lazımdır?
CHRF nədir və harada tətbiq olunur?
Niyə indekslər məlumatların əlavə olunması və yenilənməsini yavaşladır?
Xüsusiyyətin elastikliyini və onun hədəfə təsirini necə qiymətləndirmək olar?
Genişlənən pəncərə və hərəkətli pəncərə kross-validasiyası nədir?
Tibbiyyatda çox balanssız məlumat dəstlərinin təsnifatı nədir?
BERT-də token nədir və hansı tokenləşdirmə variantları mövcuddur?
Hansı üsullar insan qiymətləndirməsindən (LLM-məhkəmər, model qiymətləndirməsi) daha ucuzdur?
Birləşdirmədən sonra daha uzun siyahıdan qalan elementləri əlavə etmək lazımdırmı?
Məzmun filtrələməsi ilə əməkdaşlıq edən filtrələmə arasındakı fərq nədir?
ML xidmətləri üçün inteqrasiya testləri üçün hansı üsullar istifadə olunur?
Uçurumlu regresiya üçün hansı metrik seçilməlidir: MSE və ya MAE?
Məlumatların yenilənməsindən sonra Spark-də join zamanı out of memory xətasını necə ayıklamaq və düzəltmək olar?
Öz- diqqət nədir?
Hər istifadəçi üçün ümumi gəlir (revenue) məbləğini hesablayın
Hansı vəziyyətlərdə numpy istifadə etmək daha yaxşıdır və hansı vəziyyətlərdə Python-un standart məlumat strukturları istifadə olunur?
Mətnlər arasında oxşarlığı hesablamaq üçün vektorlar necə əldə edilir?