Machine Learning / AI
Pseudo-labeling nedir ve riskleri nelerdir?
Neden doğrudan orijinal veritabanıyla çalışmıyoruz?
Hangi optimizasyon algoritmalarını biliyorsunuz (SGD, Momentum, RMSProp, Adam, AdamW)? Fikirleri ve farkları nelerdir?
Arama için sorgu seçenekleri nereden geliyordu?
Bir sütundaki sıfır olmayan öğelerin sayısını nasıl sayılır?
RAG (chunking, embeddings, Milvus) için belgeleri nasıl hazırladınız?
Partitioning ile sharding arasındaki fark nedir?
Sınıflandırma görevleri için hangi metrikleri sayabilirsin? Her biri hakkında bana anlat.
Veri miktarı nereden biliniyor?
Model kartı nedir ve ne işe yarar?
Popülerlik-bayas nedir ve onunla nasıl mücadele edilir?
Histogram tabanlı gradyan artırma nedir?
Occupancy nedir ve nasıl optimize edilir?
Hangi veri kalitesi sorunlarıyla karşılaştınız?
Boosting ile bagging (Random Forest) arasındaki fark nedir? Aşırı uyum eğilimlerini karşılaştırın.
Doğrusal ve lojistik regresyon arasındaki fark nedir?
Veriler anonimleştirildi mi?
Python'da bir sözlüğe ekleme ve indeksleme işlemlerinin ortalama ve en kötü durum karmaşıklığı nedir?
Büyük metin verilerini (yaklaşık 10 GB) aktarmak için hangi seçenek daha iyidir?
İş yerinde en sık kiminle iletişim kuruyorsun?