Günde 300.000 gönderi ile 10.000 Telegram kanalını depolama ve arama sistemi nasıl tasarlanır, gecikme süresi 2 saniyeden az mı?
Machine Learning / AI
Worker senkron ise, batching olacak mı?
API uç noktasında embeddings'leri senkron olarak doğrudan sayabilir miyiz? FastAPI uç noktasında büyük bir belge akışı için embeddings hesaplanırsa ne olur?
Kanal yazarının tarzında Telegram kanalları için otomatik içerik oluşturma sistemi nasıl tasarlanır?
LoRA ince ayarını nasıl doğruladınız?
Kalite değerlendirme metriği olarak yapay sinir ağı kullandınız mı?
RAG sistemleriyle çalışma deneyiminizden ve son projenizde ne yaptığınızdan bahsedebilir misiniz?
LoRA'yı ne zaman seçmeli ve benzer gönderilerle retrieval ne zaman yapılmalı? Her yaklaşım için kaç veri gerekir?
Bunu kendiniz mi yaptınız (RAG, LoRA, sinir ağlarıyla çalışma) yoksa birine mi yardım ettiniz?
LoRA için hangi rütbeyi belirledin ve o neye bağlı?
Hangi katmanlara LoRA ekledin ve q_proj nedir?
Sistem kalitesini değerlendirmek için hangi metrikleri kullandınız ve nasıl %40'lık bir iyileşme sağladınız?
Sunucu veya bulutta sinir ağları kurdun mu?
Bu mimari için neden vektör veritabanına ihtiyaç var?
LoRA neden az sayıda parametreye rağmen aşırı öğrenmeye eğilimli olabilir? Renk seçimi aşırı öğrenmeyi etkiler mi?