Hogyan működött az önjavítás a Text-to-SQL ügynöknél?
Machine Learning / AI
Hogyan szervezték az LLM (DeepSeek R1 33B) inferenciát? Hány GPU, hogyan párhuzamosították?
Meséljen a TechVille-ben található RAG-chat (iChat) architektúrájáról: pipeline, komponensek, technológiák.
Meséljen a Text-to-SQL ügynökről: architektúra, pipeline, technológiák.
Milyen metrikákat használtak a RAG rendszer értékelésére, és hogyan született döntés a bevezetéséről a termelésbe?
Hogyan értékelték a Text-to-SQL ügynök minőségét?
Meséljen az Alrosában a jelentések összefoglaló projektjéről: feladat, megközelítés, további tanítás.
Miért a Qdrant-ot választottátok az Elasticsearch helyett? Milyen előnyei vannak?
Hogyan kezelték a terhelési csúcsokat a RAG rendszerben? Mi történt nagy terhelés esetén?
Milyen rangsorolási metrikákat használtak a visszaszerző értékeléséhez?