[jméno] se zeptal: Képzelje el, hogy most a telepítés csak fájlok másolását jelenti egy távoli gépre, és a pnpm start futtatását. Az alkalmazás magas terhelésű megoldássá vált, RPS akár 1000-ig. Hogyan állítaná be a CI/CD-t ehhez a projekthez?
Frontend
[jméno] se zeptal: Máš praktické zkušenosti s prací s CI?
[jméno] se zeptal: Povídej mi víc o testech, které jsi napsal, a o typech testů, které znáš, ale ještě jsi je v praxi nevyzkoušel?
Kolik současných připojení může služba zvládnout a jak odhadnout tuto hodnotu na základě 1 milionu denně aktivních uživatelů, špičkové zátěže a doby trvání připojení?
[jméno] se zeptal: Byl architekt obecně zodpovědný za architekturu frontendu, nebo byla na frontendu samostatná osoba za to zodpovědná?
[jméno] se zeptal: Máte zkušenosti s nástroji umělé inteligence?
[jméno] se zeptal: Co můžete říct o výhodách a nevýhodách práce v Yandexu?
Kde a jak by měly být tajné klíče pro LLM, databáze a fronty uloženy a přenášeny, aby nedošlo k jejich vystavení v kódu a repozitářích?
[jméno] se zeptal: Který z těchto projektů byl nejnovější?
[jméno] se zeptal: Zaměřte se na jeden konkrétní úkol: popište časové plány, složitost a tři hlavní technické výzvy, kterým jste čelili.
[jméno] se zeptal: Pracoval jste někdy s SSR?
[jméno] se zeptal: Povídej o největším a technicky nejkomplexnějším konkrétním úkolu nebo funkci, s kterou ses setkal.
Kdo by měl číst úkoly z fronty a posílat je do LLM, a jak publikovat části a konečné výsledky odpovědi zpět do fronty?
Jak se objeví tajemství v bráně LLM při použití Kubernetes a integraci s úložištěm tajemství?
Kdo by měl číst výsledky z fronty, ukládat zprávy a chaty do databází a posílat streamovaná data do otevřeného SSE připojení?
Jak doručit generovaný HTML do sandboxovaného iframe a jak organizovat interakci mezi rodičovskou stránkou a iframe?
Jak odhadnout RPS požadavky na LLM na základě frekvence zpráv od uživatelů, délky relace a počtu uživatelů a porovnat je s propustností modelu?
Jaká bezpečnostní rizika jsou pro takový projekt významná a jaká opatření je třeba přijmout?
Jak zorganizovat frontu, omezit rychlost a zpracovávat požadavky na LLM, když je překročena dostupná propustnost modelu?
Jak navrhnout a škálovat chatovou službu s LLM: vybrat mezi SSE a WebSocketem pro komunikaci klient-server, organizovat streamování odpovědí modelu a zpracovávat požadavky?