[imię] zapytał: Ile czasu zajęła implementacja mniej więcej gotowego rozwiązania odtwarzacza?
Frontend
[imię] zapytał: Kto zatwierdził umowy z backendem podczas realizacji zadania?
Ile jednoczesnych połączeń może obsłużyć usługa i jak oszacować tę wartość na podstawie 1 miliona codziennych aktywnych użytkowników, szczytowego obciążenia i czasu życia połączenia?
[imię] zapytał: Co sądzisz o projekcie, nad którym pracujesz?
[imię] zapytał: Oprócz celu ukończenia projektu, jakie inne cele biznesowe lub techniczne zostały wyznaczone dla zespołu? Jakie były kryteria sukcesu?
Jak oszacować RPS zapytań do LLM na podstawie częstotliwości wiadomości od użytkowników, czasu trwania sesji i liczby użytkowników, i porównać je z przepustowością modelu?
[imię] zapytał: Wyobraź sobie, że teraz wdrożenie polega tylko na skopiowaniu plików na zdalną maszynę i uruchomieniu pnpm start. Aplikacja stała się rozwiązaniem o dużym obciążeniu z RPS do 1000. Jak skonfigurowałbyś CI/CD dla tego projektu?
[imię] zapytał: Czy masz praktyczne doświadczenie w pracy z CI?
[imię] zapytał: Opowiedz mi więcej o testach, które napisałeś i o rodzajach testów, które znasz, ale jeszcze nie zastosowałeś w praktyce.
Jak dostarczyć wygenerowany HTML do sandboxed iframe i zorganizować interakcję między stroną główną a iframe?
Jak bezpiecznie wyświetlać HTML i interaktywny kod wygenerowany przez model w przeglądarce?
Jakie zagrożenia bezpieczeństwa są istotne dla takiego projektu i jakie środki należy podjąć?
[imię] zapytał: Czy architekt był ogólnie odpowiedzialny za architekturę frontendu, czy na front-endzie był osobny odpowiedzialny za to?
Jak zorganizować kolejkę, ograniczyć szybkość i obsługiwać żądania do LLM, gdy przekroczona jest dostępna przepustowość modelu?
[imię] zapytał: Czy masz doświadczenie w pracy z narzędziami AI?
Jak wdrożyć i skalować mikroserwisy, workerów i obsługiwacze połączeń na wielu maszynach i zarządzać tą infrastrukturą?
[imię] zapytał: Co możesz powiedzieć o zaletach i wadach pracy w Yandex?
[imię] zapytał: Który z tych projektów był najnowszy?
[imię] zapytał: Skup się na jednym konkretnym zadaniu: opisz harmonogram, złożoność i trzy główne wyzwania techniczne, z którymi się zmierzyłeś.
Jak zaprojektować i skalować usługę czatu z LLM: wybrać między SSE a WebSocket do komunikacji klient-serwer, zorganizować strumieniowe przesyłanie odpowiedzi modelu i obsługę żądań?