Sobes.tech

Machine Learning / AI

Jak zaprojektować agenta, który odpowiada użytkownikom na podstawie danych z bazy transakcyjnej: jaki stos technologiczny i architektura są potrzebne, i czy warto stosować wieloagentowość?

Senior
196

Jakie optymalizacje inferencji standardowego LLM można zaproponować, jeśli korporacyjny GPT działa wolno?

Senior
183

Czym jest spekulacyjne dekodowanie i jak przyspiesza generację?

Senior
176

Czym jest MoE (Mieszanka Ekspertów) i dlaczego ta architektura może być korzystna dla inferencji?

Senior
167

Dlaczego nie należy używać wektorowego RAG jako głównego mechanizmu dla odpowiedzi w transakcyjnych bazach danych SQL?

Senior
162

Poprawna sekwencja nawiasów Rozważmy sekwencję składającą się z nawiasów okrągłych, kwadratowych i klamrowych '{', '}', '[', ']'. Program powinien określić, czy dana sekwencja nawiasów jest poprawna. - Pusta sekwencja jest poprawna. - Jeśli A jest poprawną sekwencją, to (A), [A], {A} są poprawne. - Jeśli A i B są poprawnymi sekwencjami, to AB jest poprawne. Format wejścia: W jednej linii podana jest sekwencja nawiasów, zawierająca nie więcej niż 100000 nawiasów. Format wyjścia: Jeśli sekwencja jest poprawna, program powinien wypisać 'yes', w przeciwnym razie 'no'.

Senior
162

Co się dzieje dalej w bloku Transformer po tym, jak uwaga wygenerowała wektor wyjściowy?

Senior
162

Jaka jest wymiarowość wyjścia warstwy MLP?

Senior
162

Rozdzielnie przeanalizuj prefill i decode: Q/K/V, formy macierzy i różnice faz.

Senior
162

Po ID tokena i osadzeniu, co dokładnie trafia do dekodera: jaka jest forma reprezentacji, jak dodawana jest informacja pozycyjna i co się dzieje dalej?

Senior
157

Co zrobiono z zgodnością w systemie RAG?

Senior
157

Jak wygląda ogólnie ścieżka aplikacji ML/LLM od Dockerfile i kodu źródłowego do wdrożonej usługi i ruchu użytkowników w Kubernetes?

Senior
153

Co się robi z logitami przed samplingiem i jakie parametry samplingowe znasz?

Senior
149

Przy dekodowaniu, przez co jest mnożony wektor Q i co się uzyskuje?

Senior
145

Jakie ważne tematy o sobie lub swoim stylu pracy chciałbyś dodatkowo podkreślić przed przełożonym?

Senior
143

Czym wyczyszczono i znormalizowano dokumenty: Redis czy regex?

Senior
140

Dlaczego kwantyzowany LLM może działać szybciej i dlaczego czasami kwantyzacja, przeciwnie, spowalnia inferencję?

Senior
140

Z jakiego IDE lub środowiska korzystasz do pracy z narzędziami AI?

Senior
139

import unittest class Solution: def isvalid(self, s:str) -> bool: matching_brackets = { ")": "(", "]": "[", "}": "{", } stack: list[str] = [] for bracket in s: if bracket in "([{": stack.append(bracket) continue if bracket not in matching_brackets: return False if not stack or stack[-1] != matching_brackets[bracket]: return False stack.pop() return not stack class SolutionTest: def __init__(self): self.Solution = Solution() def run(self): test_cases = [ ("", True), ("()", True), ("(){}[]", True), ("(({}))", True), ("(", False), (")", False), ("(((", False), ("{[]}", False), ] for brackets, expected in test_cases: actual = self.Solution.isvalid(brackets) assert actual == expected, ( f"Błąd dla {brackets!r}" f"Oczekiwano {expected}, ale otrzymano {actual}" ) print(f"Wszystkie testy przeszły pomyślnie: {len(test_cases)}") if __name__ == "__main__": SolutionTest().run()

Senior
137

Jakie istnieją rodzaje uwagi, które pozwalają uniknąć kwadratowej złożoności pełnej samouwagi w długim kontekście?

Senior
135
/2