Sobes.tech

Machine Learning / AI

Wie man einen Agenten entwirft, der auf Basis von Transaktionsdaten auf Benutzeranfragen antwortet: Welche Technologie-Stack und Architektur sind erforderlich, und ist der Einsatz von Multi-Agenten sinnvoll?

Senior
188

Welche Optimierungen der Inferenz für ein Standard-LLM können vorgeschlagen werden, wenn das Unternehmens-GPT langsam arbeitet?

Senior
177

Was ist spekulatives Decoding und wie beschleunigt es die Generierung?

Senior
172

Was ist MoE (Mixture of Experts) und warum könnte diese Architektur für die Inferenz vorteilhaft sein?

Senior
162

Unterscheide separat zwischen prefill und decode: Q/K/V, Matrizenformen und Phasenunterschiede.

Senior
157

Warum sollte man Vektor-RAG nicht als Hauptmechanismus für Antworten in transaktionalen SQL-Datenbanken verwenden?

Senior
155

Gültige Klammerfolge Betrachten wir eine Sequenz aus runden, eckigen und geschweiften Klammern '{', '}', '[', ']'. Das Programm soll bestimmen, ob diese Klammerfolge korrekt ist. - Eine leere Sequenz ist korrekt. - Wenn A eine korrekte Sequenz ist, dann sind (A), [A], {A} korrekt. - Wenn A und B korrekte Sequenzen sind, dann ist AB korrekt. Eingabeformat: In einer einzigen Zeile wird die Klammerfolge eingegeben, die nicht mehr als 100000 Klammern enthält. Ausgabeformat: Wenn die Sequenz korrekt ist, soll das Programm 'yes' ausgeben, andernfalls 'no'.

Senior
155

Nach Token-ID und Einbettungen, was genau gelangt in den Decoder: Wie ist die Form der Darstellungen, wie wird die Positionsinformation hinzugefügt und was passiert als Nächstes?

Senior
155

Was passiert als Nächstes im Transformer-Block, nachdem die Aufmerksamkeit den Ausgabvektor erzeugt hat?

Senior
148

Wie groß ist die Ausgabedimension der MLP-Schicht?

Senior
148

Was wurde mit der Compliance im RAG-System gemacht?

Senior
146

Was macht man vor dem Sampling mit den Logits und welche Sampling-Parameter kennst du?

Senior
140

Wie verläuft im Allgemeinen der Weg einer ML/LLM-Anwendung vom Dockerfile und Quellcode bis zum bereitgestellten Service und Nutzerverkehr in Kubernetes?

Senior
136

Wird der Q-Vektor beim Decodieren multipliziert und was ergibt sich daraus?

Senior
136

Welche wichtigen Themen über dich oder deinen Arbeitsstil möchtest du dem Vorgesetzten zusätzlich hervorheben?

Senior
133

import unittest class Solution: def isvalid(self, s:str) -> bool: matching_brackets = { ")": "(", "]": "[", "}": "{", } stack: list[str] = [] for bracket in s: if bracket in "([{": stack.append(bracket) continue if bracket not in matching_brackets: return False if not stack or stack[-1] != matching_brackets[bracket]: return False stack.pop() return not stack class SolutionTest: def __init__(self): self.Solution = Solution() def run(self): test_cases = [ ("", True), ("()", True), ("(){}[]", True), ("(({}))", True), ("(", False), (")", False), ("(((", False), ("{[]}", False), ] for brackets, expected in test_cases: actual = self.Solution.isvalid(brackets) assert actual == expected, ( f"Fehler für {brackets!r}" f"Wir wollten {expected} bekommen, aber haben {actual}" ) print(f"Alle Tests bestanden: {len(test_cases)}") if __name__ == "__main__": SolutionTest().run()

Senior
133

Welche Arten von Attention gibt es, die die quadratische Komplexität der vollständigen Selbstaufmerksamkeit bei langen Kontexten vermeiden lassen?

Senior
131

Welches IDE oder welche Umgebung verwendest du für die Arbeit mit KI-Tools?

Senior
129

Was wurde zur Reinigung und Normalisierung der Dokumente verwendet: Redis oder regex?

Senior
129

Warum kann eine quantisierte LLM schneller arbeiten und warum verlangsamt Quantisierung manchmal die Inferenz?

Senior
128
/2