Sobes.tech

Machine Learning / AI

Hoe ontwerp je een agent die reageert op gebruikers op basis van gegevens uit een transactionele database: welke stack en architectuur zijn nodig, en is het zinvol om multi-agentiteit toe te passen?

Senior
198

Welke optimalisaties voor inferentie van standaard LLM kunnen worden voorgesteld als de bedrijfs-GPT traag werkt?

Senior
187

Wat is speculatieve decoding en hoe versnelt het de generatie?

Senior
184

Wat is MoE (Mixture of Experts) en waarom kan deze architectuur voordelig zijn voor inferentie?

Senior
171

Wat gebeurt er daarna in de Transformer-blok nadat de aandacht de uitgangsvector heeft gegeven?

Senior
170

Waarom moet vector RAG niet worden gebruikt als het belangrijkste mechanisme voor antwoorden in transactionele SQL-databases?

Senior
168

Wat is de uitgangsdimensie van de MLP-laag?

Senior
168

Correcte haakjesreeks Laten we een reeks beschouwen die bestaat uit ronde, vierkante en accolades '{', '}', '[', ']'. Het programma moet bepalen of deze haakjesreeks correct is. - Een lege reeks is correct. - Als A een correcte reeks is, dan zijn (A), [A], {A} correct. - Als A en B correcte reeksen zijn, dan is AB correct. Invoerschema: In één regel wordt de haakjesreeks ingevoerd, met niet meer dan 100000 haakjes. Uitvoerschema: Als de reeks correct is, moet het programma 'yes' afdrukken, anders 'no'.

Senior
166

Analyseer prefill en decode afzonderlijk: Q/K/V, matrixvormen en faseverschillen.

Senior
164

Na token-ID en embeddings, wat komt er precies in de decoder: wat is de vorm van de representaties, hoe wordt de positionele informatie toegevoegd en wat gebeurt er daarna?

Senior
163

Hoe verloopt over het algemeen de weg van een ML/LLM-toepassing vanaf Dockerfile en broncode tot een uitgeruste service en gebruikersverkeer in Kubernetes?

Senior
161

Wat werd er gedaan met compliance in het RAG-systeem?

Senior
157

Wat wordt er gedaan met de logits vóór het sampling en welke samplingparameters ken je?

Senior
156

Waarmee wordt de Q-vector vermenigvuldigd tijdens decoding en wat wordt er verkregen?

Senior
149

Welke belangrijke onderwerpen over jezelf of je werkstijl wil je extra benadrukken aan de leidinggevende?

Senior
145

Welke IDE of omgeving gebruik je voor het werken met AI-tools?

Senior
142

Waarom kan een gekwantiseerde LLM sneller werken en waarom vertraagt kwantisatie soms juist de inferentie?

Senior
142

Wat werd gebruikt om documenten te reinigen en te normaliseren: Redis of regex?

Senior
142

Welke soorten aandacht bestaan er die de kwadratische complexiteit van volledige zelfaandacht bij lange contexten kunnen voorkomen?

Senior
140

Beschrijf stap voor stap het pad van het gebruikersbericht door LLM tijdens inferentie — van chat tot antwoord, inclusief architectonische details van de Transformer.

Senior
139
/2