Sobes.tech

Machine Learning / AI

Jak uložit do stavu LangGraph velké množství informací získaných přes API, použít je uvnitř nástroje, ale nezahrnovat zbytečná data do kontextu LLM? Například LLM vidí pouze ID a jména odborníků, zatímco nástroj obdrží jejich rozvrh a doplňující údaje.

Senior
147

Jaký je váš současný status jako kandidáta? Pracujete nebo jste odešel?

Middle
146

Jak v praxi zajistit, aby model v konkrétním poli generoval pouze hodnoty z krátkého seznamu řetězcových ID a žádné jiné znaky?

Senior
146

Jak trénovat LLM, aby ne odpovídal, když v kontextu není žádná informace?

Senior
142

Jak na úrovni kódu předat schéma modelu pro strukturovaný výstup?

Senior
141

Co je to pravděpodobnost zkoušky?

140

Co lze udělat, pokud nasazený agent odpovídá příliš pomalu nebo není dostatek paměti pro umístění LLM?

Senior
140

Vidí orchestrátor výsledky volání nástrojů subagenta nebo pouze konečný výstup samotného subagenta?

Senior
137

Jak jste implementovali a nasadili službu pro zpracování pull requestů?

Senior
137

Povězte nám více o KV cache: jak funguje a odkud pochází, začínaje architekturou Transformer.

Senior
136

Jaké další metody optimalizace lze použít k urychlení inference nebo alespoň k umístění modelu do 12 GB VRAM na RTX 3090?

Senior
135

Jak ověřit, že LLM-as-a-Judge správně hodnotí kvalitu a jak ji kalibrovat?

Senior
133

Jak dosáhnout formalizované, strukturované odpovědi, například při použití strukturovaného výstupu?

Senior
132

Jak je orchestrátor postaven: jaký rámec a architektura jsou použity, co dělá, je to jednopásmový nebo může několikrát přemýšlet před odpovědí?

Senior
130

Jak růst dialogu a kontextu ovlivňuje rychlost zpracování odpovědí?

Senior
117

Jaké jsou možnosti vzorkování nových tokenů v LLM?

Senior
116

V čem se liší dense- a MoE-modely, například Qwen3-27B a Qwen3-30B-A3B?

Senior
111

Co je třeba udělat po retrievalu, aby se vytvořila odpověď uživateli, a jak hodnotit kvalitu generování v RAG?

Senior
110

Kdo se podílel na ladění modelů?

Middle
105
/4