Sobes.tech

Machine Learning / AI

La proiectul la care ai lucrat pentru implementarea serviciilor și dezvoltarea serviciilor FastAPI: ai făcut asta singur sau doar ai întreținut și ai monitorizat?

Senior
148

Cum să păstrezi în starea LangGraph o cantitate mare de informații obținute prin API, să le folosești în interiorul instrumentului, dar fără a transmite date inutile în contextul LLM? De exemplu, LLM vede doar ID-ul și numele specialiștilor, în timp ce instrumentul primește programul lor și date suplimentare.

Senior
148

Cum să faci în practică ca un model într-un câmp specific să genereze doar valori dintr-o listă scurtă de ID-uri de șiruri și niciun alt simbol?

Senior
146

Cum să antrenezi un LLM să nu răspundă în cazul în care nu există informații în context?

Senior
142

Cum se transmite un schemă de model pentru ieșire structurată la nivel de cod?

Senior
141

Ce se poate face dacă un agent implementat răspunde prea lent sau nu există suficientă memorie pentru a găzdui un LLM?

Senior
140

Ce este probabilitatea de examinare?

140

Cum ați implementat și implementat serviciul pentru procesarea pull request-urilor?

Senior
137

Orchestratorul vede rezultatele apelurilor instrumentelor subagent sau doar rezultatul final al subagentului însuși?

Senior
137

Spuneți-ne mai multe despre cache-ul KV: cum funcționează și de unde provine, începând cu arhitectura Transformer.

Senior
136

Ce alte metode de optimizare pot fi utilizate pentru a accelera inferența sau cel puțin pentru a plasa modelul în 12 GB VRAM pe RTX 3090?

Senior
135

Cum să verifici dacă LLM-as-a-Judge evaluează corect calitatea și cum să o calibrați?

Senior
133

Cum se obține un răspuns formalizat și structurat, de exemplu, atunci când se utilizează output structurat?

Senior
132

Cum este construit orchestratorul: ce framework și arhitectură sunt utilizate, ce face, este de o singură etapă sau poate gândi de mai multe ori înainte de a răspunde?

Senior
130

Cum influențează creșterea dialogului și a contextului viteza de procesare a răspunsurilor?

Senior
117

Care sunt opțiunile de eșantionare a noilor tokeni în LLM?

Senior
116

De ce ai decis să părăsești locul de muncă actual?

Middle
112

Care este diferența dintre modelele dense și MoE, de exemplu Qwen3-27B și Qwen3-30B-A3B?

Senior
111

Ce trebuie făcut după retrieval pentru a forma răspunsul către utilizator și cum se evaluează calitatea generării în RAG?

Senior
110
/4