Sobes.tech

Machine Learning / AI

Nella pipeline TTS, l'addestramento è diventato tre volte più lento, carico GPU 20%, memoria GPU 90%. Come trovare il problema?

2

Il punteggio di allineamento e WER sono la stessa cosa?

2

Le modifiche nell'inferenza possono causare la mancanza di parole e ripetizioni di frasi, e in quale parte?

2

Il MOS è aumentato da 4.1 a 4.3, ma il modello a volte manca parole e ripete frasi. Cosa fare?

2

Perché qualcuno potrebbe scegliere il modello A con WER del 3% invece del modello B con WER del 2%?

2

# Completa questo metodo def __init__(self, nums: List[float]): pass # Completa questo metodo def dot_product(self, vec: 'SparseVector') -> float: pass

2

Come valutare la qualità di un modello TTS?

2

È necessario eseguire la normalizzazione del testo durante il preprocessing o l'inferenza?

2

È sempre necessario convertire il testo in fonemi?

2

Cosa succede se il PCM viene registrato a 8 kHz, ma l'intestazione WAV indica 48 kHz, e come suonerà?

2

Parlaci della tua esperienza con TTS.

2

Come preparare 5000 ore di dati vocali di qualità sconosciuta per l'addestramento TTS?

2

Hai condotto test A/B in modo indipendente o insieme all'analisi?

2

In che cosa DDP si differenzia da DataParallel?

1

Quali parametri devono essere usati per valutare la memoria per l'inferenza di LLM e quali ottimizzazioni architettoniche riducono il cache KV?

1

È possibile configurare la ricerca semantica per RAG di notizie per rispondere a chi possiede attualmente lo Stretto di Hormuz durante eventi irregolari?

1
/185