Sobes.tech

Machine Learning / AI

În pipeline-ul TTS, antrenamentul a devenit de trei ori mai lent, încărcarea GPU 20%, memoria GPU 90%. Cum se identifică problema?

2

Este scorul de aliniere și WER același lucru?

2

Schimbările în inferență pot cauza lipsa cuvintelor și repetarea frazelor, și în care parte?

2

MOS a crescut de la 4.1 la 4.3, dar model uneori ratează cuvinte și repetă fraze. Ce să fac?

2

De ce cineva ar alege modelul A cu WER de 3% în locul modelului B cu WER de 2%?

2

# Completează această metodă def __init__(self, nums: List[float]): pass # Completează această metodă def dot_product(self, vec: 'SparseVector') -> float: pass

2

Cum se evaluează calitatea unui model TTS?

2

Este necesar să se efectueze normalizarea textului în timpul preprocesării sau inferenței?

2

Este întotdeauna necesar să convertiți textul în foneme?

2

Ce se întâmplă dacă PCM este înregistrat la 8 kHz, dar antetul WAV indică 48 kHz, și cum va suna?

2

Spuneți-ne despre experiența dvs. cu TTS.

2

Cum să pregătiți 5000 de ore de date vocale de calitate necunoscută pentru antrenarea TTS?

2

Ai efectuat teste A/B independent sau împreună cu analiza?

2

Cum diferă DDP de DataParallel?

1

Ce parametri ar trebui utilizați pentru a evalua memoria pentru inferența LLM și ce optimizări arhitecturale reduc cache-ul KV?

1

Este posibil să se configureze căutarea semantică pentru RAG de știri pentru a răspunde cine deține în prezent Strâmtoarea Hormuz în timpul evenimentelor neregulate?

1
/185