Sobes.tech

Machine Learning / AI

W pipeline TTS trening stał się trzy razy wolniejszy, obciążenie GPU 20%, pamięć GPU 90%. Jak znaleźć problem?

2

Czy wynik wyrównania i WER to to samo?

2

Czy zmiany w inferencji mogą powodować pomijanie słów i powtarzanie fraz, i w której części?

2

MOS wzrosło z 4,1 do 4,3, ale model czasami pomija słowa i powtarza frazy. Co zrobić?

2

Dlaczego ktoś mógłby wybrać model A z WER 3% zamiast modelu B z WER 2%?

2

# Uzupełnij tę metodę def __init__(self, nums: List[float]): pass # Uzupełnij tę metodę def dot_product(self, vec: 'SparseVector') -> float: pass

2

Jak ocenić jakość modelu TTS?

2

Czy konieczne jest przeprowadzenie normalizacji tekstu podczas preprocessingu lub inferencji?

2

Czy zawsze konieczne jest przekształcanie tekstu na fonemy?

2

Co się stanie, jeśli PCM jest nagrany z częstotliwością 8 kHz, ale nagłówek WAV wskazuje 48 kHz, i jak to zabrzmi?

2

Opowiedz o swoim doświadczeniu z TTS.

2

Jak przygotować 5000 godzin danych głosowych o nieznanej jakości do treningu TTS?

2

Czy przeprowadzałeś testy A/B samodzielnie, czy razem z analizą?

2

Czym różni się DDP od DataParallel?

1

Jakie parametry należy użyć do oceny pamięci dla inferencji LLM i jakie optymalizacje architektoniczne zmniejszają KV-cache?

1

Czy można skonfigurować wyszukiwanie semantyczne dla RAG wiadomości, aby odpowiadało, kto obecnie posiada Cieśninę Ormuz podczas nieregularnych wydarzeń?

1
/185