Sobes.tech

Machine Learning / AI

Im TTS-Pipeline ist das Training dreimal langsamer geworden, GPU-Auslastung 20%, GPU-Speicher 90%. Wie findet man das Problem?

2

Sind Alignment-Score und WER dasselbe?

2

Können Änderungen in der Inferenz zu fehlenden Wörtern und wiederholten Phrasen führen, und in welchem Teil?

2

Der MOS stieg von 4,1 auf 4,3, aber das Modell verpasst manchmal Wörter und wiederholt Phrasen. Was tun?

2

Warum könnte jemand Modell A mit WER von 3 % gegenüber Modell B mit WER von 2 % wählen?

2

# Vervollständigen Sie diese Methode def __init__(self, nums: List[float]): pass # Vervollständigen Sie diese Methode def dot_product(self, vec: 'SparseVector') -> float: pass

2

Wie bewertet man die Qualität eines TTS-Modells?

2

Ist es notwendig, die Textnormalisierung während des Preprocessings oder der Inferenz durchzuführen?

2

Ist es immer notwendig, Text in Phoneme umzuwandeln?

2

Was passiert, wenn PCM bei 8 kHz aufgenommen wird, aber im WAV-Header 48 kHz angegeben ist, und wie klingt das?

2

Erzählen Sie uns von Ihrer Erfahrung mit TTS.

2

Wie bereitet man 5000 Stunden Sprachdaten unbekannter Qualität für das Training von TTS vor?

2

Haben Sie A/B-Tests eigenständig oder zusammen mit Analytics durchgeführt?

2

Worin unterscheidet sich DDP von DataParallel?

1

Welche Parameter sollten verwendet werden, um den Speicher für die LLM-Inferenz zu bewerten, und welche architektonischen Optimierungen reduzieren den KV-Cache?

1

Kann die semantische Suche für Nachrichten-RAG so konfiguriert werden, dass sie beantwortet, wer derzeit den Persischen Golf kontrolliert, während unregelmäßiger Ereignisse?

1
/185