Sobes.tech

Machine Learning / AI

En la tubería de TTS, el entrenamiento se ha vuelto tres veces más lento, carga de GPU 20%, memoria de GPU 90%. ¿Cómo encontrar el problema?

2

¿La puntuación de alineación y WER son lo mismo?

2

¿Pueden los cambios en la inferencia causar la omisión de palabras y repeticiones de frases, y en qué parte?

2

MOS aumentó de 4.1 a 4.3, pero el modelo a veces omite palabras y repite frases. ¿Qué hacer?

2

¿Por qué alguien podría elegir el modelo A con WER del 3% en lugar del modelo B con WER del 2%?

2

# Completa este método def __init__(self, nums: List[float]): pass # Completa este método def dot_product(self, vec: 'SparseVector') -> float: pass

2

¿Cómo evaluar la calidad de un modelo TTS?

2

¿Es necesario realizar la normalización del texto durante el preprocesamiento o la inferencia?

2

¿Es siempre necesario convertir el texto en fonemas?

2

Si el PCM se graba a 8 kHz, pero la cabecera WAV indica 48 kHz, ¿qué pasará y cómo sonará?

2

Cuéntenos sobre su experiencia trabajando con TTS.

2

¿Cómo preparar 5000 horas de datos de voz de calidad desconocida para entrenar TTS?

2

¿Realizaste pruebas A/B de forma independiente o junto con análisis?

2

¿En qué se diferencia DDP de DataParallel?

1

¿Qué parámetros se deben usar para evaluar la memoria en la inferencia de LLM y qué optimizaciones arquitectónicas reducen el KV-cache?

1

¿Se puede configurar la búsqueda semántica para RAG de noticias para responder quién actualmente posee el Estrecho de Ormuz durante eventos irregulares?

1
/185