Sobes.tech

Machine Learning / AI

Na pipeline TTS, o treino tornou-se três vezes mais lento, carga da GPU 20%, memória da GPU 90%. Como encontrar o problema?

2

A pontuação de alinhamento e o WER são a mesma coisa?

2

As mudanças na inferência podem causar a omissão de palavras e repetições de frases, e em qual parte?

2

O MOS aumentou de 4,1 para 4,3, mas o modelo às vezes omite palavras e repete frases. O que fazer?

2

Por que alguém escolheria o modelo A com WER de 3% em vez do modelo B com WER de 2%?

2

# Complete este método def __init__(self, nums: List[float]): pass # Complete este método def dot_product(self, vec: 'SparseVector') -> float: pass

2

Como avaliar a qualidade de um modelo TTS?

2

É necessário realizar a normalização do texto durante o pré-processamento ou a inferência?

2

É sempre necessário converter o texto em fonemas?

2

O que acontece se o PCM for gravado a 8 kHz, mas o cabeçalho WAV indicar 48 kHz, e como soará?

2

Fale-nos sobre sua experiência com TTS.

2

Como preparar 5000 horas de dados de fala de qualidade desconhecida para treinar TTS?

2

Realizou testes A/B de forma independente ou juntamente com análise?

2

Como o DDP difere do DataParallel?

1

Quais parâmetros devem ser usados para avaliar a memória na inferência de LLM e que otimizações arquitetónicas reduzem o KV-cache?

1

É possível configurar a pesquisa semântica para RAG de notícias para responder quem atualmente possui o Estreito de Ormuz durante eventos irregulares?

1
/185