Elektrine lite

← Feed

@kupaye@zirk.us

Post #1498588

2026-04-12 13:31 UTC

@pudupudu no me queda claro a qué te refieres. pero por ahora no tengo ni de cerca un millón de palabras grabadas (+100 horas), tampoco me he metido con TTS-STT, pero le tengo el ojo puesto al modelo XLSR para representar patrones acústicos (basado en wav2vec 2.0). aparentemente se puede usar con pocas horas, podría funcionar en lenguas con escasos recursos digitales (<10 horas, ciertas condiciones aplican). simulaciones que deben probarse. https://arxiv.org/pdf/2006.13979 ¿qué tienen ustedes?

Replies (1)

  • @pudupudu@tuiter.rocks 2026-04-12 19:10

    @kupaye el resultado final es un modelo que se puede usar en Bergamot https://share.google/3ZLJCzk4XxckFSC3P Para eso, hace falta tener material que permita traducir a un lenguaje conocido. Su además tenés material hablado es mejor, pero hace falta la transcripción.

    Open ##1498589