Reconocimiento del habla
Mejorar la calidad, la robustez y la adaptación al dominio del ASR multilingüe en condiciones ruidosas.
Área de investigación
Avanzando sistemas de habla, IA conversacional e interfaces nativas de voz mediante investigación en flujos de baja latencia, gestión de interrupciones, reconocimiento robusto y generación de respuestas naturales en entornos del mundo real.
Pilares clave de investigación
Mejorar la calidad, la robustez y la adaptación al dominio del ASR multilingüe en condiciones ruidosas.
Diseñar estrategias de toma de turnos, retención de contexto y diálogo para interacciones habladas naturales.
Construir sistemas TTS expresivos, controlables y de baja latencia para uso en producción.
Optimizar la latencia de extremo a extremo, la fiabilidad de la transmisión y el procesamiento de voz consciente de interrupciones.
Crear modelos de interacción orientados a la voz para asistentes, herramientas y experiencias inteligentes integradas.
Enfoque actual
Colabora con OpenQCore Research para construir sistemas de inteligencia de voz fiables, naturales y escalables.