Documentos de trabajo · habla, salud e IA fiableVigo, 2026

Investigación

Todos los artículos, agrupados por línea de trabajo. Cada entrada empieza con una frase en lenguaje llano; la cita completa está a un clic.

§1 La voz como señal clínica

  1. [1]

    Un paseo corto hace más fiable el cribado por voz: las toses y vocales grabadas tras el ejercicio revelan las secuelas post-COVID mejor que las grabadas en reposo.

    Vera-López Á. et al. · Frontiers in Medicine · 2026

    Cita completa

    Vera-López Á., Tilves-Santiago D., Ramírez-Sánchez J.M., Docío-Fernández L., García-Mateo C., Bustillo-Casado M., García-Caballero A.A. Improving respiratory disease detection through SSL-enhanced acoustic analysis and exercise-rest measurements. Frontiers in Medicine, 2026.

  2. [4]

    Los biomarcadores de voz necesitan una validación de nivel clínico: una extensión del marco V3, centrada en el ciclo de vida de los datos de los ensayos, y una herramienta abierta para evaluar datasets de voz y salud.

    Ramírez J.M. et al. · XoveTIC · 2024

    Conference DOI
    Cita completa

    Ramírez J.M., Docío-Fernández L., García-Mateo C. Dataset-Driven Voice Biomarker Validation: Advancing Clinical Standards with the Enhanced V3 Framework. XoveTIC 2024 (7th XoveTIC Congress, A Coruña), 2024.

  3. [6]

    El primer estudio que comprueba si las grabaciones de voz bastan para distinguir a pacientes con COVID persistente de personas sanas. Las toses tras el esfuerzo funcionaron mejor.

    Ramírez Sánchez J.M. et al. · JMIR Preprints · 2023

    Cita completa

    Ramírez Sánchez J.M., Docío-Fernández L., García Mateo C., Bustillo-Casado M., García-Caballero A.A. Identifying patients with Long COVID: study of the effectiveness of voice signal analysis and machine learning. JMIR Preprints, 2023.

§2 IA para la salud mental y salvaguardas conversacionales

  1. [2]

    Un conjunto de datos abierto, psicométrico y demográfico, de adolescentes con alto riesgo de suicidio, publicado para una IA de salud mental reproducible.

    Ramírez Sánchez J.M. et al. · Zenodo · 2026

    Dataset DOI
    Cita completa

    Ramírez Sánchez J.M., Manso-Vázquez M., Gómez Gómez B., et al. VisIA-Q: A cross-sectional psychometric and demographic dataset of adolescents at high-risk for suicide. Zenodo, 2026.

  2. [3]

    Un agente conversacional diseñado para detectar factores de riesgo suicida durante una conversación en directo y responder de forma segura cuando los encuentra.

    Ramírez Sánchez J.M. et al. · IWSDS · 2025

    Conference Link
    Cita completa

    Ramírez Sánchez J.M., Manso Vázquez M., García-Mateo C., Docío-Fernández L., Fernández-Iglesias M.J., Gómez-Gómez B., Pinal B., Brañas A., García-Caballero A. Design of a conversational agent to support people on suicide risk. IWSDS 2025 (International Workshop on Spoken Dialogue Systems Technology), 2025.

  3. [5]

    El plan de VisIA: un sistema multimodal que detecta malestar emocional y un agente conversacional por voz basado en guías clínicas, para evaluar el riesgo suicida en jóvenes de forma no invasiva.

    Ramírez Sánchez J.M. et al. · IberSPEECH · 2024

    Conference DOI
    Cita completa

    Ramírez Sánchez J.M., Manso M., García-Mateo C., Gómez-Gómez B., Pinal B., Brañas A., García Caballero A., Docío-Fernández L., Fernández-Iglesias M.J. VisIA Project: design of an automated AI-based emotional distress and suicide risk detection system. IberSPEECH 2024, 2024.

§3 Reconocimiento de voz robusto y búsqueda en habla

  1. [9]

    Resultados de una evaluación internacional sobre la búsqueda de palabras y frases habladas en audio de varios dominios.

    Tejedor J. et al. · Applied Sciences · 2021

    Journal DOI
    Cita completa

    Tejedor J., Toledano D.T., Ramírez J.M., Montalvo A.R., Álvarez-Trejos J.I. The Multi-Domain International Search on Speech 2020 ALBAYZIN Evaluation: Overview, Systems, Results, Discussion and Post-Evaluation Analyses. Applied Sciences, 2021.

  2. [10]

    Una herramienta que localiza términos hablados en grabaciones de audio.

    Ramírez Sánchez J.M. et al. · V Conferencia Internacional en Ciencias Computacionales e Informáticas · 2020

    Conference
    Cita completa

    Ramírez Sánchez J.M., Montalvo Bereau A.R., Calvo de Lara J.R. GELABERT: herramienta para la detección automática de términos hablados. V Conferencia Internacional en Ciencias Computacionales e Informáticas (CICCI 2020), 2020.

  3. [11]

    Qué técnicas de aumento de datos ayudan de verdad a los reconocedores de voz. Mi artículo más citado.

    Ramírez J.M. et al. · CIARP · 2019

    Conference DOI
    Cita completa

    Ramírez J.M., Montalvo A., Calvo J.R. A Survey of the Effects of Data Augmentation for Automatic Speech Recognition Systems. CIARP 2019, Lecture Notes in Computer Science, 2019.

  4. [12]

    Resultados de la evaluación internacional ALBAYZIN 2018 sobre detección de términos hablados en audio en español.

    Tejedor J. et al. · EURASIP Journal on Audio · 2019

    Journal DOI
    Cita completa

    Tejedor J., Toledano D.T., Lopez-Otero P., Docío-Fernández L., Montalvo A.R., Ramírez J.M., Peñagarikano M., Rodríguez-Fuentes L.J. ALBAYZIN 2018 spoken term detection evaluation: a multi-domain international evaluation in Spanish. EURASIP Journal on Audio, Speech, and Music Processing, 2019.

  5. [13]

    ¿MFCC o PLP? En silencio apenas importa; con ruido, los MFCC mantienen mejor el reconocimiento de voz, mientras que los PLP decodifican más rápido. Mi primer artículo.

    Ramírez Sánchez J.M. et al. · Revista Ingeniería Electrónica · 2019

    Cita completa

    Ramírez Sánchez J.M., Montalvo Bereau A.R., Calvo de Lara J.R. Evaluación de Rasgos Acústicos para el Reconocimiento Automático del Habla en Escenarios Ruidosos usando Kaldi. Revista Ingeniería Electrónica, Automática y Comunicaciones (RIELAC) 40(3), 2019.

  6. [14]

    El sistema del CENATAV para la evaluación Albayzin 2018 de búsqueda en habla.

    Montalvo A.R. et al. · IberSPEECH · 2018

    Conference DOI
    Cita completa

    Montalvo A.R., Ramírez J.M., Roble A., Calvo J.R. Cenatav Voice Group System for Albayzin 2018 Search on Speech Evaluation. IberSPEECH 2018, 2018.

§4 Tecnología lingüística para lenguas con pocos recursos

  1. [7]

    El estado de las tecnologías del habla y del lenguaje para el gallego, dentro del informe European Language Equality.

    Ramírez Sánchez J.M. et al. · European Language Equality · 2023

    Chapter DOI
    Cita completa

    Ramírez Sánchez J.M., Docío-Fernández L., García-Mateo C. Language Report Galician. European Language Equality (Springer, Cognitive Technologies), 2023.

  2. [8]

    Dónde está el gallego en tecnologías del habla y del lenguaje, y qué recursos faltan todavía.

    Ramírez Sánchez J.M. et al. · IberSPEECH · 2022

    Conference DOI
    Cita completa

    Ramírez Sánchez J.M., Docío-Fernández L., García-Mateo C. Galician's Language Technologies in the Digital Age. IberSPEECH 2022, 2022.