001 LiveLingo Voice Translation Benchmarks 2026 OpenAlex Paper Ron Villomo 6 days ago 002 StellarTTS: Sparse Temporal Embedding for Low-Latency and Robust Speech Synthesis OpenAlex Paper Kaicheng Luo, X Z Gong et al. Jul 22 003 WDYW.01: Tone Restoration for Standard Yorùbá OpenAlex Paper Tosin Sina Akerele Jul 20 004 Roxi-Duplex: Low-Resource Indian-English Adaptation of a Full-Duplex Speech-to-Speech Model with Synthetic Two-Channel Training Data OpenAlex Paper J A, J A Jul 19 005 Roxi-Duplex: Low-Resource Indian-English Adaptation of a Full-Duplex Speech-to-Speech Model with Synthetic Two-Channel Training Data OpenAlex Paper J A, J A Jul 19 006 SLT 2026 REAL-TSE Challenge: Real-world Target Speaker Extraction from Conversational Recordings OpenAlex Paper Shuai Wang, Zihan Qian et al. Jul 16 007 DIVERSE: a corpus of cisgender female speakers for phonetic and forensic research OpenAlex Paper Alice Paver, Chloe Patman et al. Jul 15 008 Malayalam SK-ARJ OpenAlex Paper Somdev Kar, ashitha rachel jacob Jul 15 009 Rethinking Speech Foundation Model Fine-tuning: Better SFT or Better Match? OpenAlex Paper Wangjin Zhou, Yizhou Zhang et al. Jul 15 010 The role of temporal information in automatic speech and voice recognition OpenAlex Paper Erdem Baha Topbas, Srikanth Madikeri et al. Jul 15 011 Towards explainable linguistic phonetic methods to authenticate allegedly deepfake audio OpenAlex Paper Ben Gibb-Reid, Jessica Wormald et al. Jul 15 012 Synchronized Three-Dimensional Vocal-Tract Motion for Speech Synchronization via Joint-Embedding Predictive Architecture Alignment OpenAlex Paper Sheng Li, Takahiro Shinozaki Jul 13 013 An Objective Intelligibility Metric Evaluation on Spanish Speech OpenAlex Paper Iván López-Espejo, Jesper Jensen Jul 12 014 ICPHS 2027 OpenAlex Paper Neda Mousavi, Pauline Larrouy-Maestri Jul 11 015 Silent speech with ultrasound OpenAlex Paper Vadims Casecnikovs, Gimran Abdullin et al. Jul 7 016 Silent speech with ultrasound OpenAlex Paper Vadims Casecnikovs, Gimran Abdullin et al. Jul 7 017 The Receiver-Limited Floor: Rate-Distortion Bounds on Serial Decoding Throughput OpenAlex Paper Grant Lavell Whitmer III Jul 7 018 Enhancing EFL Learners’ Pronunciation: A GenAI-Powered Approach to Weak Forms for Students at Arab Open University OpenAlex Paper Shaimaa Mohamed Helal, Hassan Saleh Mahdi et al. Jul 5 019 Measuring Word Length in Japanese: Mora or Syllable? OpenAlex Paper Wenchao Li Jul 4 020 QuaSR: Quality-Aware Sample Reweighting for Pacific Indigenous Speech Recognition OpenAlex Paper Yishun Li, Y H Xiao et al. Jul 4 021 Protocol for a Systematic Literature Review: Visual Speech Recognition for Bengali (Bangla) and Assamese OpenAlex Paper Abdul Hasib Uddin, Abu Shamim Mohammad Arif Jul 3 022 The Receiver-Limited Floor: Rate-Distortion Bounds on Serial Decoding Throughput OpenAlex Paper Grant Lavell Whitmer III Jul 3 023 CALLHOME American English Second Edition OpenAlex Paper Alexandra Canavan, David Graff et al. Jul 1 024 Speaker-Conditioned Neural Speech Synthesis for Marathi and English Using Guided Attention on the vVISWa Dataset OpenAlex Paper Diksha R. Pawar and Dr. Pravin L. Yannawar Jul 1 025 From Acoustic Diagnosis to Generative Interaction: An Integrated Model of Digital Tools in College English Speaking Instruction OpenAlex Paper Yijing Zhang Jun 30 026 An Italian corpus of clinical speech data OpenAlex Paper Laura Tagliaferro Jun 29 027 PIAS: Transparent Multimodal Assessment of Presentation Delivery OpenAlex Paper Nina Hosseini-Kivanani, Nafiseh Taghva et al. Jun 29 028 PIAS: Transparent Multimodal Assessment of Presentation Delivery OpenAlex Paper Nina Hosseini-Kivanani, Nafiseh Taghva et al. Jun 29 029 Preserving Speech-to-Text LLM Capabilities in Speech-to-Speech Generation OpenAlex Paper Yuxuan Hu, Hüseyin Ozan Ҫirkinoğlu et al. Jun 29 030 The Multilingual Evaluation Paradox: Ramoju Potential Across Languages, Scripts, and 2.37 Billion Speakers OpenAlex Paper Surya Sai Brahmendra Ramoju, Sri Likhitha Anuganti et al. Jun 29 031 The Multilingual Evaluation Paradox: Ramoju Potential Across Languages, Scripts, and 2.37 Billion Speakers OpenAlex Paper Surya Sai Brahmendra Ramoju, Sri Likhitha Anuganti et al. Jun 29 032 Learning Latent Representations with Progressive Hypothesis Space Expansion OpenAlex Paper Jonathan Charles Paramore Jun 26 033 Enhancing Zero-shot Whisper ASR for Under-resourced Javanese and Sundanese via Generative Fusion Decoding and Logit Calibration OpenAlex Paper Agung Santosa, Asril Jarin et al. Jun 24 034 Fine-Tuning VGG19 with Mel Spectrograms for Amazigh Spoken Digit Recognition OpenAlex Paper Hossam Boulal, Abdelkader Benzirar et al. Jun 24 035 Acoustic Landmark Detector based on Conformer and HuBERT OpenAlex Paper Mateo Cámara, José Luis Blanco et al. Jun 22 036 Enhancing Arabic Diacritization Using BERT with BiLSTM and BiGRU Heads OpenAlex Paper Ahmed Abdelhamed Elgayar, Abdul-Hadi Nabi Ahmed et al. Jun 22 037 Enhancing Hausa Words Lemmatization Through Feature Engineering OpenAlex Paper Abba Bello Muhammad, Rasheed Abubakar Rasheed et al. Jun 22 038 ProsoCodec: Prosody-Oriented Speech Codec for Voice Conversion OpenAlex Paper J H Choi, Ji-Hoon Kim et al. Jun 20 039 Using Phonological-Level Wav2Vec2 for Mandarin Automatic Mispronunciation Detection and Diagnosis OpenAlex Paper Jinghao Chen, Mostafa Shahin et al. Jun 20 040 COMPUTATIONAL MODEL OF KAZAKH VOWEL–CONSONANT HARMONY OpenAlex Paper Zhansaya Segizbayeva, Marek Miłosz Jun 19 041 DisSpeech: Low-Resource Controllable Mandarin Stuttered Speech Synthesis for ASR Augmentation OpenAlex Paper Yao Lu Jun 19 042 Standard and Dagestani Russian in automatic speech recognition: weaknesses of ASR systems OpenAlex Paper A. Katsnelson, O. Lyashevskaya Jun 19 043 To Shorten or to Lengthen? Output Strategies of ASR Models in Atypical Speech Recognition OpenAlex Paper Anastasia Kolmogorova, Ekaterina Yavshits et al. Jun 19 044 Exploring Pre-training Benefits on Phoneme Addition through Fine-tuning in Speech Synthesis OpenAlex Paper Masato Murata, Koichi Miyazaki et al. Jun 18 045 Interpreting Content and Speaker Characteristics in Factorised Self-Supervised Subspaces OpenAlex Paper Kyle Janse van Rensburg, Herman Kamper Jun 18 046 Language Geometry: A Unified Geometric Framework for Understanding Large Language Models OpenAlex Paper Xiaobo Li Jun 18 047 Quantifying Punctuation Patterns in Chinese Language for Language Service Applications OpenAlex Paper Jarosław Kwapień, Jakub Dec et al. Jun 18 048 Self-Supervised and Semi-Supervised Learning for Nepali ASR with Limited Labeled Data OpenAlex Paper Rajesh Raskoti, Kobid Karkee Jun 18 049 Transcript-Free Flow-Matching Text-to-Speech via Speech Feature Conditioning OpenAlex Paper SooHwan Eom, Hee Suk Yoon et al. Jun 18 050 ОЦЕНКА ПРОСОДИЧЕСКОЙ ИНФОРМАЦИИ В САМООБУЧАЮЩИХСЯ ПРЕДСТАВЛЕНИЯХ РЕЧИ: СРАВНИТЕЛЬНЫЙ АНАЛИЗ HUBERT И WAVLM OpenAlex Paper А С Ларин Jun 18 051 ОЦЕНКА ПРОСОДИЧЕСКОЙ ИНФОРМАЦИИ В САМООБУЧАЮЩИХСЯ ПРЕДСТАВЛЕНИЯХ РЕЧИ: СРАВНИТЕЛЬНЫЙ АНАЛИЗ HUBERT И WAVLM OpenAlex Paper А С Ларин Jun 18 052 Responsible ASR: Overcoming Challenges of Foundational Models in Narrow-Band and Low-Resource Settings OpenAlex Paper Tejas Godambe, Nutan Choudhary et al. Jun 17 053 Zero-Shot Performance of Compact Whisper Variants on Urdu-English Code-Mixed Speech: An Empirical Investigation Using WER and Switch Point Analysis OpenAlex Paper Abdullah Haroon Mohammed haroon Jun 17 054 Zero-Shot Performance of Compact Whisper Variants on Urdu-English Code-Mixed Speech: An Empirical Investigation Using WER and Switch Point Analysis OpenAlex Paper Abdullah Haroon Mohammed haroon Jun 17 055 Next-Turn: Duration-Aware Streaming Endpoint Detection via Time-to-Next-Speech-Onset Prediction OpenAlex Paper Tristan Tsoi, Jiajun Deng et al. Jun 16 056 CraBERT: Efficient Phoneme Encoder Pre-Training via Cascade Fusion of Subword Representations for Text-to-Speech OpenAlex Paper D Yang, Yuki Saito et al. Jun 15 057 Joycent: Diffusion-based Accent TTS without Accented Phone Prediction OpenAlex Paper Xintong Wang, Ye Wang Jun 15 058 Bridging the SEA Gap: An Initial Benchmark for Neural Audio Codec-Synthesized Speech Deepfakes in South-East Asian Languages OpenAlex Paper Orchid Chetia Phukan, Girish et al. Jun 14 059 Automated Vietnamese text-to-speech: A survey of artificial intelligence techniques OpenAlex Paper Trương Thanh Thảo, Tran Thanh Nam et al. Jun 13 060 CSE-Guided Linguistically Constrained Morphological Segmentation for Turkmen OpenAlex Paper Ualsher Tukeyev, Dina Amirova et al. Jun 13