paper-with-me

Speech-to-Text Translation

11개 벤치마크 · 논문 176편 · 이 태스크의 논문 보기 →

Benchmarks

MuST-C EN->DE

결과 8개

MuST-C EN->ES

결과 5개

MuST-C EN->FR

결과 3개

CoVoST 2 X-eng

결과 2개

CoVoST 2 eng-X

결과 2개

FLEURS X-eng

결과 2개

FLEURS eng-X

결과 2개

MediBeng

결과 2개

MuST-C

결과 2개

libri-trans

결과 2개

MuST-C EN->NL

결과 1개

Most implemented

Papers

NOPE-HYPE: A Structured Simulation Workflow for Robust Speech-to-Text Across Diverse Acoustic Environments

2026-09-09 · Niramay M. Patel, Bibek Behera, Raksha Sharma arxiv

Robust speech-to-text translation systems should perform reliably across diverse acoustic conditions, yet practical pipelines lack controllable tools for systematic environment exploration. Large speech models remain sen…

Speech-to-Text Translation

SPRI: SVD-Partitioned Residual Initialization for Data-Constrained MoE Upcycling

2026-06-15 · Weiqiao Shan, Ruixiang Mao, Yuang Li, Yuhao Zhang 외 arxiv

Mixture-of-Experts (MoE) models enable efficient scaling, but training them from scratch remains prohibitively expensive. MoE upcycling mitigates this cost by converting pretrained dense models into sparse MoE models. Ho…

Speech-to-Text Translation

A Pocket Offline Model for Simultaneous Speech Translation as CUNI Submission to IWSLT 2026

2026-06-02 · Aziz Sharipov Ortega, Dominik Macháček arxiv

We implement simultaneous translation capability with the offline direct speech-to-text translation model Canary, using the state-of-the-art policy AlignAtt, and submit it to IWSLT 2026 Simultaneous Speech Translation Sh…

Speech-to-Text Translation

OpenSTBench: Beyond Semantic Evaluation for Speech Translation

2026-05-29 · Yanjie An, Yuxiang Zhao, Yichi Zhang, Qixi Zheng 외 arxiv

Speech translation systems increasingly span speech-to-text translation (S2TT), speech-to-speech translation (S2ST), offline translation, and streaming generation, producing outputs that differ in modality, speech realiz…

Speech-to-Speech TranslationSpeech-to-Text Translation

DOA: Training-Free Decoder-Only Attention Policy for Long-Form Simultaneous Translation with SpeechLLMs

2026-05-29 · Sara Papi, Luisa Bentivogli arxiv

Simultaneous speech-to-text translation (SimulST) generates translations while speech is still unfolding, requiring a streaming policy that decides when to read and when to write. State-of-the-art approaches rely on atte…

Speech-to-Text Translation

Parameter- and Bandwidth-Efficient Edge--cloud Many-to-Many Speech-to-Text Translation

2026-05-27 · Yexing Du, Kaiyuan Liu, Youcheng Pan, Bo Yang 외 arxiv

Multimodal large language models (MLLMs) have demonstrated significant potential for speech-to-text translation (S2TT). However, existing deployment paradigms face critical challenges: pure on-device models suffer from r…

Speech-to-Text TranslationSpeech Recognition

전체 176편 보기 →