MarkTechPost·10h agoSarvam AI Releases Saaras V4: A Speech-to-Text Model for All 22 Indian Languages and Global English#sarvam#saaras-v4#speech-to-text 5 min
arXiv cs.AI / cs.LG / cs.CL·2d agoA Training Criterion with Token-Level Tolerance to Transcription Ambiguity for Automatic Speech Recognition#asr#ctc#speech-recognitionAI research
The Decoder·3d agoAlibaba launches Qwen Audio 3.1 with new models and slashes AI audio prices by up to 95 percent#alibaba#qwen#qwen-audio 9 sources
Hugging Face daily papers·4d agoSix Layers Less: Encoder Pruning for Whisper with Label-Free Recovery#whisper#asr#pruning
Hugging Face trending models·5d agoEdge0/Audio8-ASR-Infinite — new model trending #30 on Hugging Face#asr#speech-recognition#streamingModel release 6 min
MarkTechPost·8d agoSpaceXAI Releases Grok Voice Transcribe 2.0: A Speech-to-Text API Claiming 2x Accuracy Over 1.0 at $0.10 per Hour#api#asr#grok 4 min
arXiv cs.AI / cs.LG / cs.CL·9d agoMTVA-Bench: Evaluating the Language Model Inside Cascaded Voice Agents#asr#benchmark#llm-evaluationAI research
arXiv cs.AI / cs.LG / cs.CL·9d agoDesign of the IBM Granite 5.0 TurboCTC ASR Model#asr#conformer#ctcModel release
Hugging Face daily papers·10d agoVākQA: A Benchmark and Evaluation Study for Telugu Spoken Factoid Question Answering#asr#benchmark#evaluation
Hugging Face daily papers·10d agoTeleAntiFraud 2.0: A Refreshable, Profile-Grounded, and Audio-Based Benchmark for Telecom Fraud Detection#asr#audio#benchmark
Hacker News · security·12d agoShow HN: Nari Qwen3-TTS and Qwen3-ASR – High accuracy, low latency and cost#asr#benchmarks#covalAI tools & infra 3 min1
Hugging Face daily papers·16d agoBuilding a Production Greek-English Speech Recognizer#asr#bilingual#evaluation
Hugging Face trending models·16d agonetease-youdao/Confucius4-R2T2 — new model trending #28 on Hugging Face#asr#low-latency#netease-youdaoModel release 15 min1
Hugging Face daily papers·17d agoX-AuT: Progressive Audio-Encoder Compression for Speech LLMs with Cross-Scale Distillation#asr#audio-encoder#distillation1
Hugging Face trending models·24d agomicrosoft/VibeVoice-ASR-Streaming-7B — new model trending #27 on Hugging Face#asr#microsoft#multilingualModel release 2 min2
Hugging Face Blog·Aug 28, 2026The Open ASR Leaderboard Adds Its First Global South Language#asr#benchmark#global-southAI research
Hugging Face Blog·Aug 21, 2026Measuring benchmark optimization in speech recognition#asr#benchmarks#evaluationAI research