firdhokk/speech-emotion-recognition-with-facebook-wav2vec2-large-xlsr-53 Audio Classification • 0.3B • Updated Dec 15, 2024 • 987 • 2
Running on Zero MCP Featured 37 Breeze TTS 2 🎙 37 Bilingual TTS with voice design, cloning, and direction
DiTAR: Diffusion Transformer Autoregressive Modeling for Speech Generation Paper • 2502.03930 • Published Feb 6, 2025 • 3
SkillEvo: Self-Renewing Evolution Gradients from Multi-Turn Interaction Feedback Paper • 2608.13120 • Published 20 days ago • 32
Running on Zero Agents Featured 1.26k OmniVoice 🌍 1.26k High-quality voice cloning TTS for 600+ languages