automatic-speech-recognition
63 个项目 · ⭐ 35.0kONNX-compatible Fast SeamlessM4T—Massively Multilingual & Multimodal Machine Translation
real time japanese speech recognition translator using wav2vec2
Wav2vec resources and models for Brazilian Portuguese
Docker image for a self-hosted WhisperLive real-time speech-to-text server, powered by faster-whisper. Provides WebSocket streaming for live audio transcription and an OpenAI-compatible REST API. Supports all Whisper models, VAD, NVIDIA GPU (CUDA) acceleration, offline mode, and multi-arch (amd64, arm64).
Easy to use Multi-Provider ASR/Speech To Text and NLP engine
This is an OpenAI Whisper automatic speech recognition microservice
Blueprint by Mozilla.ai on how to transcribe audio files
An implementation for "Conformer: Convolution-augmented Transformer for Speech Recognition" Paper
Finalist at Brainhack TIL 2024: Team 12000SGDPLUSHIE
Fine-Tune Whisper for Italian ASR with transformers
共 63 条 · 第 3 / 4 页