speech-to-text
986 个项目 · ⭐ 742.1kChunkFormer: Masked Chunking Conformer For Long-Form Speech Transcription
OpenAI Whisper API-style local server, runnig on FastAPI
Speech Recognition model based off of FAIR research paper built using Pytorch.
AI Speech Solutions for Tasks such as ASR, Vocal Extraction, Accompaniment Extraction, Audio Denoising, and Enhancement, Support models such as paraformer, sensevoice, fireredasr, zipformer, moonshine, wenet, whisper, fsmn-vad, silero-vad, CT Transformer punc, Spleeter, Uvr5, etc, apply ONNX models in various scenarios.
Agent-first CLI for audio/video transcription via Whisper
Free, sub-second on-device AI dictation for macOS. Dual engines (Whisper + Parakeet) on Apple Silicon. Optional AI polish with our own on-device model (EG-1), Apple Intelligence (macOS 26), Ollama, or your own OpenAI/Gemini key. No account, no subscription, audio never leaves your Mac.
A MXNet implementation of Baidu's DeepSpeech architecture
Emotions recognition from audio and text files (only russian language)
Kim,your personal voice kit for Home Inteligence.
在Unity环境下,借助sherpa-ncnn框架,实现实时并准确的中英双语语音识别功能。
共 986 条 · 第 23 / 50 页