Sherpa-ONNX

Non-Streaming Speech Recognition

Uses VAD to split long audio into speech segments, then recognizes each segment with an offline ASR model.