NEWVectors or files. Pick a path.Start →

    Automatic Speech Recognition Models

    Browse AI models for multimodal decomposition and recomposition pipelines: plug any model into your extractors.

    480 models available

    Showing 1-24 of 480 models

    Automatic Speech Recognition

    argmaxinc/whisperkit-coreml

    9.7M
    200
    whisperkit
    Automatic Speech Recognition

    pyannote/speaker-diarization-3.1

    9.4M
    3,084
    pyannote-audio
    Automatic Speech Recognition

    openai/whisper-large-v3-turbo

    7.9M
    3,245
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-japanese

    5.9M
    62
    transformers
    Automatic Speech Recognition

    pyannote/speaker-diarization-community-1

    5.6M
    1,038
    pyannote-audio
    Automatic Speech Recognition

    openai/whisper-large-v3

    5.0M
    6,151
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-portuguese

    5.0M
    55
    transformers
    Automatic Speech Recognition

    pyannote/voice-activity-detection

    4.3M
    240
    pyannote-audio
    Automatic Speech Recognition

    Qwen/Qwen3-ASR-1.7B

    4.3M
    1,020
    Automatic Speech Recognition

    Qwen/Qwen3-ASR-0.6B

    4.2M
    332
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-russian

    4.1M
    76
    transformers
    Automatic Speech Recognition

    openai/whisper-base

    3.1M
    285
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-polish

    2.8M
    12
    transformers
    Automatic Speech Recognition

    openai/whisper-small

    2.6M
    582
    transformers
    Automatic Speech Recognition

    MahmoudAshraf/mms-300m-1130-forced-aligner

    2.4M
    99
    transformers
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-dutch

    2.3M
    17
    transformers
    Automatic Speech Recognition

    mistralai/Voxtral-Mini-4B-Realtime-2602

    2.2M
    945
    vllm
    Automatic Speech Recognition

    indonesian-nlp/wav2vec2-indonesian-javanese-sundanese

    2.2M
    15
    transformers
    Automatic Speech Recognition

    mlx-community/parakeet-tdt-0.6b-v2

    2.1M
    45
    mlx
    Automatic Speech Recognition

    handy-computer/nemotron-3.5-asr-streaming-0.6b-gguf

    2.0M
    4
    transcribe.cpp
    Automatic Speech Recognition

    Systran/faster-whisper-small

    1.9M
    43
    ctranslate2
    Automatic Speech Recognition

    jonatasgrosman/wav2vec2-large-xlsr-53-greek

    1.9M
    4
    transformers
    Automatic Speech Recognition

    nvidia/parakeet-ctc-1.1b

    1.9M
    58
    nemo
    Automatic Speech Recognition

    handy-computer/parakeet-unified-en-0.6b-gguf

    1.8M
    3
    transcribe.cpp
    1 / 20