Skip to main content
KYM

Detected Skills:

Speech Recognition (100% match)

Found 0 registries and 11 entities for "Speech Recognition"

All Agents & Models

@cf/openai/whisper

model

Whisper is a general-purpose speech recognition model. It is trained on a large dataset of diverse audio and is also a multitasking model that can perform multilingual speech recognition, speech translation, and language identification.

Speech Recognition Speech Recognition
@cf Score: 0

@cf/deepgram/flux

model

Flux is the first conversational speech recognition model built specifically for voice agents.

Speech Recognition
@cf Score: 0

@cf/openai/whisper-tiny-en

model

Whisper is a pre-trained model for automatic speech recognition (ASR) and speech translation. Trained on 680k hours of labelled data, Whisper models demonstrate a strong ability to generalize to many datasets and domains without the need for fine-tuning. This is the English-only version of the Whisper Tiny model which was trained on the task of speech recognition.

Speech Recognition
@cf Score: 0

@cf/openai/whisper-large-v3-turbo

model

Whisper is a pre-trained model for automatic speech recognition (ASR) and speech translation.

Speech Recognition Speech Recognition
@cf Score: 0

subformer/meta-omnilingual-asr-7b

model

Omnilingual ASR 7B by Meta (Unofficial) - Automatic speech recognition supporting 1,693 languages with best-in-class accuracy. Meta's recommended variant for mission-critical transcription requiring maximum quality.

Text Generation Speech Recognition
subformer Score: 0

ibm-granite/granite-speech-3.3-8b

model

Granite-speech-3.3-8b is a compact and efficient speech-language model, specifically designed for automatic speech recognition (ASR) and automatic speech translation (AST).

Text Generation Speech Recognition
ibm-granite Score: 0

erium/whisperx

model

Automatic Speech Recognition with Word-level Timestamps & Diarization

Speech Recognition Speech Recognition
erium Score: 0

nateraw/whisper-large-v3

model

Whisper is a general-purpose speech recognition model.

Speech Recognition Speech Recognition
nateraw Score: 0

awerks/whisperx

model

Fast automatic speech recognition (70x realtime with large-v2) with word-level timestamps and speaker diarization.

Speech Recognition Speech Recognition
awerks Score: 0

twangodev/qwenasr

model

Serve QwenASR speech recognition and alignment.

Text Generation
twangodev Score: 0

ibm-granite/granite-speech-4.1-2b

model

Granite Speech 4.1 2B is a compact and efficient speech-language model, specifically designed for multilingual automatic speech recognition (ASR) and bidirectional automatic speech translation (AST) for English, French, German, Spanish, Portuguese and Jap

ibm-granite Score: 0