Best speech AI models

3 speech models compared on specs, pricing and community reviews.

  • Whisper Large v3 — openai: Whisper Large v3 is OpenAI's state-of-the-art open-source speech recognition model, trained on millions of hours of diverse audio data to deliver industry-leadi
  • Deepgram Nova-3 — deepgram: Deepgram's most accurate speech-to-text model, tuned for noisy, multi-speaker enterprise audio. It extends the Nova line's lead in real-time transcription laten
  • GPT-Realtime 2.1 — openai: GPT-Realtime 2.1 by OpenAI represents a major leap in conversational AI, offering native speech-to-speech interaction with extremely low latency. Combining adva