๐๏ธ Audio & Speech
Speech-to-text, text-to-speech, and audio understanding. 40 models.
Google: Gemini 2.5 Flash Preview TTS
A specialized preview of Gemini 2.5 Flash with text-to-speech capabilities. Combines fast inference with high-quality voice synthesis for real-time audio applications.
Google: Gemini 2.5 Pro Preview TTS
A specialized preview of Gemini 2.5 Pro with text-to-speech capabilities. Designed for applications requiring high-quality voice synthesis alongside advanced language understanding.
Google: Gemini 3.1 Flash TTS Preview
Gemini 3.1 Flash TTS Preview is a capable language model available on LangMart via Google for general-purpose text generation and analysis tasks.
Google: Gemini 3.5 Transcribe
Gemini 3.5 Transcribe is a capable language model available on LangMart via Google for general-purpose text generation and analysis tasks.
Google: Gemini Audio Understanding
Audio analysis model.
Groq: Distil Whisper Large V3 EN
Groq: Distil Whisper Large V3 EN is a language model provided by the provider. This model offers advanced capabilities for natural language processing tasks.
Groq: Orpheus Arabic Saudi
A specialized Arabic language model from Canopy Labs focused on Saudi Arabian dialect and culture. Optimized for Saudi Arabic text generation and understanding.
Groq: Orpheus V1 English
Canopy Labs' Orpheus V1 model for English language tasks. A lightweight model optimized for fast inference on Groq infrastructure.
Groq: PlayAI TTS
PlayAI's text-to-speech model hosted on Groq for ultra-fast audio generation. Provides high-quality voice synthesis with low latency.
Groq: PlayAI TTS Arabic
PlayAI's Arabic-specialized text-to-speech model hosted on Groq. Optimized for high-quality Arabic voice synthesis.
Groq: Whisper Large V3
OpenAI's Whisper Large V3 speech-to-text model hosted on Groq for ultra-fast transcription. Supports multiple languages and audio formats.
Groq: Whisper Large V3 Turbo
Groq: Whisper Large V3 Turbo is a language model provided by the provider. This model offers advanced capabilities for natural language processing tasks.
Groq: Whisper V3 Large
Whisper V3 Large is a audio processing model for speech synthesis and audio understanding. Developed by Groq, this model is optimized for its specific use case category.
Mistral AI: Voxtral Mini
Voxtral Mini is a audio processing model for speech synthesis and audio understanding. Developed by Mistral AI, this model is optimized for its specific use case category.
Mistral AI: Voxtral Small
Voxtral Small is a audio processing model for speech synthesis and audio understanding. Developed by Mistral AI, this model is optimized for its specific use case category.
OpenAI: Gpt 4O Audio Preview 2024 12 17
OpenAI model: gpt-4o-audio-preview-2024-12-17 This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solv...
OpenAI: Gpt 4O Audio Preview 2025 06 03
OpenAI model: gpt-4o-audio-preview-2025-06-03 This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solv...
OpenAI: Gpt 4O Mini Audio Preview
OpenAI model: gpt-4o-mini-audio-preview This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solving ta...
OpenAI: Gpt 4O Mini Audio Preview 2024 12 17
OpenAI model: gpt-4o-mini-audio-preview-2024-12-17 This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem...
OpenAI: Gpt 4O Mini Transcribe
OpenAI model: gpt-4o-mini-transcribe This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solving tasks...
OpenAI: Gpt 4O Mini Transcribe 2025 03 20
OpenAI model: gpt-4o-mini-transcribe-2025-03-20 This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-so...
OpenAI: Gpt 4O Mini Transcribe 2025 12 15
OpenAI model: gpt-4o-mini-transcribe-2025-12-15 This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-so...
OpenAI: Gpt 4O Transcribe
OpenAI model: gpt-4o-transcribe This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solving tasks.
OpenAI: Gpt 4O Transcribe Diarize
OpenAI model: gpt-4o-transcribe-diarize This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solving ta...
OpenAI: Gpt Audio
OpenAI model: gpt-audio This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solving tasks.
OpenAI: Gpt Audio 2025 08 28
OpenAI model: gpt-audio-2025-08-28 This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solving tasks.
OpenAI: Gpt Audio Mini
OpenAI model: gpt-audio-mini This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solving tasks.
OpenAI: Gpt Audio Mini 2025 10 06
OpenAI model: gpt-audio-mini-2025-10-06 This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solving ta...
OpenAI: Gpt Audio Mini 2025 12 15
OpenAI model: gpt-audio-mini-2025-12-15 This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-solving ta...
OpenAI: GPT-4o Audio Preview
Preview of GPT-4o with audio processing capabilities. This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex prob...
OpenAI: GPT-4o Audio Preview (October 2024)
October release of audio-enabled GPT-4o preview. This model supports multimodal capabilities including vision and image understanding. It features advanced reasoning capabilities for complex problem-s...
OpenAI: GPT-4o Mini TTS
GPT-4o Mini TTS is a audio processing model for speech synthesis and audio understanding. Developed by OpenAI, this model is optimized for its specific use case category.
OpenAI: TTS
TTS is a audio processing model for speech synthesis and audio understanding. Developed by OpenAI, this model is optimized for its specific use case category.
OpenAI: TTS HD
TTS HD is a audio processing model for speech synthesis and audio understanding. Developed by OpenAI, this model is optimized for its specific use case category.
OpenAI: Whisper
Whisper is a audio processing model for speech synthesis and audio understanding. Developed by OpenAI, this model is optimized for its specific use case category.
LangMart: Mistral: Voxtral Small 24B 2507
Voxtral Small is an enhancement of Mistral Small 3, incorporating state-of-the-art audio input capabilities while retaining best-in-class text performance. It excels at speech transcription, translati...
LangMart: OpenAI: GPT-4o Audio
OpenAI: GPT-4o Audio is a conversational AI model designed for multi-turn dialogue and interactive tasks. Developed by LangMart, this model is optimized for its specific use case category.
OpenAI: GPT Audio
OpenAI: GPT Audio is a capable language model available on LangMart via OpenRouter for general-purpose text generation and analysis tasks.
OpenAI: GPT Audio Mini
OpenAI: GPT Audio Mini is a capable language model available on LangMart via OpenRouter for general-purpose text generation and analysis tasks.
Together AI: Whisper Large v3
Whisper Large v3 is a conversational AI model designed for multi-turn dialogue and interactive tasks. Developed by Together AI, this model offers reliable performance for diverse applications.