Audio & Music
Mistral AI's speech understanding models (24B and 3B) with 32k token context for audio up to 40 minutes. Features multilingual transcription, built-in Q&A, summarization, function calling, and Apache 2.0 license.