GPT Audio Mini
GPT Audio Mini is an audio model — speech-to-text, text-to-speech, or a unified audio-in/audio-out variant depending on the provider. Available via OpenAI. 128,000-token context. Mid-tier pricing.
GPT Audio Mini is a multimodal AI model from OpenAI. It costs $0.600 per million input tokens and $2.400 per million output tokens (blended $1.140/M), with a 128,000-token context window.
- Speech transcription
- Multilingual coverage
- Realtime or batch ingest depending on provider
- Multimodal: handles images alongside text
- Meeting transcription
- Voice interfaces
- Subtitle pipelines
Benchmarks
More from OpenAI
See all 28 →Frequently asked questions
How much does GPT Audio Mini cost?
GPT Audio Mini costs $0.600 per million input tokens and $2.400 per million output tokens, for a blended reference rate of $1.140 per million tokens.
What is GPT Audio Mini's context window?
GPT Audio Mini supports up to 128,000 tokens of context in a single request.
What is GPT Audio Mini best for?
GPT Audio Mini is well suited to Speech transcription, Multilingual coverage and Realtime or batch ingest depending on provider.
Who makes GPT Audio Mini?
GPT Audio Mini is developed and served by OpenAI.