class
AI::OpenAI::OpenAITranscriptionModel
- AI::OpenAI::OpenAITranscriptionModel
- Reference
- Object
Overview
OpenAI transcription model implementation.
Implements the TranscriptionModelV3 interface for speech-to-text using OpenAI's audio/transcriptions API.
Supports models:
- whisper-1 - Whisper transcription model
- gpt-4o-mini-transcribe - GPT-4o mini transcription model
- gpt-4o-transcribe - GPT-4o transcription model
Example:
model = OpenAITranscriptionModel.new("whisper-1", config)
result = model.do_generate(
Provider::TranscriptionModel::CallOptions.new(
audio: File.read("audio.mp3").to_slice,
media_type: "audio/mp3"
)
)
puts result.text
Included Modules
Defined in:
ai/openai/transcription/openai_transcription_model.crConstructors
- .new(model_id : OpenAITranscriptionModelId, config : OpenAIConfig)
- .new(model_id : OpenAITranscriptionModelId, config : OpenAITranscriptionModelConfig)
Instance Method Summary
-
#do_generate(options : Provider::TranscriptionModel::CallOptions) : Provider::TranscriptionModel::Result
Generates a transcript from audio.
-
#model_id : OpenAITranscriptionModelId
The model ID.
-
#provider : String
Returns the provider name.
-
#specification_version : String
Returns the specification version.
Instance methods inherited from module AI::Provider::TranscriptionModel::V3
do_generate(options : CallOptions) : Result
do_generate,
model_id : String
model_id,
provider : String
provider,
specification_version : String
specification_version
Constructor Detail
Instance Method Detail
def do_generate(options : Provider::TranscriptionModel::CallOptions) : Provider::TranscriptionModel::Result
#
Generates a transcript from audio.
Parameters:
- options: Call options including audio data, media type, and provider options
Returns transcription result with text, segments, and metadata.