class AI::OpenAI::OpenAITranscriptionModel

Overview

OpenAI transcription model implementation.

Implements the TranscriptionModelV3 interface for speech-to-text using OpenAI's audio/transcriptions API.

Supports models:

Example:

model = OpenAITranscriptionModel.new("whisper-1", config)
result = model.do_generate(
  Provider::TranscriptionModel::CallOptions.new(
    audio: File.read("audio.mp3").to_slice,
    media_type: "audio/mp3"
  )
)
puts result.text

Included Modules

Defined in:

ai/openai/transcription/openai_transcription_model.cr

Constructors

Instance Method Summary

Instance methods inherited from module AI::Provider::TranscriptionModel::V3

do_generate(options : CallOptions) : Result do_generate, model_id : String model_id, provider : String provider, specification_version : String specification_version

Constructor Detail

def self.new(model_id : OpenAITranscriptionModelId, config : OpenAIConfig) #

[View source]
def self.new(model_id : OpenAITranscriptionModelId, config : OpenAITranscriptionModelConfig) #

[View source]

Instance Method Detail

Generates a transcript from audio.

Parameters:

  • options: Call options including audio data, media type, and provider options

Returns transcription result with text, segments, and metadata.


[View source]
def model_id : OpenAITranscriptionModelId #

The model ID.


[View source]
def provider : String #

Returns the provider name.


[View source]
def specification_version : String #

Returns the specification version.


[View source]