Skip to main content
GPT-4o Transcribe Diarizeは、話者分離機能を備えたOpenAIの音声文字起こしモデルです。 以下のエンドポイントを使用し、MixRouteを通じてgpt-4o-transcribe-diarizeを呼び出します。

主な機能

  • 音声からテキストへ - アップロードした音声ファイルを文字起こしします
  • マルチパートアップロード - 元ファイルをフォームデータとして送信
  • 出力形式 - モデル固有のレスポンス形式をサポート
  • 話者分離 - 各区間で誰が話したかをラベル付け
  • セグメントのタイムスタンプ - 各話者の発話ターンの開始時刻と終了時刻を返します

簡単な使用例

パラメータ