Skip to content

非公式本サイトは非公式の日本語ドキュメントであり、Cloudflare 公式サイトではありません。最新情報はdevelopers.cloudflare.comをご確認ください。

Deepgram のロゴ

aura-2-es

テキスト読み上げ • Deepgram

Markdown で表示Agent セットアップ
  • Cloudflare ホスト
  • バッチ
  • パートナー
  • リアルタイム

Aura-2 は、入力テキストの文脈に応じて自然な間、表現力、フィラーを加えるコンテキスト認識型のテキスト読み上げ(TTS)モデルです。入力テキストの品質が、音声の自然さに直結します。

モデル情報
利用規約とライセンスリンク
バッチはい
パートナーはい
リアルタイムはい
単価$0.03 per 1k characters

パラメーター

speaker
stringデフォルト: aquilaenum: sirio, nestor, carina, celeste, alvaro, diana, aquila, selena, estrella, javier音声の生成に使う話者です。
encoding
stringenum: linear16, flac, mulaw, alaw, mp3, opus, aac出力音声のエンコードです。
container
stringenum: none, wav, ogg出力音声のファイル形式ラッパーです。使える選択肢はエンコード種別によって異なります。
text
string必須音声に変換するテキストです
sample_rate
number出力音声のサンプルレートです。エンコードによって対応する値が異なります。一部のエンコードでは変更できません
bit_rate
number音声のビットレート(bps)です。エンコード種別に応じた範囲または値から選びます。

バインディングは MPEG 形式の音声を含む ReadableStream を返します(モデルの出力スキーマを確認してください)。

API スキーマ(Raw)

Input
Output

役に立ちましたか?