Skip to content

非公式本サイトは非公式の日本語ドキュメントであり、Cloudflare 公式サイトではありません。最新情報はdevelopers.cloudflare.comをご確認ください。

Deepgram のロゴ

aura-1

テキスト読み上げ • Deepgram

Markdown で表示Agent セットアップ
  • Cloudflare ホスト
  • バッチ
  • パートナー
  • リアルタイム

Aura は、入力テキストの文脈に応じて自然な間、表現力、フィラーを加えるコンテキスト認識型のテキスト読み上げ(TTS)モデルです。入力テキストの品質が、音声の自然さに直結します。

モデル情報
利用規約とライセンスリンク
バッチはい
パートナーはい
リアルタイムはい
単価$0.015 per 1k characters

使い方


export default {
  async fetch(request, env, ctx): Promise<Response> {
      const resp = await env.AI.run("@cf/deepgram/aura-1", {
        "text":"Hello World!"
      }, {
        returnRawResponse: true
      });

      return resp;
  },
} satisfies ExportedHandler<Env>;

curl --request POST   --url 'https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}/ai/run/@cf/deepgram/aura-1'   --header 'Authorization: Bearer {TOKEN}'   --header 'Content-Type: application/json'   --data '{
    "text":"Hello world!"
}'

パラメーター

speaker
stringデフォルト: angusenum: angus, asteria, arcas, orion, orpheus, athena, luna, zeus, perseus, helios, hera, stella音声の生成に使う話者です。
encoding
stringenum: linear16, flac, mulaw, alaw, mp3, opus, aac出力音声のエンコードです。
container
stringenum: none, wav, ogg出力音声のファイル形式ラッパーです。使える選択肢はエンコード種別によって異なります。
text
string必須音声に変換するテキストです
sample_rate
number出力音声のサンプルレートです。エンコードによって対応する値が異なります。一部のエンコードでは変更できません
bit_rate
number音声のビットレート(bps)です。エンコード種別に応じた範囲または値から選びます。

バインディングは MPEG 形式の音声を含む ReadableStream を返します(モデルの出力スキーマを確認してください)。

API スキーマ(Raw)

Input
Output

役に立ちましたか?