- Cloudflare ホスト
- バッチ
- パートナー
- リアルタイム
Aura は、入力テキストの文脈に応じて自然な間、表現力、フィラーを加えるコンテキスト認識型のテキスト読み上げ(TTS)モデルです。入力テキストの品質が、音声の自然さに直結します。
| モデル情報 | |
|---|---|
| 利用規約とライセンス | リンク ↗ |
| バッチ | はい |
| パートナー | はい |
| リアルタイム | はい |
| 単価 | $0.015 per 1k characters |
export default {
async fetch(request, env, ctx): Promise<Response> {
const resp = await env.AI.run("@cf/deepgram/aura-1", {
"text":"Hello World!"
}, {
returnRawResponse: true
});
return resp;
},
} satisfies ExportedHandler<Env>;
curl --request POST --url 'https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}/ai/run/@cf/deepgram/aura-1' --header 'Authorization: Bearer {TOKEN}' --header 'Content-Type: application/json' --data '{
"text":"Hello world!"
}'speaker
stringデフォルト: angusenum: angus, asteria, arcas, orion, orpheus, athena, luna, zeus, perseus, helios, hera, stella音声の生成に使う話者です。encoding
stringenum: linear16, flac, mulaw, alaw, mp3, opus, aac出力音声のエンコードです。container
stringenum: none, wav, ogg出力音声のファイル形式ラッパーです。使える選択肢はエンコード種別によって異なります。text
string必須音声に変換するテキストですsample_rate
number出力音声のサンプルレートです。エンコードによって対応する値が異なります。一部のエンコードでは変更できませんbit_rate
number音声のビットレート(bps)です。エンコード種別に応じた範囲または値から選びます。バインディングは MPEG 形式の音声を含む ReadableStream を返します(モデルの出力スキーマを確認してください)。