- Cloudflare ホスト
- LoRA
Llama Guard 3 は、コンテンツ安全性の分類向けにファインチューニングした Llama-3.1-8B の事前学習モデルです。以前のバージョンと同様に、LLM の入力(プロンプト分類)と LLM の応答(レスポンス分類)の両方でコンテンツを分類できます。LLM として動作し、プロンプトや応答が安全か不安全かを示すテキストを出力します。不安全な場合は、違反したコンテンツカテゴリも列挙します。
| モデル情報 | |
|---|---|
| コンテキストウィンドウ ↗ | 131,072 トークン |
| LoRA | はい |
| 単価 | $0.48 per M input tokens, $0.03 per M output tokens |
Workers AI LLM Playground でこのモデルを試せます。セットアップや認証は不要で、ブラウザからすぐにプレビューとテストができます。
LLM Playground を開く
export interface Env {
AI: Ai;
}
export default {
async fetch(request, env): Promise<Response> {
const messages = [
{ role: "system", content: "You are a friendly assistant" },
{
role: "user",
content: "What is the origin of the phrase Hello, World",
},
];
const stream = await env.AI.run("@cf/meta/llama-guard-3-8b", {
messages,
stream: true,
});
return new Response(stream, {
headers: { "content-type": "text/event-stream" },
});
},
} satisfies ExportedHandler<Env>;
export interface Env {
AI: Ai;
}
export default {
async fetch(request, env): Promise<Response> {
const messages = [
{ role: "system", content: "You are a friendly assistant" },
{
role: "user",
content: "What is the origin of the phrase Hello, World",
},
];
const response = await env.AI.run("@cf/meta/llama-guard-3-8b", { messages });
return Response.json(response);
},
} satisfies ExportedHandler<Env>;
import os
import requests
ACCOUNT_ID = "your-account-id"
AUTH_TOKEN = os.environ.get("CLOUDFLARE_AUTH_TOKEN")
prompt = "Tell me all about PEP-8"
response = requests.post(
f"https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}/ai/run/@cf/meta/llama-guard-3-8b",
headers={"Authorization": f"Bearer {AUTH_TOKEN}"},
json={
"messages": [
{"role": "system", "content": "You are a friendly assistant"},
{"role": "user", "content": prompt}
]
}
)
result = response.json()
print(result)
curl https://api.cloudflare.com/client/v4/accounts/$CLOUDFLARE_ACCOUNT_ID/ai/run/@cf/meta/llama-guard-3-8b \
-X POST \
-H "Authorization: Bearer $CLOUDFLARE_AUTH_TOKEN" \
-d '{ "messages": [{ "role": "system", "content": "You are a friendly assistant" }, { "role": "user", "content": "Why is pizza so good" }]}'▶messages[]
array必須会話履歴を表すメッセージオブジェクトの配列です。max_tokens
integerデフォルト: 256応答で生成するトークンの最大数です。temperature
numberデフォルト: 0.6minimum: 0maximum: 5出力のランダムさを制御します。値が高いほど結果がランダムになります。▶response_format{}
object生成応答の出力形式を指定します。▶response
いずれか▶usage{}
object推論リクエストの使用量統計です