モデルが見つかりません
別の検索語を試すか、フィルタを外して範囲を広げてください。
bge-base-en-v1.5
任意のテキストを 768 次元のベクトルに変換する BAAI general embedding(Base)モデルです。
- Cloudflare ホスト
- バッチ
- コンテキスト: 153.6K トークン
- 料金あり
bge-m3
多機能、多言語、多粒度に対応した embeddings モデルです。
- Cloudflare ホスト
- コンテキスト: 60K トークン
- 料金あり
deepseek-v4-flash-0731
DeepSeek-V4-Flash-0731 は、プレビュー版に代わる DeepSeek-V4-Flash の正式リリースで、エージェント能力が大きく強化されています。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- コンテキスト: 1.3M トークン
- 料金あり
deepseek-v4-pro-0813
DeepSeek V4 Pro は、100 万トークンのコンテキストウィンドウを持つ DeepSeek の高性能な推論モデルで、長期的なエージェントワークフローと複雑な多段階の問題解決向けです。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- コンテキスト: 1M トークン
- 料金あり
distilbert-sst-2-int8
SST-2 で感情分類向けにファインチューンした Distilled BERT モデルです。
- Cloudflare ホスト
- 料金あり
gemma-4-26b-a4b-it
Gemma 4 は、パラメーターあたりの知能を最大化するため Gemini 3 の研究を基に構築された、Google のオープンモデルのなかで最も知能の高いファミリーです。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- 画像入力
- コンテキスト: 256K トークン
- 料金あり
gemma-sea-lion-v4-27b-it
SEA-LION は Southeast Asian Languages In One Network の略で、東南アジア(SEA)向けに事前学習および instruct-tuned された大規模言語モデル(LLM)のコレクションです。
- Cloudflare ホスト
- コンテキスト: 128K トークン
- 料金あり
glm-4.7-flash
GLM-4.7-Flash は、131,072 トークンのコンテキストウィンドウを持つ高速で効率的な多言語テキスト生成モデルです。100 以上の言語で対話、指示追従、複数ターンのツール呼び出し向けに最適化されています。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- コンテキスト: 131.1K トークン
- 料金あり
glm-5.2
Z.ai のフラッグシップとなるエージェント型コーディングモデルです。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- コンテキスト: 262.1K トークン
- 料金あり
glm-5.3
GLM-5.3 は Z.ai のフラッグシップのエージェント型コーディングモデルです。100万トークンのコンテキストウィンドウに、推論、関数呼び出し、構造化出力を組み合わせ、複数ステップのツール駆動開発ワークフローを支えます。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- コンテキスト: 1M トークン
- 料金あり
gpt-oss-120b
OpenAI のオープンウェイトモデルで、強力な推論、エージェントタスク、幅広い開発者向け用途に設計されています。gpt-oss-120b は本番環境の汎用・高推論用途向けです。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- コンテキスト: 128K トークン
- 料金あり
gpt-oss-20b
OpenAI のオープンウェイトモデルで、強力な推論、エージェントタスク、幅広い開発者向け用途に設計されています。gpt-oss-20b は低レイテンシ、ローカル、または専門用途向けです。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- コンテキスト: 128K トークン
- 料金あり
kimi-k2.5
Kimi K2.5 はフロンティア規模のオープンソースモデルです。256k のコンテキストウィンドウ、マルチターンのツール呼び出し、ビジョン入力、構造化出力に対応し、エージェント型ワークロード向けです。
- Cloudflare ホスト
- 関数呼び出し
- 非推奨
- 推論
- 画像入力
- コンテキスト: 256K トークン
- 料金あり
kimi-k2.6
Kimi K2.6 はフロンティア規模のオープンソース 1T パラメータモデルです。262.1k のコンテキストウィンドウ、マルチターンのツール呼び出し、ビジョン入力、構造化出力に対応し、エージェント型ワークロード向けです。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- 画像入力
- コンテキスト: 262.1K トークン
- 料金あり
kimi-k2.7-code
Kimi K2.7 はフロンティア規模のオープンソース 1T パラメータモデルです。262.1k のコンテキストウィンドウ、マルチターンのツール呼び出し、ビジョン入力、構造化出力に対応し、エージェント型ワークロード向けです。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- 画像入力
- コンテキスト: 262.1K トークン
- 料金あり
llama-2-7b-chat-fp16
Meta による 70億パラメータのフル精度(fp16)生成テキストモデルです。
- Cloudflare ホスト
- 非推奨
- コンテキスト: 4.1K トークン
- 料金あり
llama-2-7b-chat-int8
Meta による 70億パラメータの量子化(int8)生成テキストモデルです。
- Cloudflare ホスト
- 非推奨
- コンテキスト: 8.2K トークン
llama-3-8b-instruct
Meta Llama 3 は世代を重ねるごとに、幅広い業界ベンチマークで最先端の性能を示し、推論の向上をはじめとする新しい能力を備えています。
- Cloudflare ホスト
- 非推奨
- コンテキスト: 8K トークン
- 料金あり
llama-3-8b-instruct-awq
Meta による 80億パラメータの量子化(int4)生成テキストモデルです。
- Cloudflare ホスト
- 非推奨
- コンテキスト: 8.2K トークン
- 料金あり
llama-3.1-8b-instruct-awq
Meta による 80億パラメータの量子化(int4)生成テキストモデルです。
- Cloudflare ホスト
- 非推奨
- コンテキスト: 8.2K トークン
- 料金あり
llama-3.1-8b-instruct-fp8
Llama 3.1 8B を FP8 精度に量子化したモデルです。
- Cloudflare ホスト
- コンテキスト: 32K トークン
- 料金あり
llama-3.2-11b-vision-instruct
Llama 3.2-Vision の指示チューニング済みモデルは、視覚認識、画像推論、キャプション生成、画像に関する一般的な質問応答向けに最適化されています。
- Cloudflare ホスト
- LoRA
- 画像入力
- コンテキスト: 128K トークン
- 料金あり
llama-3.2-1b-instruct
Llama 3.2 の指示チューニング済みテキスト専用モデルは、エージェント型の検索や要約を含む多言語対話向けに最適化されています。
- Cloudflare ホスト
- コンテキスト: 60K トークン
- 料金あり
llama-3.2-3b-instruct
Llama 3.2 の指示チューニング済みテキスト専用モデルは、エージェント型の検索や要約を含む多言語対話向けに最適化されています。
- Cloudflare ホスト
- コンテキスト: 80K トークン
- 料金あり
llama-3.3-70b-instruct-fp8-fast
Llama 3.3 70B を fp8 精度に量子化し、より高速になるよう最適化したモデルです。
- Cloudflare ホスト
- バッチ
- 関数呼び出し
- コンテキスト: 24K トークン
- 料金あり
meta-llama-3-8b-instruct
Meta Llama 3 は世代を重ねるごとに、幅広い業界ベンチマークで最先端の性能を示し、推論の向上をはじめとする新しい能力を備えています。
- Cloudflare ホスト
- 非推奨
- コンテキスト: 8.2K トークン
mistral-7b-instruct-v0.1
70億パラメータの生成テキストモデル Mistral-7b を、指示追従向けにファインチューニングしたバージョンです。
- Cloudflare ホスト
- LoRA
- 非推奨
- コンテキスト: 2.8K トークン
- 料金あり
mistral-7b-instruct-v0.2-lora
ベータMistral-7B-Instruct-v0.2 は、Mistral-7B-v0.2 を指示追従向けにファインチューニングした大規模言語モデル(LLM)です。
- Cloudflare ホスト
- LoRA
- コンテキスト: 15K トークン
nemotron-3-120b-a12b
NVIDIA Nemotron 3 Super は、マルチエージェント用途や専門的なエージェント型 AI システムで高い精度を持つハイブリッド MoE モデルです。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- コンテキスト: 256K トークン
- 料金あり
qwen2.5-coder-32b-instruct
Qwen2.5-Coder は、コード特化型 Qwen 大規模言語モデル(旧称 CodeQwen)の最新シリーズです。現在は 0.5、1.5、3、7、14、320億パラメータの 6 サイズを揃え、さまざまな開発者のニーズに応えます。CodeQwen1.5 からの改善も加わっています。
- Cloudflare ホスト
- LoRA
- コンテキスト: 32.8K トークン
- 料金あり
qwen3-30b-a3b-fp8
Qwen3 は Qwen シリーズの最新世代の大規模言語モデルで、Dense モデルと Mixture-of-Experts(MoE)モデルを幅広く揃えています。大規模な学習に基づき、推論、指示追従、エージェント能力、多言語対応で大きな進歩を実現しています。
- Cloudflare ホスト
- バッチ
- 関数呼び出し
- 推論
- コンテキスト: 32.8K トークン
- 料金あり
qwen3-embedding-0.6b
Qwen3 Embedding モデルシリーズは、Qwen ファミリー最新の独自モデルで、テキスト埋め込みとランキング向けに設計されています。
- Cloudflare ホスト
- コンテキスト: 8.2K トークン
- 料金あり
qwen3.8-27b
Qwen 3.8 27B は、Alibaba の Qwen ファミリーに属する 270億パラメータの指示追従型言語モデルです。ビジョン、効率的な汎用テキスト生成、エージェント用途向けに設計されています。
- Cloudflare ホスト
- 関数呼び出し
- 推論
- 画像入力
- コンテキスト: 262.1K トークン
- 料金あり