Model Catalog を確認する
Model Catalog には、Serverless Inference で利用できる model がすべて掲載されています。適切な model を選び、API request 用に model 名を控えるために使用します。
Model Catalog を開く
左サイドバーの Serverless Inference で Models をクリックします。
model カードの見方
catalog の各カードには次の項目が表示されます。
| 項目 | 説明 |
|---|---|
| Model name | API request の model パラメータに指定する名前 |
| Provider | model を公開している組織(例: Meta、Mistral AI、Google) |
| Context window | 1 回の request で処理できる最大 token 数(input と output の合計) |
| Input price | input(prompt)token 100 万件あたりの料金 |
| Output price | output(completion)token 100 万件あたりの料金 |
絞り込みと検索
catalog 上部の検索バーで、model 名または提供元を絞り込めます。model カードをクリックすると、model の詳細説明と gateway URL を含む詳細ビューが開きます。
次のステップ
- API key を作成する — request を認証する key を発行します。
- Inference API を呼び出す — 選んだ model で最初の API を呼び出します。