メインコンテンツまでスキップ

クイックスタート

API key を作成して、最初の serverless inference を呼び出します。credit のある FPT AI Factory アカウントが必要です。開始前に Billing でチャージしてください。


ステップ 1: Model Catalog を確認する

  1. 左サイドバーで Serverless Inference をクリックします。
  2. Models をクリックして、利用できる model を一覧表示します。
  3. 各 model カードには model 名、提供元、context window、token 単価が表示されます。

使用する model 名 を控えてください。API request の body で指定します。

詳細ガイド: Model Catalog を確認する


ステップ 2: API key を作成する

  1. Serverless Inference のサイドバーで API Keys をクリックします。
  2. + Create API Key をクリックします。
  3. key の Name を入力します(例: quickstart-test)。
  4. この key で呼び出しを許可する model を選択します(Select all のままでも構いません)。
  5. Create をクリックし、key をコピーします。key は一度しか表示されません。

Create an API Key ダイアログ

詳細ガイド: API key を作成する


ステップ 3: API を呼び出す

serverless gateway に request を送信します。gateway の base URL は API Keys ページと各 model の詳細カードに表示されます。

curl https://<serverless-gateway-domain>/v1/chat/completions \
-H "Authorization: Bearer <your-api-key>" \
-H "Content-Type: application/json" \
-d '{
"model": "<model-name>",
"messages": [{"role": "user", "content": "Hello!"}],
"max_tokens": 256
}'

<serverless-gateway-domain><your-api-key><model-name> は実際の値に置き換えてください。

詳細ガイド: Inference API を呼び出す


ステップ 4: 使用量を確認する

  1. Serverless Inference のサイドバーで Usage をクリックします。
  2. ダッシュボードに当月累計の request 数、token in、token out、推定コストが表示されます。
  3. Tokens by model テーブルで model ごとの内訳を、Usage by API Key で key ごとの支出を確認できます。

Serverless Inference — Usage タブ

詳細ガイド: Usage & Billing を確認する