クイックスタート
API key を作成して、最初の serverless inference を呼び出します。credit のある FPT AI Factory アカウントが必要です。開始前に Billing でチャージしてください。
ステップ 1: Model Catalog を確認する
- 左サイドバーで Serverless Inference をクリックします。
- Models をクリックして、利用できる model を一覧表示します。
- 各 model カードには model 名、提供元、context window、token 単価が表示されます。
使用する model 名 を控えてください。API request の body で指定します。
詳細ガイド: Model Catalog を確認する
ステップ 2: API key を作成する
- Serverless Inference のサイドバーで API Keys をクリックします。
- + Create API Key をクリックします。
- key の Name を入力します(例:
quickstart-test)。 - この key で呼び出しを許可する model を選択します(Select all のままでも構いません)。
- Create をクリックし、key をコピーします。key は一度しか表示されません。

詳細ガイド: API key を作成する
ステップ 3: API を呼び出す
serverless gateway に request を送信します。gateway の base URL は API Keys ページと各 model の詳細カードに表示されます。
curl https://<serverless-gateway-domain>/v1/chat/completions \
-H "Authorization: Bearer <your-api-key>" \
-H "Content-Type: application/json" \
-d '{
"model": "<model-name>",
"messages": [{"role": "user", "content": "Hello!"}],
"max_tokens": 256
}'
<serverless-gateway-domain>、<your-api-key>、<model-name> は実際の値に置き換えてください。
詳細ガイド: Inference API を呼び出す
ステップ 4: 使用量を確認する
- Serverless Inference のサイドバーで Usage をクリックします。
- ダッシュボードに当月累計の request 数、token in、token out、推定コストが表示されます。
- Tokens by model テーブルで model ごとの内訳を、Usage by API Key で key ごとの支出を確認できます。

詳細ガイド: Usage & Billing を確認する