Chuyển tới nội dung chính

Bắt đầu nhanh

Tạo API key và gọi serverless inference lần đầu. Bạn cần một tài khoản FPT AI Factory có credit — vào Billing để nạp trước khi bắt đầu.


Bước 1: Xem Model Catalog

  1. Ở sidebar bên trái, nhấn Serverless Inference.
  2. Nhấn Models để xem toàn bộ model đang có.
  3. Mỗi thẻ model hiển thị tên model, nhà cung cấp, context window và giá theo token.

Ghi lại tên model bạn muốn dùng — bạn sẽ truyền nó trong body của API request.

Xem hướng dẫn chi tiết: Xem Model Catalog


Bước 2: Tạo API key

  1. Nhấn API Keys trong sidebar của Serverless Inference.
  2. Nhấn + Create API Key.
  3. Nhập Name cho key (ví dụ quickstart-test).
  4. Chọn các model mà key này được phép gọi (hoặc giữ Select all).
  5. Nhấn Create, rồi copy key — key chỉ hiện một lần duy nhất.

Hộp thoại Create an API Key

Xem hướng dẫn chi tiết: Tạo API key


Bước 3: Gọi API

Gửi request tới serverless gateway. Base URL của gateway hiển thị ở trang API Keys và trong thẻ chi tiết của từng model.

curl https://<serverless-gateway-domain>/v1/chat/completions \
-H "Authorization: Bearer <your-api-key>" \
-H "Content-Type: application/json" \
-d '{
"model": "<model-name>",
"messages": [{"role": "user", "content": "Hello!"}],
"max_tokens": 256
}'

Thay <serverless-gateway-domain>, <your-api-key><model-name> bằng giá trị thật.

Xem hướng dẫn chi tiết: Gọi Inference API


Bước 4: Kiểm tra mức sử dụng

  1. Nhấn Usage trong sidebar của Serverless Inference.
  2. Dashboard hiển thị tổng từ đầu tháng: số request, token in, token out và chi phí ước tính.
  3. Bảng Tokens by model tách mức dùng theo từng model; Usage by API Key hiển thị chi phí theo từng key.

Serverless Inference — tab Usage

Xem hướng dẫn chi tiết: Theo dõi Usage & Billing