Xem Model Catalog
Model Catalog liệt kê mọi model dùng được qua Serverless Inference. Dùng nó để chọn model phù hợp và ghi lại tên model cho các API request.
Mở Model Catalog
Ở sidebar bên trái, trong mục Serverless Inference, nhấn Models.
Đọc một thẻ model
Mỗi thẻ trong catalog hiển thị:
| Trường | Mô tả |
|---|---|
| Model name | Tên truyền vào tham số model trong API request |
| Provider | Tổ chức phát hành model (ví dụ Meta, Mistral AI, Google) |
| Context window | Số token tối đa model xử lý được trong một request (tính cả input và output) |
| Input price | Giá cho 1 triệu token input (prompt) |
| Output price | Giá cho 1 triệu token output (completion) |
Lọc và tìm kiếm
Dùng thanh tìm kiếm phía trên catalog để lọc theo tên model hoặc nhà cung cấp. Nhấn vào một thẻ model để mở trang chi tiết kèm mô tả đầy đủ và URL gateway.
Tiếp theo
- Tạo API key — tạo key để xác thực request.
- Gọi Inference API — gọi API lần đầu với model vừa chọn.