Chuyển tới nội dung chính

Duyệt Model Catalog

Mở Model Catalog

Ở sidebar bên trái, trong Dedicated Inference, nhấn Model Catalog.

Tab Model Catalog với các model tuyển chọn và bộ lọc

Catalog hiển thị các model khả dụng từ Hugging Face dưới dạng lưới thẻ. Mỗi thẻ gồm:

  • Tên model và đường dẫn repository Hugging Face (ví dụ meta-llama/Llama-3.3-70B-Instruct)
  • Nhãn năng lực: Chat · Reasoning · Code · Embedding · Vision
  • Kích thước context window (ví dụ 128K)
  • Giá khởi điểm: FROM $X.XX /GPU-h

Lọc model

Dùng các tab lọc phía trên để thu hẹp theo loại năng lực:

All · Chat · Code · Reasoning · Embedding · Vision

Dùng thanh tìm kiếm (Search: llama, qwen, embedding...) để tìm model theo tên hoặc repository.

Deploy một model

Nhấn Deploy trên thẻ model để chuyển sang My endpoints và mở modal Deploy Dedicated Endpoint. Bạn cần nhập đường dẫn repository Hugging Face thủ công.

Xem hướng dẫn chi tiết: Deploy một model