NEXAI Docs

Model & định tuyến

Model tự động nexai, cách liệt kê model khả dụng, và cơ chế định tuyến nhiều nguồn.

Model tự động: nexai

Không muốn chọn model? Đặt "model": "nexai" — NEXAI tự định tuyến request qua nguồn nhanh và ổn định nhất tại thời điểm đó. Hợp khi bạn muốn "chạy là được", không quan tâm nhà cung cấp bên dưới.

{ "model": "nexai", "messages": [{ "role": "user", "content": "..." }] }

Liệt kê model khả dụng

Gọi GET /v1/models (tương thích OpenAI) để lấy danh sách model đang mở:

curl 'https://getnexai.net/api/v1/models' \
  -H 'Authorization: Bearer sk-YOUR_API_KEY'

Chỉ những model đang bật mới xuất hiện. Dùng đúng tên id trả về trong trường model của request.

Chọn model cụ thể

Muốn kiểm soát chính xác thì đặt tên model vào model:

resp = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[{"role": "user", "content": "..."}],
)

Định tuyến & dự phòng

Mỗi model bán có thể được cấu hình chạy trên nhiều nguồn cùng lúc. Khi có request:

  • NEXAI xếp các nguồn theo mức ưu tiên và cân tải (trọng số) giữa các nguồn ngang hàng.
  • Nguồn đang lỗi/hết hạn mức tạm bị loại (circuit-breaker), tự phục hồi khi ổn định lại.
  • Nếu nguồn đầu lỗi, request tự chuyển sang nguồn kế tiếp (failover) — bạn không phải xử lý gì.

Nhờ vậy một model không phụ thuộc vào một nhà cung cấp duy nhất, giảm gián đoạn.

Chọn model nào?

  • Không chắc / muốn đơn giảnnexai (tự định tuyến).
  • Ưu tiên tốc độ & chi phí thấp → model dòng nhẹ (vd gpt-4o-mini).
  • Tác vụ khó / suy luận sâu → model dòng mạnh (xem /v1/models).
  • Lập trình / agent (Claude Code, Codex, dsh) → xem trang tích hợp tương ứng để chọn model + cấu hình đúng.

Giá từng model (USD + VND) niêm yết ở dashboard → Nạp tiền.

Lưu ý tương thích

  • Endpoint chat: POST /v1/chat/completions (chuẩn OpenAI, có stream). Tham số đầy đủ ở API Reference.
  • Tool-calling (function calling) hỗ trợ theo chuẩn OpenAI, cả streaming.
  • Bề mặt khác: /v1/responses (Codex) và /v1/messages (Claude Code) — cùng danh mục model bên dưới.
  • Nên dùng đúng id model trả về từ /v1/models.