Providers

Vultr

Verified

A global cloud provider with GPU inference across 30+ regions.

Models on Vultr

Open in catalog

5 of 5

DeepSeek V4 Flash 0731Chatdeepseek-v4-flash-07311M contextWeights Routeemergency$0.22 / $0.66per M input / output
GLM 5.2Chatglm-5.21M contextWeights Routeemergency$1.40 / $4.40per M input / output
MiniMax M3Chatminimax-m3512K contextRouteemergency$0.30 / $1.20per M input / output
Nemotron 3 Nano OmniChatnemotron-3-nano-omni66K contextRouteemergency$0.50 / $0.90per M input / output
Qwen 3.8 27BChatqwen-3.8-27b1M contextRouteemergency$0.45 / $3.20per M input / output
Direct routingCall Vultr explicitly
vultr· routing
# pin every request to Vultr
curl https://www.ninjachat.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $NINJACHAT_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash-0731",
    "messages": [{ "role": "user", "content": "Hello!" }],
    "routing": { "providers": { "only": ["vultr"] } }
  }'