● Deploy anywhere Get API key
All models

31 models. One API.
Powered by NVIDIA NIM.

Every Plugsky model runs on NVIDIA NIM — NVIDIA's inference platform hosting 100+ open and proprietary models. Free, paid, vision, reasoning, code, and embeddings. Switch models in a single line.

🆓 Free tier 💎 Paid tier 🧠 Reasoning 👁️ Vision 💻 Code 📚 Long context 🔢 Embeddings
31
Total models
2
Free tier
27
Paid tier
2
Embeddings
1M
Max context
100%
NVIDIA NIM

🧠 Model catalog

Loading live model catalog from GET /v1/models

Loading models…

API usage

OpenAI-compatible. Any model above can be used with a single line change. No code rewrites between models.

cURL
curl https://api.plugsky.com/v1/chat/completions \
  -H "Authorization: Bearer sk-live-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "plugsky-pro",
    "messages": [{"role": "user", "content": "Hello!"}],
    "max_tokens": 200
  }'
Python (openai SDK)
from openai import OpenAI

client = OpenAI(
    api_key="sk-live-...",
    base_url="https://api.plugsky.com/v1"
)

resp = client.chat.completions.create(
    model="plugsky-pro",
    messages=[{"role": "user", "content": "Hello!"}],
    max_tokens=200,
)
print(resp.choices[0].message.content)
JavaScript / TypeScript
const r = await fetch("https://api.plugsky.com/v1/chat/completions", {
  method: "POST",
  headers: {
    "Authorization": "Bearer sk-live-...",
    "Content-Type": "application/json"
  },
  body: JSON.stringify({
    model: "plugsky-pro",
    messages: [{ role: "user", content: "Hello!" }],
    max_tokens: 200
  })
});
const data = await r.json();
console.log(data.choices[0].message.content);