NVIDIA Nemotron 3 Ultra

by deepinfra

Parameters
Context Length
262K
Category
chat
Available Serverless

Run queries immediately, pay only for usage

$0.50in|$2.20out

Per 1M tokens

Try this modelView documentation

About this model

Capabilities

Providers

One model, several sources. DOS routes to the first that answers and falls back automatically, or you can pin a provider per request.

ProviderInput /1MOutput /1MContext
DeepInfraAvailable
$0.50$2.20262K

Model Details

Provider
Model ID
nemotron-3-ultra-550b-a55b
Parameters
Context Length
262K tokens
Category
chat

API Usage

Use the DOS API to integrate NVIDIA Nemotron 3 Ultra into your applications. Our API is compatible with OpenAI's client libraries for easy migration.

Model ID

nemotron-3-ultra-550b-a55b

Python

python
from dos import DOS

client = DOS()

response = client.chat.completions.create(
    model="nemotron-3-ultra-550b-a55b",
    messages=[
        {"role": "user", "content": "Hello, how are you?"}
    ]
)

print(response.choices[0].message.content)

cURL

bash
curl https://api.dos.ai/v1/chat/completions \
  -H "Authorization: Bearer $DOS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "nemotron-3-ultra-550b-a55b",
    "messages": [
      {"role": "user", "content": "Hello, how are you?"}
    ]
  }'

Node.js

javascript
import DOS from 'dos-ai';

const client = new DOS();

const response = await client.chat.completions.create({
  model: "nemotron-3-ultra-550b-a55b",
  messages: [
    { role: "user", content: "Hello, how are you?" }
  ]
});

console.log(response.choices[0].message.content);