Nvidia

NVIDIA

nvidia/ · 9 models

Access 9 NVIDIA models through AnonRouter's privacy-first gateway, including Nemotron Cascade 2 30B A3B, NVIDIA Nemotron 3 Nano 30B, and NVIDIA Nemotron 3 Ultra. Compare pricing, context windows, and capabilities across NVIDIA's text, audio, embeddings routes — every request anonymized, with no payload logging.

Models

9

Modalities

3

Text, Audio, Embeddings

From (input)

$0.0125

per 1M tokens

Max context

262K

Private routes

9 / 9

not anonymous-only

Catalog by modality

9 routes
Text7Audio1Embeddings1

NVIDIA models9

Nvidia
Nemotron Cascade 2 30B A3B
nvidia/nemotron-cascade-2-30b-a3b
Private

Nemotron Cascade 2 30B A3B is a reasoning-optimized language model from NVIDIA, designed for efficient inference with strong reasoning capabilities across complex tasks.

Private|256K context|$0.14/M input|$0.80/M output
Nvidia
NVIDIA Nemotron 3 Nano 30B
nvidia/nvidia-nemotron-3-nano-30b
Private

NVIDIA Nemotron 3 Nano 30B is a compact and efficient language model from NVIDIA, optimized for fast inference while maintaining strong performance across diverse tasks.

Private|128K context|$0.075/M input|$0.30/M output
Nvidia
NVIDIA Nemotron 3 Ultra
nvidia/nvidia-nemotron-3-ultra
Private

NVIDIA Nemotron 3 Ultra is built for frontier reasoning, orchestration, coding agents, deep research, and complex enterprise workflows. It delivers up to 5x faster inference and up to 30% lower cost for agentic workloads while supporting up to 1M token context.

Private|256K context|$0.625/M input|$3.125/M output
Nvidia
Nemotron Nano 9B V2
nvidia/nemotron-nano-9b-v2
Private

Nemotron Nano 9B V2 served through Amazon Bedrock with support for AWS zero-data-retention mode.

Private|128K context|$0.06/M input|$0.23/M output
Nvidia
Nemotron Nano 12B V2
nvidia/nemotron-nano-12b-v2
Private

Nemotron Nano 12B V2 served through Amazon Bedrock with support for AWS zero-data-retention mode.

Private|128K context|$0.20/M input|$0.60/M output
Nvidia
Nemotron Super 3 120B
nvidia/nemotron-super-3-120b
Private

Nemotron Super 3 120B served through Amazon Bedrock with support for AWS zero-data-retention mode.

Private|256K context|$0.15/M input|$0.65/M output
Nvidia
NVIDIA Nemotron 3 Super 120B A12B
nvidia/nvidia-nemotron-3-super-120b-a12b
Private

NVIDIA Nemotron 3 Super 120B A12B served on DeepInfra serverless inference.

Private|262K context|$0.085/M input|$0.40/M output
Nvidia
Nemotron Embed VL 1B v2
nvidia/nemotron-embed-vl-1b-v2
Private

Embedding model for semantic search and retrieval, served through Venice.

Private|33K context|$0.0125/M input|$0.0125/M output
Nvidia
Parakeet ASR
nvidia/parakeet-asr
Private

Speech-to-text transcription model served through Venice.

Private|Unknown context|$0.006/min|
NVIDIA models — AnonRouter