[NVIDIA](/ai-gateway/models/labs/nvidia)

# Nvidia Nemotron Nano 12B V2 VL

Nvidia Nemotron Nano 12B V2 VL is NVIDIA's open 12B multimodal reasoning model with a hybrid Mamba-Transformer architecture, OCRBenchV2 results, and specialized support for document intelligence, video understanding, and RAG pipelines.

Input and output price

Prices from: Input $0.20, Output $0.60, Per 1M tokens

24h uptime

Loading AI Gateway uptime

[Get API key](https://vercel.com/d?to=%2F%5Bteam%5D%2F~%2Fai-gateway%3FshowCreateKeyModal%26utm_source%3Dgateway-model-page%26utm_campaign%3Dai-gateway-models&title=Get%20API%20key) [Read the docs](https://vercel.com/docs/ai-gateway)

AI SDKChat CompletionsMessagesResponses

```
1import { streamText } from 'ai'
2

3const result = streamText({
4  model: 'nvidia/nemotron-nano-12b-v2-vl',
5  prompt: 'Why is the sky blue?'
6})
```

[Read docs](https://vercel.com/docs/ai-gateway/sdks-and-apis/ai-sdk)

[Overview](/ai-gateway/models/nemotron-nano-12b-v2-vl) [API](/ai-gateway/models/nemotron-nano-12b-v2-vl/api) [Providers](/ai-gateway/models/nemotron-nano-12b-v2-vl/providers) [Uptime](/ai-gateway/models/nemotron-nano-12b-v2-vl/uptime) [Status](/ai-gateway/models/nemotron-nano-12b-v2-vl/status) [Throughput](/ai-gateway/models/nemotron-nano-12b-v2-vl/throughput) [Latency](/ai-gateway/models/nemotron-nano-12b-v2-vl/latency) [Similar](/ai-gateway/models/nemotron-nano-12b-v2-vl/similar) [About](/ai-gateway/models/nemotron-nano-12b-v2-vl/about) [FAQ](/ai-gateway/models/nemotron-nano-12b-v2-vl/faq)

## [Copy link to heading](#throughput)Throughput24 hours

1W

1D

P50 throughput on live AI Gateway traffic, in tokens per second (TPS). Visit the [docs](https://vercel.com/docs/ai-gateway/models-and-providers/metrics) for more info.

Your use is subject to NVIDIA's [Terms](https://assets.ngc.nvidia.com/products/api-catalog/legal/NVIDIA_Technology_Access_TOU.pdf) & [Privacy](https://www.nvidia.com/en-us/about-nvidia/privacy-policy/) Policies.