[NVIDIA](/ai-gateway/models/labs/nvidia)

# Nemotron 3 Nano 30B A3B

Nemotron 3 Nano 30B A3B is a sparse hybrid Mamba-Transformer mixture-of-experts (MoE) model with 30B total parameters but only 3B active per token. It supports a context window of 262.1K tokens with throughput closer to a 3B dense model than a 30B one. Your use is subject to NVIDIA's [Terms](https://assets.ngc.nvidia.com/products/api-catalog/legal/NVIDIA_Technology_Access_TOU.pdf) & [Privacy](https://www.nvidia.com/en-us/about-nvidia/privacy-policy/) Policies.

ReasoningTool Use

[Use with AI Gateway](https://vercel.com/d?to=%2F%5Bteam%5D%2F%7E%2Fai%3Futm_source%3Dgateway-model-page%26utm_campaign%3Dai-gateway-models&title=Get+Started+with+Vercel+AI+Gateway) [View docs](https://vercel.com/docs/ai-gateway)

AI SDKChat CompletionsMessagesResponses

```
1import { streamText } from 'ai'
2

3const result = streamText({
4  model: 'nvidia/nemotron-3-nano-30b-a3b',
5  prompt: 'Why is the sky blue?'
6})
```

[Read docs](https://vercel.com/docs/ai-gateway/sdks-and-apis/ai-sdk)

[Overview](/ai-gateway/models/nemotron-3-nano-30b-a3b) [API](/ai-gateway/models/nemotron-3-nano-30b-a3b/api) [About](/ai-gateway/models/nemotron-3-nano-30b-a3b/about) [Providers](/ai-gateway/models/nemotron-3-nano-30b-a3b/providers) [Throughput](/ai-gateway/models/nemotron-3-nano-30b-a3b/throughput) [Latency](/ai-gateway/models/nemotron-3-nano-30b-a3b/latency) [Uptime](/ai-gateway/models/nemotron-3-nano-30b-a3b/uptime) [Status](/ai-gateway/models/nemotron-3-nano-30b-a3b/status) [Similar](/ai-gateway/models/nemotron-3-nano-30b-a3b/similar) [FAQ](/ai-gateway/models/nemotron-3-nano-30b-a3b/faq)

1W

1D

1H