nvidia/Llama-3_1-Nemotron-Ultra-253B-v1
NvidiaLlama-3.1-Nemotron-Ultra-253B is a 253 billion parameter reasoning-focused language model optimized for efficiency that excels at math, coding, and general instruction-following tasks while running on a single 8xH100 node.
Pricing
- Input Tokens: $0.5 /M tokens
- Output Tokens: $0.5 /M tokens
- Cache Read: $0 /M tokens
Input Modalities
Try this model
Python