all the models — AI benchmark observatory
← Models

Llama 3.1 Nemotron Ultra 253B v1

NVIDIA · open weight · llama-3.1-nemotron-ultra-253b-v1

A 253B parameter derivative of Meta Llama 3.1 405B Instruct, developed by NVIDIA using Neural Architecture Search (NAS) and vertical compression. It underwent multi-phase post-training (SFT for Math, Code, Reasoning, Chat, Tool Calling; RL with GRPO) to enhance reasoning and instruction-following. Optimized for accuracy/efficiency tradeoff on NVIDIA GPUs. Supports 128k context.

MATH-500IFEvalGPQAAIME 2025LiveCodeBenc

Benchmark scores

BenchmarkScore
MATH-5000.97
IFEval0.89
GPQA0.76
AIME 20250.72
LiveCodeBench0.66

Pricing

  • No provider pricing.

AA metrics

No Artificial Analysis link yet.

Arena Elo

  • No Arena snapshot linked.