all the models — AI benchmark observatory
← Models

Claude 3.5 Sonnet

Anthropic · proprietary · claude-3-5-sonnet-20240620

Claude 3.5 Sonnet is a powerful AI model. It excels in graduate-level reasoning, undergraduate-level knowledge, and coding proficiency, with improved understanding of nuance, humor, and complex instructions.

GSM8kBIG-Bench HaHumanEvalMGSMMMLUMMLU-Pro

Benchmark scores

BenchmarkScore
GSM8k0.96
BIG-Bench Hard0.93
HumanEval0.92
MGSM0.92
MMLU0.90
MMLU-Pro0.76
MATH0.71
GPQA0.59

Pricing

  • No provider pricing.

AA metrics

No Artificial Analysis link yet.

Arena Elo

  • No Arena snapshot linked.