all the models — AI benchmark observatory
← Benchmarks

AndroidBench

AndroidBench evaluates coding agents on Android application development tasks.

id androidbench · max 1 · 1 models reported

#ModelScore
1Qwen3.8 Max
Alibaba Cloud / Qwen Team · open
0.75