ModelCap

Current AI model comparison

Exact identities · public evidence

StepFun

Step 3.7 Flash

Position

#96

Index

54.2

Estimated

3 reported rows against measured corpus ladders (20%); global-corpus-prior over 209 held-out anchors (17%); measured predecessor stepfun/step-3.5-flash less the succession penalty (63%); shrunk 0.6 up toward the measured corpus

Comparison side 1

Z.ai

GLM 5 Turbo

Position

#93

Index

54.4

Measured

publisher-corpus-prior over 209 held-out anchors (63%); 1 specialist-board observation at 1.2% support (37%); shrunk 24.5 up toward the measured corpus

Comparison side 2

Output / 1M

$1.15

vs $4.00

Context

262K

vs 203K

Weights

Open weights

vs API only