ModelCap
Current AI model comparison
Exact identities · public evidence
IFM
K2 Horizon 32B
Position
#83
Index
48.4
Estimated
global-corpus-prior over 183 held-out anchors (49%); launch card against 2 resolved peers on 8 rows (51%); exceeds every named peer on 1 of 8 rows; optimism haircut 1.3 from cross-lab-probe; shrunk 4.9 up toward the measured corpus
Comparison side 1
StepFun
Step 3.7 Flash
Position
#84
Index
48.2
Estimated
3 reported rows against measured corpus ladders (14%); global-corpus-prior over 183 held-out anchors (19%); measured predecessor stepfun/step-3.5-flash less the succession penalty (67%); shrunk 1.2 up toward the measured corpus
Comparison side 2
Output / 1M
Unavailable
vs $1.15
Context
—
vs 262K
Weights
Open weights
vs Open weights