ModelCap

Current AI model comparison

Exact identities · public evidence

Meta

Muse Glimmer 30B

Position

#28

Index

68.4

Measured

publisher-corpus-prior over 182 held-out anchors (37%); 1 specialist-board observation at 1.3% support (21%); launch card against 2 resolved peers on 12 rows (42%); exceeds every named peer on 6 of 12 rows; optimism haircut 0 from cross-lab-probe; shrunk 8.1 up toward the measured corpus

Comparison side 1

Tencent

Hy4 preview

Position

#26

Index

70.4

Measured

9 reported rows against measured corpus ladders (38%); publisher-corpus-prior over 182 held-out anchors (12%); opens above measured predecessor tencent/hy3 on same-family ordering evidence (41%); 1 specialist-board observation at 2.5% support (9%); shrunk 1.2 toward the measured corpus

Comparison side 2

Output / 1M

$1.10

vs $2.50

Context

131K

vs 1M

Weights

Open weights

vs Open weights