Navigatie
AI BENCHY
Vergelijken Grafieken
❤️ Made by XCS
Your ad here

AI BENCHY Compare

LiquidAI: LFM2-24B-A2B vs MiniMax: MiniMax M2.5

Modelnaam:

Benchmarks gegenereerd uit AI BENCHY-testsuites op : 2026-02-27 15:16

Samenvatting

Metriek LiquidAI: LFM2-24B-A2B none Releasedatum: Onbekende releasedatum MiniMax: MiniMax M2.5 medium Releasedatum: Onbekende releasedatum
Rang #39 #26
Score 2.43 5.64
Consistentie 8.91 6.12
Kosten per resultaat 0.045 4.028
Totale kosten $0.001 $0.242
Correcte tests
Foute tests 13 8
Slaagpercentage per poging 16.7% 64.3%
Instabiele tests 2 7
Uitvoer-tokens 1,125 121,297
Redeneer-tokens 0 203,513

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Uitvoer-tokens Redeneer-tokens
LiquidAI: LFM2-24B-A2B 1.00 9.81 0.0% 0 490 0
MiniMax: MiniMax M2.5 9.33 7.89 88.9% 1 286 45,112
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Uitvoer-tokens Redeneer-tokens
LiquidAI: LFM2-24B-A2B 1.00 10.00 0.0% 0 219 0
MiniMax: MiniMax M2.5 5.50 5.81 83.3% 1 369 4,952
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Uitvoer-tokens Redeneer-tokens
LiquidAI: LFM2-24B-A2B 4.00 7.21 55.6% 1 30 0
MiniMax: MiniMax M2.5 1.00 4.41 22.2% 2 111,023 139,533
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Uitvoer-tokens Redeneer-tokens
LiquidAI: LFM2-24B-A2B 3.00 10.00 0.0% 0 60 0
MiniMax: MiniMax M2.5 7.00 6.41 66.7% 1 1,121 2,521
Puzzle Solving Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Uitvoer-tokens Redeneer-tokens
LiquidAI: LFM2-24B-A2B 3.33 7.88 22.2% 1 326 0
MiniMax: MiniMax M2.5 4.33 4.79 55.6% 2 8,229 10,458
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Uitvoer-tokens Redeneer-tokens
LiquidAI: LFM2-24B-A2B 1.00 10.00 0.0% 0 0 0
MiniMax: MiniMax M2.5 10.00 10.00 100.0% 0 269 937

Vergelijkingspaar wisselen