Command A+ (low) conduce la scorul mediu cu 3.0 vs 1.9. D1 are costul de benchmark mai mic, $0.003 vs $0.073. D1 este mai rapid cu 508ms vs 92.50s, cu rate de reușită de 1.5% vs 11.6%.
Benchmark-urile au fost generate din suitele de teste AI BENCHY la:
2026-10-02
Modele comparate
Rang
#376
Total tokenuri de ieșire
25,521
Timp de răspuns (mediu)
92.50s
Cost total
$0.073
Rang
#382
Total tokenuri de ieșire
0
Timp de răspuns (mediu)
508ms
Cost total
$0.003
Model recomandatCommand A+ (low)
Are cel mai puternic scor din această comparație (3.0) și cel mai bun echilibru între cost și timp de răspuns dintre toate cele 2 modele.
D1D1none36/69 încercări. Adaptoarele oferă variantele de răspuns. Acceptă 12/23 teste. Celelalte teste sunt incompatibile, nu eșuate. Scorul folosește suita completă.Lansare: 2026-10-02
D1D1none36/69 încercări. Adaptoarele oferă variantele de răspuns. Acceptă 12/23 teste. Celelalte teste sunt incompatibile, nu eșuate. Scorul folosește suita completă.Lansare: 2026-10-02
Scor
3.0Scor mediu pe toate testele de benchmark.…
1.9Scor mediu pe toate testele de benchmark.…
Rang
#376
#382
Fiabilitate
3.5Scorul de succes la prima încercare: 10.0 înseamnă fără erori reîncercabile ale API-ului țintă sau de limită de rată înainte de apeluri reușite; erorile urmărite reduc scorul.…
10.0Scorul de succes la prima încercare: 10.0 înseamnă fără erori reîncercabile ale API-ului țintă sau de limită de rată înainte de apeluri reușite; erorile urmărite reduc scorul.…
Consistență
9.6Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
4.9Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
Încercări
69/69
36/69
Teste corecte
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 22Răspuns greșit: 1Timp de răspuns (mediu)92.50sTimp de răspuns (maxim)128.54sTimp de răspuns (total)2127.40sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 10Timp de răspuns (mediu)508msTimp de răspuns (maxim)820msTimp de răspuns (total)6.10sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
Rată de trecere pe încercare
1.5%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
11.6%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
Teste instabile
1Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
1Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Rulări totale
69Rulări totale…
36Rulări totale…
Cost per rezultat
0.000
0.112
Cost total
$0.073
$0.003
Preț de intrare
$0.300 / 1MPreț de intrare…
$0.040 / 1MPreț de intrare…
Preț de ieșire
$1.500 / 1MPreț de ieșire…
$0.000 / 1MPreț de ieșire…
Preț citire cache
$0.150 / 1MPreț citire cache…
$0.040 / 1MPreț citire cache…
Preț scriere cache
N/DPreț scriere cache…
N/DPreț scriere cache…
Total tokenuri de intrare
114,874Total tokenuri de intrare…
55,956Total tokenuri de intrare…
Tokenuri de ieșire
1,992Tokenuri de ieșire…
0Tokenuri de ieșire…
Tokenuri de raționament
23,529Tokenuri de raționament…
0Tokenuri de raționament…
Timp de răspuns (mediu)
92.50sTimp de răspuns (mediu)…
508msTimp de răspuns (mediu)…
Timp de răspuns (maxim)
128.54sTimp de răspuns (maxim)…
820msTimp de răspuns (maxim)…
Timp de răspuns (total)
2127.40sTimp de răspuns (total)…
6.10sTimp de răspuns (total)…
Parametri
218B în total (25B activi)
-
Disponibilitate
Sursă deschisă
Închis
Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.
Prezentare generare modele
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#376 Command A+
low
Provider returned error
Cost
$0.000
Timp
0.2s
Tokenuri
0 tok
#382 LiquidAI: D1
none
Nu s-a generat încă niciun rezultat de prezentare pentru acest model.
1.6Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
33.3%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
1Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 1Timp de răspuns (mediu)128.54sTimp de răspuns (maxim)128.54sTimp de răspuns (total)128.54sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
0.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)0msTimp de răspuns (maxim)0msTimp de răspuns (total)0msUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 4Timp de răspuns (mediu)87.46sTimp de răspuns (maxim)103.34sTimp de răspuns (total)349.85sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
7.5Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
25.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 2Timp de răspuns (mediu)431msTimp de răspuns (maxim)505msTimp de răspuns (total)1.29sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 3Timp de răspuns (mediu)86.43sTimp de răspuns (maxim)92.24sTimp de răspuns (total)259.28sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
6.7Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 2Timp de răspuns (mediu)456msTimp de răspuns (maxim)577msTimp de răspuns (total)911msUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 2Timp de răspuns (mediu)83.53sTimp de răspuns (maxim)90.11sTimp de răspuns (total)167.05sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
0.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)0msTimp de răspuns (maxim)0msTimp de răspuns (total)0msUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 2Timp de răspuns (mediu)85.39sTimp de răspuns (maxim)99.05sTimp de răspuns (total)170.77sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
50.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 1Timp de răspuns (mediu)418msTimp de răspuns (maxim)518msTimp de răspuns (total)836msUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 3Timp de răspuns (mediu)82.74sTimp de răspuns (maxim)103.01sTimp de răspuns (total)248.23sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
7.2Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
22.2%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
1Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 3Timp de răspuns (mediu)555msTimp de răspuns (maxim)589msTimp de răspuns (total)1.66sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 1Timp de răspuns (mediu)101.81sTimp de răspuns (maxim)101.81sTimp de răspuns (total)101.81sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
0.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)0msTimp de răspuns (maxim)0msTimp de răspuns (total)0msUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 2Timp de răspuns (mediu)105.69sTimp de răspuns (maxim)116.28sTimp de răspuns (total)211.38sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
5.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 1Timp de răspuns (mediu)820msTimp de răspuns (maxim)820msTimp de răspuns (total)820msUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 3Timp de răspuns (mediu)95.76sTimp de răspuns (maxim)102.09sTimp de răspuns (total)287.28sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
3.3Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 1Timp de răspuns (mediu)570msTimp de răspuns (maxim)570msTimp de răspuns (total)570msUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 1Timp de răspuns (mediu)99.68sTimp de răspuns (maxim)99.68sTimp de răspuns (total)99.68sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
0.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)0msTimp de răspuns (maxim)0msTimp de răspuns (total)0msUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 1Timp de răspuns (mediu)103.52sTimp de răspuns (maxim)103.52sTimp de răspuns (total)103.52sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
0.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)0msTimp de răspuns (maxim)0msTimp de răspuns (total)0msUn test este considerat trecut complet doar dacă toate rulările lui trec.…