AI BENCHY Compare
Arcee AI: Trinity Large Preview (free) vs Qwen: Qwen3 Coder Next
Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-03
| Metrică | Arcee AI: Trinity Large Preview (free) none Lansare: 2026-01-27 Disponibil gratuit | Qwen: Qwen3 Coder Next none Lansare: 2026-02-03 |
|---|---|---|
| Rang | #33 | #36 |
| Scor mediu | 4.34 | 3.71 |
| Consistență | 9.97 | 9.53 |
| Cost per rezultat | 0.000 | 0.138 |
| Cost total | $0.000 | $0.005 |
| Teste corecte | 5/14 | 3/14 |
| Rată de trecere pe încercare | 35.7% | 26.2% |
| Teste instabile | 0 | 1 |
| Tokenuri de ieșire | 1,415 | 2,688 |
| Tokenuri de raționament | 0 | 0 |
Defalcare pe categorii
| Trucuri anti-AI | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|
| Arcee AI: Trinity Large Preview (free) | 1.00 | 10.00 | 0.0% | 0 | 587 | 0 | |
| Qwen: Qwen3 Coder Next | 2.33 | 9.99 | 0.0% | 0 | 1,315 | 0 |
| Parsare și extragere de date | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|
| Arcee AI: Trinity Large Preview (free) | 9.88 | 10.00 | 100.0% | 0 | 186 | 0 | |
| Qwen: Qwen3 Coder Next | 5.50 | 10.00 | 50.0% | 0 | 276 | 0 |
| Specific domeniului | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|
| Arcee AI: Trinity Large Preview (free) | 4.00 | 10.00 | 33.3% | 0 | 21 | 0 | |
| Qwen: Qwen3 Coder Next | 4.00 | 10.00 | 33.3% | 0 | 24 | 0 |
| Respectarea instrucțiunilor | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|
| Arcee AI: Trinity Large Preview (free) | 2.00 | 9.79 | 0.0% | 0 | 63 | 0 | |
| Qwen: Qwen3 Coder Next | 4.50 | 6.88 | 33.3% | 1 | 63 | 0 |
| Puzzle Solving | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|
| Arcee AI: Trinity Large Preview (free) | 4.00 | 9.99 | 33.3% | 0 | 291 | 0 | |
| Qwen: Qwen3 Coder Next | 1.00 | 9.92 | 0.0% | 0 | 755 | 0 |
| Apelare instrumente | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|
| Arcee AI: Trinity Large Preview (free) | 10.00 | 10.00 | 100.0% | 0 | 267 | 0 | |
| Qwen: Qwen3 Coder Next | 10.00 | 10.00 | 100.0% | 0 | 255 | 0 |
Comparație rapidă
Schimbă perechea de comparație
Trinity Large Preview (free)noneDisponibil gratuitvsGLM 4.7 FlashmediumQwen3 Coder NextnonevsGLM 4.7 FlashmediumTrinity Large Preview (free)noneDisponibil gratuitvsQwen3 Coder NextmediumTrinity Large Preview (free)noneDisponibil gratuitvsMiniMax M2.5mediumTrinity Large Preview (free)noneDisponibil gratuitvsgpt-oss-120bmediumDisponibil gratuitTrinity Large Preview (free)noneDisponibil gratuitvsQwen3.5-FlashmediumTrinity Large Preview (free)noneDisponibil gratuitvsGPT-5 NanomediumTrinity Large Preview (free)noneDisponibil gratuitvsQwen3.5-35B-A3BmediumTrinity Large Preview (free)noneDisponibil gratuitvsMiMo-V2-FlashmediumClaude Opus 4.6mediumvsTrinity Large Preview (free)noneDisponibil gratuitTrinity Large Preview (free)noneDisponibil gratuitvsSeed-2.0-MinimediumMiniMax M2.5mediumvsQwen3 Coder Nextnone