Résumé
gpt-oss-120b obtient 4.2 sur AI BENCHY et se classe #361. Il affiche une fiabilité de 10.0, un taux de réussite de 34.8%, un coût total de $0.016 et un temps de réponse moyen de 28.63s.
Ce qui rend gpt-oss-120b unique : Il se distingue surtout en Tâches agentiques, où il se classe #1, tandis que Programmation est son point le plus faible avec #10.
Données du modèle
Date de recherche : 2026-08-12
- Paramètres
- 117B au total (5.1B actifs)
- Architecture
- MoE
- Disponibilité
- Open source
- Licence
- Apache-2.0
4.2
Cohérence
7.6
10.0
Total des jetons de sortie
62,213
Total des jetons d'entrée
131,652
Prix d'entrée
$0.037 / 1M
Prix de sortie
$0.170 / 1M
Prix de lecture du cache
N/D
Prix d’écriture du cache
N/D
Les prix du cache concernent les tokens d’entrée. La lecture réutilise les prompts en cache ; l’écriture les stocke et peut coûter plus cher. Les tokens de sortie utilisent le prix de sortie.
Tests incorrects: 14
Taux de réussite par tentative: 34.8%
Couverture du benchmark: 60/69 tentatives (Objectif : 3 répétitions par test)
Tests instables
3
Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).
Historique des runs
| Testé le | Score | Fiabilité | Tests corrects | Coût total | Comparer |
|---|---|---|---|---|---|
| 2026-10-01 05:17 Suite modifiée | 4.2 | 10.0 | $0.016 ↓ | Exécution actuelle | |
| 2026-04-21 12:42 Première exécution enregistrée | 5.2 | N/D | $0.009 | Comparer |
Ce run a utilisé une suite de benchmark différente. Gardez ce changement de suite à l'esprit lorsque vous lisez l'historique.
Historique des prix
Données historiques de tarification pour ce modèle provenant d'OpenRouter.
| Date | Prix d'entrée | Prix de sortie | Prix de lecture du cache | Prix d’écriture du cache |
|---|---|---|---|---|
| 2026-06-04 15:40 | $0.039 / 1M | $0.180 / 1M | N/D | N/D |
| 2026-06-29 01:00 | $0.030 / 1M | $0.150 / 1M | N/D | N/D |
| 2026-07-09 20:59 | $0.036 / 1M | $0.180 / 1M | N/D | N/D |
| 2026-07-16 15:36 | $0.037 / 1M | $0.170 / 1M | N/D | N/D |
| 2026-08-12 11:59 | $0.030 / 1M | $0.170 / 1M | N/D | N/D |
Graphiques
Choisissez d'abord le premier modèle, puis cliquez sur un second modèle pour ouvrir une page côte à côte.
Score vs Coût total
Temps de réponse (moy.)
Score vs Temps de réponse (moy.)
Total des jetons de sortie
Score vs Total des jetons de sortie
Comparaison rapide
Répartition par catégorie
| Catégorie | Score | Cohérence | Tests corrects |
|---|---|---|---|
| Tâches agentiques | 6.1 | 3.1 | |
| Astuces anti-IA | 6.5 | 10.0 | |
| Programmation | 1.5 | 0.4 | |
| Combiné | 1.5 | 5.0 | |
| Analyse et extraction des données | 6.5 | 10.0 | |
| Spécifique au domaine | 3.0 | 10.0 | |
| Intelligence générale | 4.8 | 10.0 | |
| Suivi des instructions | 9.8 | 10.0 | |
| Résolution d'énigmes | 6.0 | 7.2 | |
| Appel d'outils | 3.0 | 10.0 | |
| Culture générale | 3.0 | 10.0 |