Anthropic: Claude Opus 4.7 vs Tencent: Hy3 preview
Samenvatting
Benchmarkvergelijking Claude Opus 4.7 vs Hy3 preview: Claude Opus 4.7 leidt in gemiddelde score met 7.4 vs 6.8. Hy3 preview heeft lagere benchmarkkosten met $0.059 vs $0.505. Claude Opus 4.7 is sneller met 3.02s vs 56.57s, met slagingspercentages van 76.2% vs 55.6%.
Aanbevolen model: Claude Opus 4.7 - Het heeft hier de beste score (7.4) en reageert ongeveer 18.7x sneller dan Hy3 preview.
Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-18
Metriek
Claude Opus 4.7Claude Opus 4.7noneGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2026-04-16
Hy3 previewHy3 previewhighGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2026-04-22
Metriek
Claude Opus 4.7Claude Opus 4.7noneGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2026-04-16
Hy3 previewHy3 previewhighGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2026-04-22
Score
7.4Gemiddelde score over alle benchmarktests.…
6.8Gemiddelde score over alle benchmarktests.…
Rang
#49
#74
Betrouwbaarheid
10.0Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vóór succesvolle calls; geregistreerde fouten verlagen de score.…
10.0Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vóór succesvolle calls; geregistreerde fouten verlagen de score.…
Consistentie
9.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
9.2Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
Correcte tests
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 3Responstijd (gem.)3.02sResponstijd (max)18.27sResponstijd (totaal)57.44sEen test is alleen volledig geslaagd als alle runs slagen.…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 7Verkeerd antwoord: 3Responstijd (gem.)56.57sResponstijd (max)149.94sResponstijd (totaal)848.59sEen test is alleen volledig geslaagd als alle runs slagen.…
Slaagpercentage per poging
76.2%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
55.6%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
Instabiele tests
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
2Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Totaal runs
57Totaal runs…
63Totaal runs…
Kosten per resultaat
3.154Toont de gemiddelde kosten per correct benchmark-antwoord in centen (lager is beter).…
0.000Toont de gemiddelde kosten per correct benchmark-antwoord in centen (lager is beter).…
Totale kosten
$0.505Totale kosten (huidige prijs)…
$0.059Totale kosten (huidige prijs)…
Invoerprijs
$5.000 / 1MInvoerprijs…
$0.066 / 1MInvoerprijs…
Uitvoerprijs
$25.000 / 1MUitvoerprijs…
$0.260 / 1MUitvoerprijs…
Totaal aantal invoer-tokens
69,576Totaal aantal invoer-tokens…
25,987Totaal aantal invoer-tokens…
Uitvoer-tokens
6,265Uitvoer-tokens…
216,719Uitvoer-tokens…
Redeneer-tokens
0Redeneer-tokens…
0Redeneer-tokens…
Responstijd (gem.)
3.02sResponstijd (gem.)…
56.57sResponstijd (gem.)…
Responstijd (max)
18.27sResponstijd (max)…
149.94sResponstijd (max)…
Responstijd (totaal)
57.44sResponstijd (totaal)…
848.59sResponstijd (totaal)…
Generatie-showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#49 Claude Opus 4.7
none
Kosten
$0.051
Tijd
24.2s
Tokens
2,181 tok
#74 Hy3 preview
high
Hy3 preview is no longer available as a free model. It has transitioned to a paid model. Continue using it here: https://openrouter.ai/tencent/hy3-preview
Kosten
$0.000
Tijd
0.0s
Tokens
0 tok
Score
-
Kosten
-
Tijd
-
Tokens
-
Topmodellen op score
Score vs totale kosten
Responstijd (gem.)
Score vs Responstijd (gem.)
Totaal aantal uitvoer-tokens
Score vs Totaal aantal uitvoer-tokens
Categorie-uitsplitsing
Anti-AI-trucs
Score
Consistentie
Slaagpercentage per poging
Instabiele tests
Correcte tests
Responstijd (gem.)
Invoer-tokens
Uitvoer-tokens
Redeneer-tokens
Claude Opus 4.7Gearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
8.3Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
75.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)2.12sResponstijd (max)3.75sResponstijd (totaal)8.50sEen test is alleen volledig geslaagd als alle runs slagen.…
2.12sResponstijd (gem.)…
894Totaal aantal invoer-tokens…
522Uitvoer-tokens…
0Redeneer-tokens…
Hy3 previewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
6.4Gemiddelde score over alle benchmarktests.…
7.9Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
58.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
1Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 2Responstijd (gem.)15.12sResponstijd (max)19.99sResponstijd (totaal)45.37sEen test is alleen volledig geslaagd als alle runs slagen.…
15.12sResponstijd (gem.)…
373Totaal aantal invoer-tokens…
6,839Uitvoer-tokens…
0Redeneer-tokens…
Programmeren
Score
Consistentie
Slaagpercentage per poging
Instabiele tests
Correcte tests
Responstijd (gem.)
Invoer-tokens
Uitvoer-tokens
Redeneer-tokens
Claude Opus 4.7Gearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.3Gemiddelde score over alle benchmarktests.…
3.3Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)2.84sResponstijd (max)2.84sResponstijd (totaal)2.84sEen test is alleen volledig geslaagd als alle runs slagen.…
2.84sResponstijd (gem.)…
1,176Totaal aantal invoer-tokens…
494Uitvoer-tokens…
0Redeneer-tokens…
Hy3 previewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
5.3Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 2Responstijd (gem.)99.76sResponstijd (max)99.76sResponstijd (totaal)99.76sEen test is alleen volledig geslaagd als alle runs slagen.…
99.76sResponstijd (gem.)…
741Totaal aantal invoer-tokens…
38,167Uitvoer-tokens…
0Redeneer-tokens…
Gecombineerd
Score
Consistentie
Slaagpercentage per poging
Instabiele tests
Correcte tests
Responstijd (gem.)
Invoer-tokens
Uitvoer-tokens
Redeneer-tokens
Claude Opus 4.7Gearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
9.5Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)18.27sResponstijd (max)18.27sResponstijd (totaal)18.27sEen test is alleen volledig geslaagd als alle runs slagen.…
18.27sResponstijd (gem.)…
37,740Totaal aantal invoer-tokens…
3,504Uitvoer-tokens…
0Redeneer-tokens…
Hy3 previewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)113.09sResponstijd (max)113.09sResponstijd (totaal)113.09sEen test is alleen volledig geslaagd als alle runs slagen.…
113.09sResponstijd (gem.)…
13,119Totaal aantal invoer-tokens…
31,319Uitvoer-tokens…
0Redeneer-tokens…
Gegevensparsering en extractie
Score
Consistentie
Slaagpercentage per poging
Instabiele tests
Correcte tests
Responstijd (gem.)
Invoer-tokens
Uitvoer-tokens
Redeneer-tokens
Claude Opus 4.7Gearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)2.15sResponstijd (max)2.33sResponstijd (totaal)4.29sEen test is alleen volledig geslaagd als alle runs slagen.…
2.15sResponstijd (gem.)…
10,533Totaal aantal invoer-tokens…
324Uitvoer-tokens…
0Redeneer-tokens…
Hy3 previewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
6.5Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
50.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)12.11sResponstijd (max)12.11sResponstijd (totaal)12.11sEen test is alleen volledig geslaagd als alle runs slagen.…
12.11sResponstijd (gem.)…
2,316Totaal aantal invoer-tokens…
4,323Uitvoer-tokens…
0Redeneer-tokens…
Domeinspecifiek
Score
Consistentie
Slaagpercentage per poging
Instabiele tests
Correcte tests
Responstijd (gem.)
Invoer-tokens
Uitvoer-tokens
Redeneer-tokens
Claude Opus 4.7Gearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
7.7Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)1.19sResponstijd (max)1.40sResponstijd (totaal)3.58sEen test is alleen volledig geslaagd als alle runs slagen.…
1.19sResponstijd (gem.)…
1,020Totaal aantal invoer-tokens…
78Uitvoer-tokens…
0Redeneer-tokens…
Hy3 previewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
5.3Gemiddelde score over alle benchmarktests.…
7.2Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
44.4%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
1Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Responstijd (gem.)109.04sResponstijd (max)149.94sResponstijd (totaal)327.11sEen test is alleen volledig geslaagd als alle runs slagen.…
109.04sResponstijd (gem.)…
747Totaal aantal invoer-tokens…
87,559Uitvoer-tokens…
0Redeneer-tokens…
Algemene intelligentie
Score
Consistentie
Slaagpercentage per poging
Instabiele tests
Correcte tests
Responstijd (gem.)
Invoer-tokens
Uitvoer-tokens
Redeneer-tokens
Claude Opus 4.7Gearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)3.47sResponstijd (max)3.47sResponstijd (totaal)3.47sEen test is alleen volledig geslaagd als alle runs slagen.…
3.47sResponstijd (gem.)…
723Totaal aantal invoer-tokens…
257Uitvoer-tokens…
0Redeneer-tokens…
Hy3 previewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)0msResponstijd (max)0msResponstijd (totaal)0msEen test is alleen volledig geslaagd als alle runs slagen.…
0msResponstijd (gem.)…
0Totaal aantal invoer-tokens…
0Uitvoer-tokens…
0Redeneer-tokens…
Instructies opvolgen
Score
Consistentie
Slaagpercentage per poging
Instabiele tests
Correcte tests
Responstijd (gem.)
Invoer-tokens
Uitvoer-tokens
Redeneer-tokens
Claude Opus 4.7Gearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)1.46sResponstijd (max)1.68sResponstijd (totaal)2.91sEen test is alleen volledig geslaagd als alle runs slagen.…
1.46sResponstijd (gem.)…
939Totaal aantal invoer-tokens…
114Uitvoer-tokens…
0Redeneer-tokens…
Hy3 previewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)34.36sResponstijd (max)41.83sResponstijd (totaal)68.73sEen test is alleen volledig geslaagd als alle runs slagen.…
34.36sResponstijd (gem.)…
675Totaal aantal invoer-tokens…
13,483Uitvoer-tokens…
0Redeneer-tokens…
Puzzeloplossing
Score
Consistentie
Slaagpercentage per poging
Instabiele tests
Correcte tests
Responstijd (gem.)
Invoer-tokens
Uitvoer-tokens
Redeneer-tokens
Claude Opus 4.7Gearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)2.46sResponstijd (max)3.72sResponstijd (totaal)7.38sEen test is alleen volledig geslaagd als alle runs slagen.…
2.46sResponstijd (gem.)…
939Totaal aantal invoer-tokens…
597Uitvoer-tokens…
0Redeneer-tokens…
Hy3 previewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
7.7Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)27.94sResponstijd (max)45.06sResponstijd (totaal)55.89sEen test is alleen volledig geslaagd als alle runs slagen.…
27.94sResponstijd (gem.)…
390Totaal aantal invoer-tokens…
15,567Uitvoer-tokens…
0Redeneer-tokens…
Toolaanroepen
Score
Consistentie
Slaagpercentage per poging
Instabiele tests
Correcte tests
Responstijd (gem.)
Invoer-tokens
Uitvoer-tokens
Redeneer-tokens
Claude Opus 4.7Gearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)4.74sResponstijd (max)4.74sResponstijd (totaal)4.74sEen test is alleen volledig geslaagd als alle runs slagen.…
4.74sResponstijd (gem.)…
15,339Totaal aantal invoer-tokens…
372Uitvoer-tokens…
0Redeneer-tokens…
Hy3 previewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)78.83sResponstijd (max)78.83sResponstijd (totaal)78.83sEen test is alleen volledig geslaagd als alle runs slagen.…
78.83sResponstijd (gem.)…
7,410Totaal aantal invoer-tokens…
10,370Uitvoer-tokens…
0Redeneer-tokens…
Algemene kennis
Score
Consistentie
Slaagpercentage per poging
Instabiele tests
Correcte tests
Responstijd (gem.)
Invoer-tokens
Uitvoer-tokens
Redeneer-tokens
Claude Opus 4.7Gearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)1.46sResponstijd (max)1.46sResponstijd (totaal)1.46sEen test is alleen volledig geslaagd als alle runs slagen.…
1.46sResponstijd (gem.)…
273Totaal aantal invoer-tokens…
3Uitvoer-tokens…
0Redeneer-tokens…
Hy3 previewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)47.71sResponstijd (max)47.71sResponstijd (totaal)47.71sEen test is alleen volledig geslaagd als alle runs slagen.…