तुलना करें चार्ट Karyapranali

भाषा:

❤️ Made by XCS

AI BENCHY तुलना

Anthropic: Claude Opus 4.6 vs Trinity Large Preview

तुलना करें:

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-06

मेट्रिक	Anthropic: Claude Opus 4.6 medium रिलीज़: 2026-02-05	Trinity Large Preview none रिलीज़: 2026-01-27 निःशुल्क उपलब्ध
रैंक	#26	#45
औसत स्कोर	6.6	4.2
संगति	9.0	9.6
प्रति परिणाम लागत	13.118	0.000
कुल लागत	$1.312	$0.000
सही परीक्षण
प्रति प्रयास पास दर	66.7%	33.3%
अस्थिर टेस्ट	2	1
कुल रन	48	48
आउटपुट टोकन	26,254	1,837
रीजनिंग टोकन	17,363	0
प्रतिक्रिया समय (औसत)	22.86s	3.15s
प्रतिक्रिया समय (अधिकतम)	83.40s	8.91s
प्रतिक्रिया समय (कुल)	205.71s	50.46s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

औसत स्कोर vs प्रतिक्रिया समय (औसत)

श्रेणी विवरण

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Anthropic: Claude Opus 4.6	4.0	4.4	55.6%	2		11.88s	897	1,000
Trinity Large Preview	10.0	10.0	0.0%	0		3.59s	587	0

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Anthropic: Claude Opus 4.6	10.0	10.0	100.0%	0		76.66s	8,178	5,194
Trinity Large Preview	10.0	10.0	0.0%	0		8.91s	294	0

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Anthropic: Claude Opus 4.6	9.9	10.0	100.0%	0		7.37s	691	757
Trinity Large Preview	9.9	10.0	100.0%	0		3.26s	186	0

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Anthropic: Claude Opus 4.6	10.0	10.0	0.0%	0		83.40s	14,642	8,687
Trinity Large Preview	4.0	10.0	33.3%	0		877ms	25	0

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Anthropic: Claude Opus 4.6	10.0	10.0	100.0%	0		5.04s	188	292
Trinity Large Preview	3.0	9.9	0.0%	0		2.86s	124	0

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Anthropic: Claude Opus 4.6	10.0	10.0	100.0%	0		2.43s	266	467
Trinity Large Preview	3.5	6.7	16.7%	1		1.09s	63	0

Puzzle Solving	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Anthropic: Claude Opus 4.6	7.0	10.0	66.7%	0		4.60s	531	637
Trinity Large Preview	4.0	10.0	33.3%	0		3.30s	291	0

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Anthropic: Claude Opus 4.6	10.0	10.0	100.0%	0		9.73s	861	329
Trinity Large Preview	10.0	10.0	100.0%	0		6.67s	267	0

त्वरित तुलना

तुलना जोड़ी बदलें

Claude Opus 4.6mediumvsQwen3.5 Plus 2026-02-15none Trinity Large Previewnoneनिःशुल्क उपलब्धvsMiniMax M2.5medium Claude Opus 4.6mediumvsGemini 3.1 Flash Lite Previewnone Claude Opus 4.6mediumvsGLM 5none Claude Opus 4.6mediumvsGemini 3 Flash Previewnone Trinity Large Previewnoneनिःशुल्क उपलब्धvsQwen3 Coder Nextmedium Claude Opus 4.6mediumvsGPT-5.3 Chatnone Claude Opus 4.6mediumvsGemini 3.1 Flash Lite Previewlow Claude Opus 4.6mediumvsGPT-5.2 Chatnone Trinity Large Previewnoneनिःशुल्क उपलब्धvsgpt-oss-120bmediumनिःशुल्क उपलब्ध Claude Opus 4.6mediumvsDeepSeek V3.2none Trinity Large Previewnoneनिःशुल्क उपलब्धvsMercury 2medium