Navigate the site or open source-checked model and benchmark registry records.
Navigate
Lumina Bench
News
Research
Independent rankings. Commercial relationships never affect scoring.
Anthropic · stable
Claude Opus 4 is a API model tracked via Artificial Analysis independent evaluations for capability comparison across coding, agents, and reasoning.
#60 · 60.1 score · Confidence D