Navigate the site or open source-checked model and benchmark registry records.
Navigate
Lumina Bench
News
Research
Independent rankings. Commercial relationships never affect scoring.
OpenAI · stable
OpenAI's API model optimized for agentic coding tasks in Codex and similar environments.
#37 · 64.4 score · Confidence B