OpenAI o3 reasoning model sets new coding benchmark scores
OpenAI's o3 reasoning model achieves 87.5 percent on ARC-AGI-2 and 92 percent on SWE-bench Verified, marking a significant step toward general-purpose code synthesis.
By Tech & Ideas Desk • 8 min read
