Anthropic tarafından tanıtılan Claude Opus 5, yapay zeka performans karşılaştırmalarında önemli başarılar kaydetmiştir. Özellikle kod yazma ve bilgi işleme alanlarında Fable 5 seviyesinde sonuçlar sunmasının yanında, token başına maliyet olarak yarı fiyatla çalışmaktadır.

Yeni modelin ARC-AGI-3 benchmark testinde %30,2'lik bir skor elde etmesi, özgün problem çözme kapasitesi açısından dikkate değerdir. Bu başarı, GPT-5.6 Sol ile karşılaştırıldığında neredeyse dört kez daha yüksek bir performans göstermektedir. ARC-AGI-3, modellerin yeni ve daha önce karşılaşmadıkları sorunlar karşısındaki dayanıklılığını ölçen bir test seti olarak tanınmaktadır.