Стоимость задачи у разных моделей сильно разнится: например, у Sonnet 5.5 она составляет $7,67, а у GPT-6 Luna — $0,07.
Сводный индекс Artificial Analysis усредняет результаты по десяти тестам. В других тестах, например Terminal-Bench 4.0, Sonnet 5.5 показала результат 70,6 %, а Opus 5.5 — 66,4 %. Сравнивать модели следует только на одном и том же уровне рассуждения, так как на разных уровнях их результаты и цена могут отличаться в разы.