Модель Sol оценивается в 2 доллара за миллион входных токенов, тогда как Luna обходится в 0,10 доллара. Экономический эффект усиливается за счет обновленного кэширования промптов: скидка достигает 90% и сохраняется даже при смене инструментов или уровня рассуждений. На бенчмарке AutomationBench модель Sol набрала 33,2%, обойдя Claude Opus 5, при этом стоимость выполнения задачи упала с 3 долларов до 27 центов.
В задачах по написанию кода на платформе DeepSWE v1.1 результат Sol составил 68,8%, что лишь на 1,1 процентного пункта ниже показателей Claude Fable 5.1. При этом затраты на использование Sol сократились на 80%. Инженеры OpenAI также добились снижения уровня фактических ошибок: у Sol этот показатель сократился вдвое по сравнению с предшественниками. Уровень ложных утверждений при написании кода упал до 0,5% у Sol и 1,3% у Luna.


Комментарии (0)
Пока нет комментариев. Будьте первым!