OpenAI показала, где в GPT-5.6 деньги улетают зря: гайд для сборщиков.
Мы выделили ключевые цифры из гайда OpenAI по GPT-5.6.
Экономия на прогонах
На поисковом бенчмарке BrowseComp младшая Luna набрала 84,04% против 84,36% у предыдущей GPT-5.5. При этом предыдущая модель потратила на прогон 33,27 доллара, а Luna обошлась в 1,33 доллара.
Настройки вместо смены модели
Второй момент касается не модели, а настроек. С сохранением рассуждений и сжатием контекста Sol на ARC-AGI-3 вырос с 13,3% до 38,3% и потратил в шесть раз меньше выходных токенов.
Распределение задач
В гайде разобрано, какой тир под какие задачи подходит:
- Sol для сложных задач;
- Terra как рабочая лошадь;
- Luna для потока.
Материал читается примерно за десять минут.

