Cursor доказал: 90% кодинга могут выполнять дешёвые модели, если архитектуру продумывает дорогая?
Многоуровневый подход: как Cursor оптимизировал затраты на кодинг
Специалисты Cursor провели наглядный эксперимент, демонстрирующий неэффективность использования мощных моделей для всех этапов разработки без разбора.
Задача: с нуля переписать SQLite на Rust, опираясь исключительно на документацию, без доступа к исходникам, интернету и тестам. Проверкой служили миллионы SQL-запросов.
Рецепт, который сработал: дорогая модель-планировщик (Opus 4.8 или Fable 5) разбивает задачу и принимает ключевые решения, а всю рутину пишет дешёвый «работник», Composer 2.5. Планировщик снимает неопределённость, после чего код генерируют копеечные модели. На исполнителей ушло от 69 до 90 процентов всех токенов.
Результаты, отрезвляющие для поставщиков передовых моделей:
- Связка Opus + Composer обошлась в $1 339, качество при этом осталось на высоком уровне.
- GPT-5.5 в одиночку справилась за $10 565, что оказалось в 15 раз дороже за аналогичную работу.
- Количество конфликтов слияния сократилось с 70 000+ до менее чем 1 000.
Практический вывод: мы не советуем платить фронтир-ценой за каждый этап. Дорогая модель нужна для планирования и создания архитектуры, а всё остальное сделает «рой» из доступных решений. Интеллект решает задачу, но цена токена имеет не меньшее значение.
Подробнее об исследовании можно почитать в источнике на The Decoder.

