Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Горькая правда о Sonnet 5: скрытая наценка и потеря ума заставляют вернуться на Opus 4.8.

Пару недель назад, как только вышел Claude Sonnet 5, мы оперативно перевели на него несколько рабочих рутин. Обещали красиво: лучше, быстрее и почти такой же умный, как Opus, только дешевле. Прошло две недели, и мы возвращаем модель обратно. Разобрались в цифрах, и картина оказалась ровно противоположной обещанной.

  1. Скрытая наценка ~30% через токенайзер.
    Вместе с Opus 4.7 Anthropic сменила токенайзер: тот же текст теперь дробится на до 35% больше токенов, это признаёт даже документация самой Anthropic. Ставка за токен «не менялась», но платить приходится за количество. С Opus 4.7 это уже проходили: у людей счёт вырос на 27%, хотя на странице цен ничего не поменялось. The Decoder называет это паттерном скрытого повышения цен.
  2. Дороже за реальную задачу.
    Независимый замер Artificial Analysis: полный прогон Intelligence Index обошёлся в $2.29 за задачу на Sonnet 5 против $1.97 на Opus 4.8. «Дешёвая» модель по факту вышла дороже флагмана, потому что потребляет ~40% больше выходных токенов и делает втрое больше шагов.
  3. Тупее на ровном месте.
    И это не за больший ум, а наоборот. Opus 4.8 сейчас первая модель мира на Intelligence Index (61.4), а Sonnet 5 набирает 53. На агентном кодинге SWE-bench Pro результат 69% против 63%. Для рутин это реально сорвавшиеся прогоны и лишние итерации.
  4. Если заставишь думать, сожрёт больше Opus.
    Поднимаешь effort, чтобы вытянуть качество, и Sonnet 5 по стоимости обгоняет Opus 4.8 при сопоставимом результате. А сам Opus 4.8 при этом стал ещё и экономнее: ту же работу делает на 15% меньшим числом шагов и с 35% меньшим числом токенов, чем 4.7.

Где Sonnet 5 хорош: простые задачи на низком усилии (суммаризация, классификация, извлечение) и период вводной цены ($2/$10 до 31 августа): там он реально дешевле. Но наши рутины — многошаговые агентные прогоны, где включаются и токенайзер, и мышление, и лишние итерации. Именно там математика разворачивается против него.

Вывод: премиальный ценник Opus 4.8 оказался дешевле в пересчёте на выполненную работу и умнее. Мораль: считайте стоимость по задаче, а не по ставке за токен. Именно на этой подмене построена вся «экономия».

Этот пост Вконтакте:

Ещё новости:

Вышел Skales: полезный ИИ-агент, который запустится даже на слабом ПК.
Эндрю Ын представил open source ИИ-агента OpenWorker.
Авито запустил флешмоб: что пользователи никогда не доверят ИИ?
Любую книгу можно превратить в навык для нейросети: вышел конвертер book-to-skill.
Anthropic научит Claude проектировать процессоры.
Higgsfield выложили 95-минутный ИИ-фильм Hell Grind со всеми промптами.
Cloudflare выдал ИИ-агентам кошельки и читаемые адреса для оплаты API и контента.
Бывший сотрудник Google запустил «AI-бота», который оказался обычным человеком.
Человек с помощью Claude написал Bluetooth-радар для поиска телефона.
Бабушкины сказки от нейросетей: родители бьют тревогу.