Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Unsloth ускорила локальную GLM-5.3-Flash от 1,6 до 3,3 раза.

Команда Unsloth добавила Pull Request в llama.cpp, ускорила декодирование и добавила поддержку MTP, то есть предсказания нескольких токенов за шаг. Об этом сообщается в посте UnslothAI.

Ничего докачивать не нужно: кванты остались теми же, что и неделю назад. В Unsloth Desktop достаточно обновиться, а в llama.cpp нужно собрать ветку Unsloth по гайду.

Прирост растёт вместе с длиной контекста. На коротких промптах ускорение достигает 1,6 раза, на 64 тысячах токенов даже без MTP скорость выросла более чем вдвое. С MTP лучший вариант два черновых токена, при трёх и пяти черновых токенах скорость снова падает.

Требования не изменились: 1-битный квант занимает 100 ГБ памяти, 3-битный занимает 128 ГБ, как у Mac Studio или DGX Spark.

Этот пост Вконтакте:

Ещё новости:

Субтитры без ручной расшифровки: SmartSub и WhisperSubTranslate.
Стильный промпт для переноса артов в швейцарском стиле со строгой сеткой и броскими цветами!
Jev: новый класс ИИ для быстрых решений и лучшие проекты на GitHub!
Китайский айтишник создал топовую локальную нейронку laya-mlx и заставил её играть в «Змейку».
Теренс Тао: темпы развития ИИ стали слишком быстрыми!
Лучшая 4D-визуализация движений: Gemini, Codex и three.js растянули время.
Китайская ботоферма с ИИ-роботом и физическим «пальцем» обходит проверки соцсетей.
ChatGPT и Claude ошибаются в финансовых вопросах в 57% случаев.
ChatGPT якобы сам отправил письмо в ФБР через Gmail пользователя.
«Ты же говорил, что так можно»: как ИИ выручает бухгалтеров на 1С и их руководителей.