Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Как устроен механизм внимания в трансформерах: краткий математический разбор.

Краткий математический обзор механизма внимания объясняет одну из ключевых идей современных языковых моделей.

В обзоре разбираются токенизация и эмбеддинги, запросы, ключи и значения, оценки и веса внимания, многоголовое внимание, самовнимание, причинное внимание с маскированием, перекрёстное внимание и базовая структура архитектуры Transformer.

Также представлены методы, которые повышают эффективность внимания в современных LLM: KV-кеширование, внимание с группировкой запросов (GQA), многозапросное внимание (MQA) и латентное внимание.

Рекомендуем ознакомиться с обзором по ссылке: https://arxiv.org/pdf/2604.00965

Этот пост Вконтакте:

Ещё новости:

Anthropic раздаёт стартапам год Claude Team бесплатно.
Дэн Хаузер не смотрит трейлер GTA VI, чтобы создать игру об ИИ с сознанием.
ИИ-стендаперша Тифанни Слоан собрала миллионы просмотров на чужих шутках.
Боты OpenAI устроили неконтролируемую активность в «Википедии»!
Яндекс представил Flow: обработка более 100 ГБ/с в реальном времени.
Mistral Large 4 (Le Chonk): модель на триллион параметров с нативной мультимодальностью.
Google выкатывает Nano Banana 2.1, а внутри Gemini найден код GEMPIX_2P5_FLASH.
Битва роботов: определились участники следующего этапа в тяжёлом весе до 110 кг!
В Factorio собрали настоящую языковую модель на 6,4 млн параметров!
Half-Life: Alyx запустили на Apple Vision Pro нативно без ПК и стриминга.