Модель Mercury 2 генерирует текст по принципу диффузии, как Stable Diffusion.
В то время как классические модели от OpenAI и Anthropic генерируют текст последовательно, токен за токеном, модель Mercury 2 использует иной подход. Она начинает с «белого шума» и постепенно преобразует его в готовый текст, применяя тот же принцип, что и диффузионные модели для изображений, например Stable Diffusion, только для языка.
Благодаря этой архитектуре скорость генерации текста в Mercury 2 оказывается выше в 5–7 раз. В демонстрации модель за секунды сгенерировала правила игры в шахматы. Однако отмечается, что способность к сложным рассуждениям (reasoning) у неё пока слабее, чем у классических трансформеров.
Это не первая подобная разработка. Ещё в 2025 году Google демонстрировал экспериментальную diffusion-LLM. Широкого релиза тогда не последовало, вероятно, потому что качество текста оказалось приоритетнее скорости.
Сейчас в сообществе обсуждают перспективы такого подхода: станет ли он новым витком развития или же скорость без глубины понимания не имеет решающего значения.

