Spark-X2.5-4B: компактная 4B-модель с нативным контекстом до 1 млн токенов.
Spark-X2.5-4B: компактная 4B-модель с нативным контекстом до 1 млн токенов.
Модель ориентирована на локальный запуск и при небольшом размере поддерживает reasoning, coding, tool use и agentic workflows. Заявлена поддержка более 200 языков.
Заявленные результаты
- 44.4: SWE-Bench Pro
- 40.9: BrowseComp
- 90.7: AIME 2026
- 54.6: MCP-Atlas
Для локального запуска уже доступны BF16, INT8, GGUF-кванты от Q2 до Q8/IQ, MLX 4/8-bit и ONNX. Есть варианты для Apple Silicon, Linux CPU и NVIDIA GPU.
В актуальном llama.cpp появилась поддержка архитектуры spark2_5, поэтому GGUF можно запускать через совместимые актуальные runtime. Полный контекст в 1 млн токенов потребует намного больше памяти, чем обычный локальный сценарий.

