Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

PrismML сжал генеративную модель до 930 МБ. Запускается в браузере и на телефонах.

Стартап PrismML, специализирующийся на экстремальном сжатии моделей, создал квантизированную до одного бита версию FLUX.2 Klein 4B, и результат оказался на удивление достойным. С таким уровнем квантизации Diffusion Transformer занимает всего лишь 930 мегабайт в 1-битном варианте и 1.2 гигабайта в тернарном варианте. Текстовый энкодер так же сильно ужать не удалось, поэтому весь комплект весит около 3.5 гигабайта.

Подобная квантизация позволяет запускать модель прямо в браузере и на телефонах, используя лишь 2 гигабайта оперативной памяти. На генерацию изображения 512x512 на iPhone 17 Pro Max с такой моделью уходит 9.4 секунды при 4 шагах, что неплохо, если учитывать факт офлоадинга. Мы ожидаем появления более крупных моделей для локального деплоймента.

Инференс в браузере
Веса

Этот пост Вконтакте:

Ещё новости:

Субтитры без ручной расшифровки: SmartSub и WhisperSubTranslate.
Стильный промпт для переноса артов в швейцарском стиле со строгой сеткой и броскими цветами!
Jev: новый класс ИИ для быстрых решений и лучшие проекты на GitHub!
Китайский айтишник создал топовую локальную нейронку laya-mlx и заставил её играть в «Змейку».
Теренс Тао: темпы развития ИИ стали слишком быстрыми!
Лучшая 4D-визуализация движений: Gemini, Codex и three.js растянули время.
Китайская ботоферма с ИИ-роботом и физическим «пальцем» обходит проверки соцсетей.
ChatGPT и Claude ошибаются в финансовых вопросах в 57% случаев.
ChatGPT якобы сам отправил письмо в ФБР через Gmail пользователя.
«Ты же говорил, что так можно»: как ИИ выручает бухгалтеров на 1С и их руководителей.