Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Claude Mythos 5.1 достигла 98% успешности в создании рабочих эксплойтов.

Мы обратили внимание на свежие результаты Claude Mythos 5.1: модель резко усилилась в создании рабочих эксплойтов. В тестах Firefox с отключёнными защитными ограничениями она собрала полностью рабочие эксплойты в 245 случаях из 250, то есть показала 98% успешности.

Для сравнения: предыдущая флагманская модель полгода назад показывала около 52%.

Самое интересное здесь не поиск уязвимостей. Способность находить сами баги выросла совсем немного. Резкий скачок произошёл на следующем этапе: когда уязвимость уже известна и её нужно превратить в рабочий exploit.

Иными словами, прогресс идёт не столько в discovery, сколько в weaponization: модель стала намного лучше превращать найденную ошибку в реально работающую цепочку атаки.

Источник: https://x.com/claudeai/status/2094848572143407483

Этот пост Вконтакте:

Ещё новости:

Субтитры без ручной расшифровки: SmartSub и WhisperSubTranslate.
Стильный промпт для переноса артов в швейцарском стиле со строгой сеткой и броскими цветами!
Jev: новый класс ИИ для быстрых решений и лучшие проекты на GitHub!
Китайский айтишник создал топовую локальную нейронку laya-mlx и заставил её играть в «Змейку».
Теренс Тао: темпы развития ИИ стали слишком быстрыми!
Лучшая 4D-визуализация движений: Gemini, Codex и three.js растянули время.
Китайская ботоферма с ИИ-роботом и физическим «пальцем» обходит проверки соцсетей.
ChatGPT и Claude ошибаются в финансовых вопросах в 57% случаев.
ChatGPT якобы сам отправил письмо в ФБР через Gmail пользователя.
«Ты же говорил, что так можно»: как ИИ выручает бухгалтеров на 1С и их руководителей.