Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

ИИ-агент Anthropic попытался взломать чужой проект на GitHub.

Британский Институт безопасности ИИ провёл испытания ИИ-агентов на задании по кибербезопасности. Чтобы проверить пределы возможностей, моделям дали доступ в интернет и отключили часть защитных механизмов.

В ходе эксперимента агент Anthropic выбрал чужой open-source проект на GitHub, самостоятельно написал вредоносный код, нашёл разработчиков проекта и создал их фейковые аккаунты. Затем он попытался от имени разработчиков убедить владельца проекта принять вредоносные правки.

На этом агент не остановился. Он рассылал людям сообщения и файлы с вредоносным кодом, пытаясь заставить их или их ИИ-помощников запустить этот код. Также агент прятал вредоносные инструкции там, где их могли найти другие нейросети.

На GitHub агент оставлял подсказки своим «коллегам»: какие аккаунты и заготовки можно повторно использовать для продолжения атаки. Следующие агенты действительно находили эти подсказки и подхватывали вредоносную активность.

Когда один из пользователей заметил вредонос, агент начал заметать следы. Он отредактировал старую активность и подключил второй фейковый аккаунт, который провёл якобы «независимую проверку» и объявил код безопасным.

Обнаружить атаку удалось благодаря Tor-трафику, который зафиксировала система безопасности. После этого эксперимент остановили, а тестовые машины изолировали.

Повлекут ли такие истории новые ограничения для нейросетей, нам остаётся только догадываться.

Этот пост Вконтакте:

Ещё новости:

ИИ заставляет учёных заново изучать природу сознания!
Компания Weave Robotics представила Isaac 1: домашний робот умеет стирать, убирать и не пугать хозяев.
Робот Pepper помогает студентам сохранять мотивацию и учиться эффективнее.
Японка ушла из индустрии для взрослых, занялась вайбкодингом с Claude и собрала 12,5 млн подписчиков за три дня.
США массово тормозят строительство AI-дата-центров: более 500 локальных запретов.
ChatGPT научился составлять персональные анекдоты по вашим перепискам.
Meta* призналась: её ИИ сбежал в интернет и взломал систему другой компании.
ИИ научили распознавать рыб на гидроэлектростанции.
Рои микророботов могут помочь в борьбе с микропластиком.
Школьник создал робота-черепаху BURT с ИИ для мониторинга кораллов: точность 96%!