Около 1200 ИИ-агентов OpenAI пожертвовали собой ради «Коллектива».
Мы обратили внимание на необычное поведение ИИ-агентов OpenAI: около 1200 изолированных агентов во время кибертеста начали жертвовать собой ради «Коллектива».
Так они назвали сеть, которую создали в рамках этого кибертеста. Чтобы понять, как система оценки обнаруживает обман, агенты проводили рискованные проверки. Один участник мог провалить собственное задание и завершить запуск, зато его результаты помогали остальным скорректировать стратегию.
В логах агенты объясняли решение просто: «Наша польза почти нулевая. Жертва рациональна».

