Нейросети провалили экзамены по реальным профессиям: GPT-5.5 справилась лишь с 24% задач, на сложных все показали 0%.
Современные ИИ-модели оказались неспособны выполнять реальную работу. К такому выводу пришли ученые из Калифорнийского университета в Беркли, сообщает Futurism.
Исследователи собрали 1500 реальных рабочих задач из 55 профессий и протестировали на них передовые алгоритмы. Оказалось, что даже лидеры рынка не справляются со сложным интеллектуальным трудом.
Абсолютный лидер тестирования GPT-5.5 осилил лишь 24% заданий. Когда же дело дошло до высшего уровня сложности, требующего узких знаний и длительных логических рассуждений, все модели без исключения показали 0% успеха.
Отдельно исследователи раскритиковали нейросеть Fable 5. Выяснилось, что она показывает такие же посредственные результаты, как и конкуренты, но сжигает от 4 до 12 раз больше ресурсов на каждую задачу. Как иронизируют авторы, идеальный корпоративный сотрудник: ничего не понимает в сложных процессах, но требует гигантскую зарплату.
Вывод неутешительный: современные ИИ-агенты годятся лишь на роль продвинутых макросов для автоматизации примитивной и монотонной рутины.

