ChatGPT и Claude ошибаются в финансовых вопросах в 57% случаев.
Популярные модели ИИ, такие как ChatGPT и Claude, дают неверные финансовые ответы в среднем в 57% случаев, а на сложных вопросах ошибки достигают от 88 до 99%.
В тесте из более чем 10 тысяч вопросов алгоритмы допускали ошибки в расчетах и ссылались на несуществующие нормы, что может привести к серьезным последствиям.
Лучший результат показала модель Claude Opus 5 в режиме «рассуждений» с 39% ошибок.

