Исследователи протестировали 18 моделей, задав им более 10 тысяч вопросов. Результаты показали, что даже платные и современные версии ИИ не гарантируют точности: в простых расчетах они ошибаются в 57% случаев, а при необходимости многоступенчатого анализа показатель провалов стремится к максимуму. Системы часто игнорируют актуальные налоговые нормы или попросту выдумывают правила, которых не существует в реальности.
Генеральный директор Saturn Амаль Джолли привел пример с моделью Claude Haiku 4.5, ошибка которой в расчете пенсионных отчислений могла стоить британскому вкладчику 17,5 тысячи фунтов стерлингов. В другом случае чат-бот придумал несуществующие льготы для погашения студенческих займов. Лучший результат продемонстрировала Claude Opus 5, однако даже ее 39% ошибок делают использование ИИ в качестве персонального финансового консультанта крайне рискованным занятием.




Комментарии (0)
Пока нет комментариев. Будьте первым!