Издание Financial Times со ссылкой на исследование технологической компании Saturn сообщает, что популярные ИИ-модели ChatGPT, Claude, Copilot, Grok и Gemini в среднем дают 57% неправильных ответов на финансовые вопросы. Если вопрос более сложный и требует проведения нескольких расчётов, количество ошибок растёт до 88%, а в худшем случае модели ошибаются в 99% случаев. Специалисты задали свыше 100 вопросов бесплатным и платным вариантам моделей, повторив каждый вопрос пять раз. В сумме 18 моделей получили более 10 000 вопросов. Изображение: Gemini Модели выдавали ошибки в расчётах, не принимали во внимание будущие изменения налогового законодательства или использовали нормы, которые в реальности не существуют. Использование подобных ответов людьми может привести к финансовым потерям. Платные модели давали более точные ответы по сравнению с бесплатными, а новые версии справлялись лучше старых. Лидером является модель Claude Opus 5 в режиме рассуждений, которая выдала ошибки в 39% случаев. Проведённое в 2026 году в России исследование показало, что 37% потребителей при покупках онлайн делают выбор без помощи искусственного интеллекта. 65% покупателей принимают во внимание рекомендации ИИ.
Источник новости: overclockers.ru

