ИИ всё чаще используют для финансовых советов, но ошибки могут дорого обойтись.
Исследование Saturn показало: популярные модели вроде ChatGPT, Claude, Copilot, Grok и Gemini ошибались в 57% финансовых запросов. В сложных задачах с несколькими расчётами доля ошибок доходила до 88%, а у некоторых моделей — до 99%.
Всего исследователи протестировали 18 моделей и задали им более 10 тысяч вопросов. ИИ ошибался в расчётах, придумывал налоговые правила и не учитывал изменения законодательства.
В одном из примеров ошибка Claude могла обернуться для британского вкладчика дополнительным налогом в £17,5 тыс.
SCAM LIST - подписаться
Исследование Saturn показало: популярные модели вроде ChatGPT, Claude, Copilot, Grok и Gemini ошибались в 57% финансовых запросов. В сложных задачах с несколькими расчётами доля ошибок доходила до 88%, а у некоторых моделей — до 99%.
Всего исследователи протестировали 18 моделей и задали им более 10 тысяч вопросов. ИИ ошибался в расчётах, придумывал налоговые правила и не учитывал изменения законодательства.
В одном из примеров ошибка Claude могла обернуться для британского вкладчика дополнительным налогом в £17,5 тыс.
SCAM LIST - подписаться