Популярные модели от ChatGPT, Claude, Copilot, Grok и Gemini в среднем давали неверные ответы на денежные вопросы в 57% случаев. А при сложных расчетах ошибались в 88%, некоторые модели врали в 99%.
Ученые задали больше 10 тыс. вопросов 18 разным ИИ-агентам. Спрашивали про налоги, пенсии, студенческие займы. Модели путались в расчетах, игнорировали изменения в налоговом законодательстве или выдумывали нормы.
🔴 Одна ошибка Claude в правилах налогообложения пенсий могла обернуться для британского вкладчика дополнительным сбором в £17,5 тыс. ( почти ₽2 млн. );
🔴 В другом случае модель "изобрела правило" и заявила, что выпускник может прекратить выплаты по студенческому займу при переезде за границу.
Эксперты отмечают, что для бюджета и исследований чат-боты еще годятся, а вот финансовые консультации ИИ пока никак не регулируются.
Пользуетесь нейросетями?
👍 — да, но все перепроверяю!
👎 — нет, не доверяю роботам...
⭐️ Подписаться на Zvezdanews
📬 Zvezdanews в MAX
