**ШІ помилився у 88% складних фінансових питань, —** дослідження

Компанія Saturn [перевірила](https://incrypted.com/yssledovanye-pokazalo-kak-chasto-yy-oshybaetsya-v-fynansovykh-sovetakh/) 18 моделей ChatGPT, Claude, Copilot, Grok та Gemini на понад 10 000 запитів. У середньому відповіді були неправильними у **57%** випадків, а у завданнях із кількома розрахунками — у **88%.**

Чат-боти **плуталися** в обчисленнях, **ігнорували** зміни податкових правил і **вигадували** власні. В одному з тестів помилка Claude могла коштувати пенсійному вкладнику **£17500.**

Платні моделі справлялися краще за безкоштовні, але навіть найкращий результат у складних завданнях — **39%** помилкових відповідей.

[Бізнес Інсайдер](https://t.me/+9AGiQNdKiL0yYmEy)