**Штучний інтелект майже завжди помиляється у фінансових питаннях**

ChatGPT, Claude, Copilot, Grok та Gemini в середньому давали неправильні відповіді в 57% випадків, а на складних питаннях з кількома обчисленнями помилялися вже в 88% випадків.

В експерименті було протестовано 18 моделей та задано їм понад 10 000 фінансових питань.

Моделі помилялися в розрахунках, не враховували зміни в податкових правилах і навіть посилалися на неіснуючі норми.

Найкращий результат серед протестованих моделей показала модель Claude Opus 5 у режимі міркувань (помилки в 39% випадків).