Штучний інтелект майже завжди помиляється у фінансових питаннях ChatGPT, Claude, Copilot, Grok та Ge

100F | Crypto Club

100F | Crypto Club

@Crypto_Clab_100F

новини важливі події короткі апдейти аналітика 📩Питання | Співпраця @Your_Franklin24x7

22,499 subscribers
Open in Telegram
Штучний інтелект майже завжди помиляється у фінансових питаннях

ChatGPT, Claude, Copilot, Grok та Gemini в середньому давали неправильні відповіді в 57% випадків, а на складних питаннях з кількома обчисленнями помилялися вже в 88% випадків.

В експерименті було протестовано 18 моделей та задано їм понад 10 000 фінансових питань.

Моделі помилялися в розрахунках, не враховували зміни в податкових правилах і навіть посилалися на неіснуючі норми.

Найкращий результат серед протестованих моделей показала модель Claude Opus 5 у режимі міркувань (помилки в 39% випадків).
Open post in Telegram