Штучний інтелект майже завжди помиляється у фінансових питаннях
ChatGPT, Claude, Copilot, Grok та Gemini в середньому давали неправильні відповіді в 57% випадків, а на складних питаннях з кількома обчисленнями помилялися вже в 88% випадків.
В експерименті було протестовано 18 моделей та задано їм понад 10 000 фінансових питань.
Моделі помилялися в розрахунках, не враховували зміни в податкових правилах і навіть посилалися на неіснуючі норми.
Найкращий результат серед протестованих моделей показала модель Claude Opus 5 у режимі міркувань (помилки в 39% випадків).
Штучний інтелект майже завжди помиляється у фінансових питаннях ChatGPT, Claude, Copilot, Grok та Ge
100F | Crypto Club
@Crypto_Clab_100Fновини важливі події короткі апдейти аналітика 📩Питання | Співпраця @Your_Franklin24x7
22,499 subscribers
Open in Telegram 