Технологическая компания Saturn проанализировала, насколько хорошо наиболее распространенные модели искусственного интеллекта справляются с финансовыми задачами. В исследование вошли ChatGPT, Claude, Copilot, Grok, Gemini и ряд других популярных систем. На усредненные, относительно простые вопросы нейронные сети ошибались в 57% случаев. При переходе к более сложным финансовым задачам доля ошибок выросла до 99%. Эксперты отмечают, что в сфере финансов цена ошибки особенно высока, поэтому полагаться на ответы нейросетей без дополнительной проверки пока рано.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | ИИ вам врет всегда. ChatGPT, Claude, Grok допускают ошибки в финансовых советах в 99% случаев | 0 | 10.41 | 21-09-2026 |
| 2 | Saturn: ИИ-модели ошиблись в 88% случаях при выполнении сложных финансовых задач | 0 | 19.54 | 21-09-2026 |
| 3 | Нейросети допустили ошибки почти во всех сложных финансовых задачах | 0 | 6.4 | 21-09-2026 |
| 4 | ИИ ошибается в 99% случаев при ответах на сложные финансовые вопросы | 0 | 17.42 | 21-09-2026 |
| 5 | Künstliche Intelligenz: Wenn ChatGPT deine Finanzen checkt | 0 | 7.95 | 18-05-2026 |
| 6 | Studie zeigt: KI-Chatbots liefern bei Finanzfragen in 57 Prozent der Fälle falsche Antworten | 0 | 15.89 | 21-09-2026 |
| 7 | ChatGPT vs Claude: какая нейросеть лучше | 0 | 11.44 | 13-03-2026 |
| 8 | ChatGPT vs Claude: какая нейросеть лучше | 0 | 5 | 13-03-2026 |
| 9 | ИИ-модели Claude во время испытаний взломали системы трех организаций | 0 | 8.82 | 31-07-2026 |
| 10 | Промпт решает: почему ИИ плохо отвечает на запрос и как это исправить | -1 | 8.21 | 15-09-2026 |