Investing.com02:52Федеральная резервная система США планирует дальнейшие повышения процентных ставокInvesting.com02:36Председатель ФРС Логан призывает к повышению ставок на 50 базисных пунктов и болееPhys.org00:40Новый метод генерации почти неразличимых фотонов для квантовой связиFast Company00:30Университет Вермонта исследует применение цифровых двойников в медицинеOilPrice23:40Китай приостанавливает экспорт топлива в октябре на фоне глобального дефицита дизеляFortune20:54Paramount и Warner Bros. завершили сделку на $111 миллиардов с обязательством выпускать 30 фильмов в годCarscoops20:30GM и LG Energy приближаются к производству новых батарейCryptoPotato19:59Evernorth получает одобрение акционеров для выхода на Nasdaq с XRPArs Technica19:28Искусственный интеллект Ataraxos одержал победу в игре StrategoOilPrice19:00Историческая сделка по сверхпроводникам приближает коммерческое использование термоядерного синтеза

vestka

ИИ показали низкую точность в решении финансовых задач, согласно исследованию

Технологическая компания Saturn провела исследование, в котором оценивались 18 моделей искусственного интеллекта на предмет их способности решать финансовые задачи. В среднем, чат-боты, такие как ChatGPT, Claude, Copilot, Grok и Gemini, давали неверные ответы на 57% запросов. На сложных задачах с несколькими расчетами эта доля ошибок возросла до 88%, а у некоторых моделей достигала 99%.

Лучшей моделью в исследовании оказалась Claude Opus 5, которая, несмотря на свои достижения, все равно ошибалась в 39% случаев. Исследователи протестировали модели на 121 вопросе, что дало более 10 000 ответов, что позволяет сделать вывод о значительных недостатках в способности ИИ решать сложные финансовые задачи.

Эти результаты подчеркивают важность критического подхода к использованию ИИ в финансовом секторе. Несмотря на прогресс в области искусственного интеллекта, его применение в сложных финансовых расчетах требует осторожности и дополнительной проверки, чтобы избежать серьезных ошибок.

Главное

  • Исследование охватило 18 моделей ИИ и 121 вопрос.
  • В среднем чат-боты ошибались в 57% случаев.
  • На сложных задачах доля ошибок возросла до 88%.

Упомянуто

Важное из дайджеста

Открыть полный дайджест →