Sunday, September 20, 2026Moscow
Eurasian Information AgencyEurasian Information Agency
Technology

FT: ИИ-модели ошибаются в 99% случаев при сложных финансовых расчетах

Технологическая компания Saturn проанализировала, как наиболее распространенные модели искусственного интеллекта (ChatGPT, Claude, Copilot, Grok, Gemini и другие) справляются с решением финансовых задач. В ответах на усредненные вопросы они ошибались в 57% случаев, на более сложные — в 99%.

Published

Технологическая компания Saturn проанализировала, как наиболее распространенные модели искусственного интеллекта (ChatGPT, Claude, Copilot, Grok, Gemini и другие) справляются с решением финансовых задач. В ответах на усредненные вопросы они ошибались в 57% случаев, на более сложные — в 99%. Результаты исследования приводит газета Financial Times.

Исследователи тестировали ИИ-модели на списке из более чем 100 вопросов, связанных с финансами. Вопросы могли повторяться до пяти раз. Специалисты отмечают, что нейросети ошибались в вычислениях, игнорировали, например, предстоящие изменения в налоговом законодательстве или выдумывали нормы. Лучше всего чат-боты справились с составлением бюджета.

«Миллионы людей доверяют моделям искусственного интеллекта в вопросах финансов, но они получают неправильные ответы, из-за которых могут потерять свои деньги»,— считает исполнительный директор Saturn Амаль Джоли. Специалисты отмечают, что лучшей по результатам исследования оказалась модель Claude Opus 5 в режиме «рассуждений».

Source: Коммерсантъ

Share

More on This Story

TechnologyРоссийские пользователи сообщили о перебоях в работе App Store

Магазин приложений App Store перестал открываться у части пользователей в России. С начала суток сервис «Сбой.рф» зафиксировал 474 жалобы.

Коммерсантъ
ИИ-компании испугались нейросетей
TechnologyИИ-компании испугались нейросетей

Еще недавно руководители крупнейших ИИ-компаний взахлеб рассказывали, с какой невероятной скоростью их модели становятся все умнее. Теперь они наперебой уверяют, что эту скорость нужно немного сбавить. Глава Anthropic Дарио Амодеи опубликовал целое эссе с призывом к конкурентам притормозить развитие искусственного интеллекта. Его поддержали Сэм Альтман из OpenAI, основатель Tesla Илон Маск и глава Google DeepMind Демис Хассабис. А вот Марк Цукерберг и Дональд Трамп оказались против.

Ведомости
TechnologyНейросеть Gemini взломала сайты трех компаний через подбор пароля

Компания Google сообщила, что ее модель искусственного интеллекта Gemini взломала несколько систем, подобрав учетные данные для входа. О каких именно ресурсах идет речь, не уточняется, однако Google незамедлительно уведомила их владельцев о случившемся, пишет AFP.

Коммерсантъ
The EIA Briefing

Keep reading, every morning.

The stories that matter, chosen by our editors and in your inbox before 7 a.m. — every weekday.

No spam. Unsubscribe anytime.