dimanche 20 septembre 2026Moscou
Eurasian Information AgencyAgence d’information eurasienne
Technologie

FT: ИИ-модели ошибаются в 99% случаев при сложных финансовых расчетах

Технологическая компания Saturn проанализировала, как наиболее распространенные модели искусственного интеллекта (ChatGPT, Claude, Copilot, Grok, Gemini и другие) справляются с решением финансовых задач. В ответах на усредненные вопросы они ошибались в 57% случаев, на более сложные — в 99%.

Publié le

Технологическая компания Saturn проанализировала, как наиболее распространенные модели искусственного интеллекта (ChatGPT, Claude, Copilot, Grok, Gemini и другие) справляются с решением финансовых задач. В ответах на усредненные вопросы они ошибались в 57% случаев, на более сложные — в 99%. Результаты исследования приводит газета Financial Times.

Исследователи тестировали ИИ-модели на списке из более чем 100 вопросов, связанных с финансами. Вопросы могли повторяться до пяти раз. Специалисты отмечают, что нейросети ошибались в вычислениях, игнорировали, например, предстоящие изменения в налоговом законодательстве или выдумывали нормы. Лучше всего чат-боты справились с составлением бюджета.

«Миллионы людей доверяют моделям искусственного интеллекта в вопросах финансов, но они получают неправильные ответы, из-за которых могут потерять свои деньги»,— считает исполнительный директор Saturn Амаль Джоли. Специалисты отмечают, что лучшей по результатам исследования оказалась модель Claude Opus 5 в режиме «рассуждений».

Source : Коммерсантъ

Partager

Sur le même sujet

TechnologieРоссийские пользователи сообщили о перебоях в работе App Store

Магазин приложений App Store перестал открываться у части пользователей в России. С начала суток сервис «Сбой.рф» зафиксировал 474 жалобы.

Коммерсантъ
ИИ-компании испугались нейросетей
TechnologieИИ-компании испугались нейросетей

Еще недавно руководители крупнейших ИИ-компаний взахлеб рассказывали, с какой невероятной скоростью их модели становятся все умнее. Теперь они наперебой уверяют, что эту скорость нужно немного сбавить. Глава Anthropic Дарио Амодеи опубликовал целое эссе с призывом к конкурентам притормозить развитие искусственного интеллекта. Его поддержали Сэм Альтман из OpenAI, основатель Tesla Илон Маск и глава Google DeepMind Демис Хассабис. А вот Марк Цукерберг и Дональд Трамп оказались против.

Ведомости
TechnologieНейросеть Gemini взломала сайты трех компаний через подбор пароля

Компания Google сообщила, что ее модель искусственного интеллекта Gemini взломала несколько систем, подобрав учетные данные для входа. О каких именно ресурсах идет речь, не уточняется, однако Google незамедлительно уведомила их владельцев о случившемся, пишет AFP.

Коммерсантъ
Le Briefing EIA

Continuez à lire, chaque matin.

Les sujets qui comptent, choisis par notre rédaction et dans votre boîte mail avant 7 h — chaque jour de semaine.

Pas de spam. Désabonnement à tout moment.