Сегодня 20 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Популярные чат-боты в большинстве случаев дают вредные советы в сфере финансов

Склонность доверять ответам ИИ может дорого обойтись пользователям популярных чат-ботов, как показывает новое исследование, если речь идёт о рекомендациях в финансовой сфере. По его данным, ChatGPT, Claude, Copilot, Grok и Gemini дают ошибочные ответы на финансовые запросы в среднем в 57 % случаев. Если следовать их рекомендациям, в итоге можно потерять деньги.

 Источник изображения: Anthropic

Источник изображения: Anthropic

Во всяком случае, это утверждают авторы исследования Saturn, на которых ссылается Financial Times. Более того, если речь идёт о более сложных вопросах, которые подразумевают более одного арифметического действия, популярные ИИ-модели в среднем допускают ошибки в 88 % случаев, а в некоторых ситуациях показатель достигает 99 %.

Авторы исследования задавали 18 различным популярным ИИ-моделям — как в бесплатной версии, так и по подписке, более 100 различных вопросов, связанных с распоряжением деньгами. Вопросы повторялись до пяти раз, в общей сложности ИИ-моделями ChatGPT, Gemini, Claude и Copilot было обработано более 10 000 запросов. Представители Saturn выявили не только банальные ошибки в арифметических вычислениях, но и «галлюцинации» в области финансовых правил и законов, а также отсутствие должного учёта грядущих изменений в налоговом законодательстве. Как считают эксперты, полагаясь на ошибочные рекомендации ИИ-моделей в налоговой сфере, пользователи рискуют потерять существенные суммы денег.

Например, бесплатная модель Claude Haiku 4.5 создала ситуацию, при которой последовавшему её рекомендациям в сфере пенсионного обеспечения гражданину Великобритании грозил бы штраф на сумму 17 500 фунтов стерлингов. В другом случае ИИ-модель сама «изобрела» правило, согласно которому переехавший за границу выпускник вуза якобы получает право прекратить выплаты по студенческой ссуде на образование. При этом следует отметить, что платные ИИ-модели давали более точные ответы в сфере финансов, а новые версии оказывались точнее предыдущих. Лучшие показатели продемонстрировала Claude Opus 5, которая в режиме рассуждений допускала 39 % ошибок.

Финансовым консультантам, как отмечают представители платформы AJ Bell, приходится вмешиваться в действия клиентов, которые руководствуются рекомендациями ИИ и совершают необдуманные операции. Впрочем, эксперты параллельно отмечают, что искусственный интеллект неплохо справляется с анализом расходов и доходов пользователей и составлением рекомендаций по оптимизации бюджета. Опросы общественного мнения в Великобритании показали, что один из пяти взрослых граждан страны склоняется к идее передачи ИИ полномочий по принятию серьёзных финансовых решений, касающихся вопросов пенсионного обеспечения, заимствований и инвестиций.

Молодые британцы также более склонны доверять рекомендациям ИИ в финансовой сфере, нежели чем профильным блогерам и телевизионным передачам. Две трети из них намереваются в течение следующего года воспользоваться ИИ для принятия соответствующих решений. В отличие от услуг живых финансовых консультантов, использование ИИ для подобных целей не позволит потерявшим деньги гражданам претендовать на материальную компенсацию. Эта сфера требует законодательного регулирования, как отмечают авторы исследования.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Популярные чат-боты в большинстве случаев дают вредные советы в сфере финансов 34 мин.
Новая статья: The Blood of Dawnwalker — начало чего-то выдающегося. Рецензия 8 ч.
Путь на дно: суд обязал Microsoft раскрыть внутренние документы и переписку топ-менеджеров в деле о перепродаже лицензий на ПО 14 ч.
Персональный ИИ-агент Muse от Meta возглавил рейтинг App Store всего через неделю после релиза 18 ч.
SpaceXAI удвоила точность распознавания речи в новой модели Grok Voice Transcribe 2.0 19 ч.
Anthropic сделала первый шаг к замедлению ИИ — Accenture будет проверять Claude изнутри 19 ч.
Европейские разработчики ИИ выступили против призывов США замедлить темп 21 ч.
Alibaba выпустила всеядную модель Qwen3.8-Omni-Flash с контекстом на 1 млн токенов 22 ч.
Anthropic до IPO собирается выпустить ИИ-модель, которая станет ответом на OpenAI GPT-6 Astra 24 ч.
Новая статья: Doloc Town — достойная наследница Stardew Valley. Рецензия 19-09 00:10
На следующей неделе Meta покажет AR-гарнитуру Phoenix и фотореалистичные голографические аватары для видеозвонков 2 ч.
Anthropic и OpenAI переключились на аренду небольших ИИ ЦОД 5 ч.
Урезанная Radeon RX 9050 с 4 Гбайт памяти оказалась в среднем на 37 % медленнее версии с 8 Гбайт 14 ч.
Исследователь OpenAI предупредил: ИИ-агенты способны общаться даже на отключённых от Сети компьютерах 15 ч.
Создана не имеющая аналогов плёночная теплоизоляция — она сдерживает тепло в пять раз лучше силикона 15 ч.
До 64 Пбайт для KV-кеша: Huawei представила платформу хранения OceanStor M900 для ИИ ЦОД 16 ч.
Samsung вновь вышла на первое место по продажам смартфонов благодаря флагманам 17 ч.
«Искусственные листья» научили добывать водород из грязной морской воды — для этого нужен только солнечный свет 19 ч.
HP представила ноутбук со 192 Гбайт памяти — 160 Гбайт можно отдать встроенной Radeon 19 ч.
Контракт на миллиард: NASA заказало ещё три пилотируемых миссии SpaceX Crew Dragon 22 ч.