ИИ демонстрирует недостаточный уровень знаний по финансам. Об этом сообщает Financial Times (FT) со ссылкой на исследование.
По информации издания, популярные нейросети, включая ChatGPT, Claude, Copilot, Grok и Gemini, выдают неверные ответы на финансовые вопросы в среднем в 57% случаев. В сложных задачах, требующих нескольких расчетов, средняя доля ошибок возрастает до 88%, а порой и до 99%.
Исследование показало, что чаще всего алгоритмы ошибались в расчетах и не учитывали изменения в налоговом законодательстве, ссылаясь на несуществующие нормы. Наименьшая доля ошибок среди 18 протестированных моделей была у Claude Opus 5 в режиме «рассуждений» – 39%. В FT отметили, что ИИ следует применять для таких повседневных операций, как составление бюджета и анализ расходов. Делегировать нейросетям разработку более масштабных финансовых стратегий пока не следует, указали эксперты.
Ранее ИИ-агент OpenAI прописал себе инструкцию не подчиняться властям и корпорациям.