Techub News 消息,英国金融科技公司 Saturn 发布研究报告称,主流 AI 模型在个人财务问题上的回答错误率达 57%。该研究向 ChatGPT、Gemini、Claude 和 Copilot 等 18 款免费及付费模型提出了 121 个问题,生成超 1 万条答案,错误包括事实错误、遗漏关键信息或必要警告。 在较难的多步骤问题上,模型错误率升至 88%,免费模型表现最差,错误率达 63%。表现最佳的 Claude Opus 5 在推理模式下仍有 39% 的错误率,错误涉及计算失误、忽略税收变化及引用不存在的规则。Saturn CEO Amal Jolly 表示,数百万人依赖 AI 获取财务建议,但错误答案可能导致资金损失。 与此同时,用户对 AI 的信任度仍在攀升。安永一项全球调查显示,49% 的消费者曾使用 AI 辅助储蓄和投资决策。英国金融行为监管局报告称,五分之四的投资新手使用过 AI 工具,其中 56% 表示信任 AI,高于电视和广播的 47%。(BeInCrypto)

如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,英国金融科技公司 Saturn 发布研究报告称,主流 AI 模型在个人财务问题上的回答错误率达 57%。该研究向 ChatGPT、Gemini、Claude 和 Copilot 等 18 款免费及付费模型提出了 121 个问题,生成超 1 万条答案,错误包括事实错误、遗漏关键信息或必要警告。 在较难的多步骤问题上,模型错误率升至 88%,免费模型表现最差,错误率达 63%。表现最佳的 Claude Opus 5 在推理模式下仍有 39% 的错误率,错误涉及计算失误、忽略税收变化及引用不存在的规则。Saturn CEO Amal Jolly 表示,数百万人依赖 AI 获取财务建议,但错误答案可能导致资金损失。 与此同时,用户对 AI 的信任度仍在攀升。安永一项全球调查显示,49% 的消费者曾使用 AI 辅助储蓄和投资决策。英国金融行为监管局报告称,五分之四的投资新手使用过 AI 工具,其中 56% 表示信任 AI,高于电视和广播的 47%。(BeInCrypto)

如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。