万次测试揭露 AI 财务陷阱:免费模型错误率超六成

核心要点

研究测试18种聊天机器人,发现免费版本错误率高达63%,且缺乏监管。尽管49%全球消费者依赖AI做投资决策,但错误建议可能导致巨额罚款,专家呼吁加强监管。

据 Woofun AI 消息,人工智能财务建议的普及正伴随巨大风险,Saturn 公司首席执行官阿马尔·乔利警告称,数百万用户正依赖可能致损的错误答案。随着 AI 工具渗透至不同市场群体与年龄层,其可靠性危机日益凸显,亟需行业正视这一结构性隐患。

为量化这一风险,研究人员构建了包含 121 个问题的测试集,覆盖包括 Copilot 在内的 18 种免费及付费聊天机器人模型。每个问题最多被提问 5 次,累计生成超过 10,000 条回答。判定标准严苛:事实错误、信息遗漏或缺乏必要警示均视为失败。

Woofun AI 整理数据显示,免费版本表现最差,错误率高达 63%,而付费版本为 49%;在难度最高的题目中,免费版本错误率飙升至 93%。即便启用"推理模式",错误率仍达 39%。具体错误涵盖计算失误、忽视税收政策变动及编造不存在的规则。例如,一道关于养老金税的题目若回答错误,可能导致纳税人面临英国税务海关总署 17,500 英镑的罚款。

市场现状显示用户信任度与认知存在严重错位。安永针对 18,000 名全球消费者的调查显示,49% 的人利用人工智能辅助储蓄和投资决策。英国《金融时报》8 月报道称,五分之四经验较少的投资者借助 AI 辅助投资决策,其中 56% 信任这些工具,高于电视和广播的 47%。

然而,44% 的人误以为 AI 生成的答案受到监管。PensionBee 针对 1,000 名美国成年人的调查进一步揭示,近六成受访者不加独立核实即按 AI 建议行事,近四分之一曾收到错误财务信息。

阿马尔·乔利指出,目前 AI 提供的财务建议未受到任何监管,消费者无法享有专业顾问所带来的相应赔偿权益。这种监管真空使得用户在遭受损失时缺乏救济渠道。他呼吁英国金融行为监管局尽快采取行动,填补这一制度空白,以保护日益依赖 AI 进行财务决策的广大消费者。

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅