{"text":[[{"start":9.3,"text":"一项研究发现,使用AI聊天机器人处理财务问题可能导致巨额损失,因为来自多家供应商的模型大多数时候都会给出错误答案。"}],[{"start":19.490000000000002,"text":"科技公司Saturn的研究显示,来自ChatGPT、Claude、Copilot、Grok和Gemini的最受欢迎AI模型,平均有57%的时间会对财务问题给出错误答案。"}],[{"start":31.410000000000004,"text":"面对涉及更复杂的问题(包括需要进行多次计算的问题),AI模型平均有88%的回答出错。一些模型在这些难度更高的问题上,错误率达到99%。"}],[{"start":43.88,"text":"这项研究通过包括ChatGPT、Gemini、Claude和副驾驶在内的供应商提供的免费及付费AI模型,提出了100多个不同的财务相关问题。每个问题最多重复提问五次,向18种不同的AI模型累计提出的问题超过1万个。"}],[{"start":61.34,"text":"研究显示,他们的回答存在计算错误,遗漏了即将实施的税制变化,或捏造了相关规定。"}],[{"start":68.77000000000001,"text":"在最糟糕的情况下,依赖AI回答税务问题可能导致严重的经济损失。Saturn首席执行官阿迈勒•乔利(Amal Jolly)说:“数百万人正相信AI模型提供的理财建议,但他们得到的答案是错误的,可能因此蒙受损失。”"}],[{"start":85.12,"text":"研究发现,Claude去年发布的免费模型Claude Haiku 4.5在养老金税收规定上犯下的一处错误,可能导致一名养老金储户被英国税务海关总署(HMRC)追收1.75万英镑。另一个案例中,当被问及学生贷款时,Claude“编造了一项规定”,称毕业生如果要移居海外,就可以停止还款。"}],[{"start":null,"text":"
"}],[{"start":106.06,"text":"研究发现,付费模型给出的回答比免费模型更准确,而新模型的表现也优于旧模型。"}],[{"start":113.34,"text":"总体而言,表现最佳的模型是开启“推理”模式的Claude Opus 5,但它仍有39%的回答存在错误。"}],[{"start":121.17,"text":"投资平台AJ Bell公司的个人理财主管萨拉•科尔斯(Sarah Coles)说:“有时,顾问会联系我们,因为他们的客户按照AI提出的建议做了令人费解的事情,而顾问希望确认客户没有据此采取行动。这很好地说明了,寻求支持的人需要获得适当的建议,而不是信任AI。”"}],[{"start":140.9,"text":"不过,科尔斯补充说,聊天机器人仍可用于制定预算和开展研究,例如根据一个人的收入和支出,提示其可能在哪些方面超支。"}],[{"start":151.26,"text":"此前,英国财务行为监管局(Financial Conduct Authority, FCA)发现,五分之一的英国成年人愿意让AI替他们作出决定;在债务、养老金和投资等复杂选择方面,这种需求最为强烈。"}],[{"start":163.06,"text":"英国财务行为监管局上月发布的研究显示,年轻投资者也更倾向于信任AI,而不是财务领域的网红或电视节目;其中三分之二的人预计未来一年会更多地使用AI。"}],[{"start":176.13,"text":"Saturn首席执行官乔利说:“目前,AI财务建议不受监管,这意味着消费者无法获得如果寻求人工顾问服务本可享有的任何保障,包括赔偿。英国财务行为监管局已经开始考虑这一问题,但必须迅速采取行动保护民众。”"}]],"url":"https://audio.ftcn.net.cn/album/a_1789813497_1332.mp3"}