生成式AI正在迅速融入个人理财市场,但其在处理复杂金融问题时的能力明显滞后于用户的使用增长。英国《金融时报》引用科技公司Saturn的研究,测试了18个主流AI模型,在超过1万次金融问题的测试中,平均错误率达57%;当涉及多步计算时,这一错误率甚至提高到88%。
此次测试涵盖了100多种与金钱相关的问题,每道题最多重复五次,并对比了免费和付费模型的表现。结果发现,问题不仅是简单的算术错误,部分模型会忽略即将实施的税制改革,甚至会生成实际上并不存在的金融规则。
在处理复杂问题时,一些模型的错误率高达99%。即便是测试中表现最好的Claude Opus 5,在“推理”模式下,错误回答率也达39%。
总体来说,付费模型的准确率高于免费模型,新模型的表现普遍优于旧模型。然而,Saturn的测试表明,即使是表现最佳的产品,仍未达到稳定支持高风险个人财务决策的标准。
错误建议可能导致实际财务损失
特别是在税务和养老金领域,错误建议可能从信息失误转化为真实损失。
测试中,Claude Haiku 4.5错误解释了一项养老金税务规则,用户如果依照该建议操作,可能会面临高达1.75万英镑的税务处罚。
在另一项关于学生贷款的测试中,模型虚构了一条不存在的规则,声称借款人“移居海外即可停止还款”。这种错误超出了信息检索的范畴,用户可能因此改变自己的财务决策。
AJ Bell个人理财主管萨拉·科尔斯(Sarah Coles)表示,近期已有顾问接到客户咨询,客户因执行AI的异常建议而产生的疑问希望得到确认。
科尔斯认为,消费者在需要实质性支持时仍应寻求正规的专业建议,而不应完全依赖聊天机器人。不过,她承认AI在个人理财中的应用潜力。
在预算整理、基础研究及识别过度消费项目等低风险环节,AI仍可提供有价值的辅助。关键在于,这些任务允许用户进行检查和纠正,而在税务、养老金或投资执行中的单次错误则可能带来不可逆的财务损失。
AI需求快速增长,填补专业建议市场空缺
尽管风险尚存,用户需求却正迅速上升。英国金融行为监管局调查显示,约20%的英国成年人希望AI为其作出金融决策,尤其是在债务、养老金和投资等复杂领域。
年轻投资者接受度更高,约三分之二预计未来一年将增加对AI的使用。另据《金融时报》报道,近20%的受访者已借助AI处理个人财务。
与此同时,只有9%的英国成年人获得过受监管的金融建议,这为低成本AI工具的快速发展创造了市场机会。
这种背景使AI理财工具得以迅速增长。对于无法支付传统财富管理费用的消费者,聊天机器人显著降低了获取金融信息的门槛。
然而,低成本与高可获得性并未解决准确性和责任的问题。消费者越方便地使用AI进行复杂决策,模型出错造成实际财务损失的风险也会增加。
AI可能改变顾问的角色,而非替代他们
传统财富管理机构依旧具备AI难以取代的优势,即受监管顾问提供的持续服务和清晰的责任关系。
以英国大型财富管理公司St James’s Place为例,其约5000名顾问被视为抵御免费AI理财工具竞争的重要资产。对于客户来说,人工顾问不仅提供解答,还包括长期的服务、明确的责任和问题处理机制。
AI的普及也在提升客户对人工顾问的期望。《金融时报》分析指出,即使客户希望继续使用人工服务,亦期待顾问能运用更高效的技术工具。
若AI能协助顾问进行资料整理、初步分析和流程标准化,那么单个顾问能服务的客户数量将可能增加。因此,AI在财富管理中的早期影响更可能体现在自动化顾问的工作流程,而非直接终止受监管的咨询关系。
当前,最紧迫的制度问题仍是责任归属。Saturn首席执行官阿迈勒·乔利(Amal Jolly)指出,消费者通过AI获取金融建议时,缺乏与人工顾问相同的保障与赔偿机制。
乔利表示,FCA已开始对此进行研究。然而,在AI用户持续增加的趋势下,消费者使用速度已接近现有监管界限,如何界定AI提供的金融信息与建议之间的责任,以及错误后由谁承担后果,正是个人理财市场亟需解决的问题。