中国数智化转型网 人工智能资讯 每日人工智能资讯|桥水基金联合Thinking Machines Lab测试前沿大模型金融判断准确率未达80%

每日人工智能资讯|桥水基金联合Thinking Machines Lab测试前沿大模型金融判断准确率未达80%

据CSDN、量子位7月28日报道,桥水基金联合Thinking Machines Lab对GPT、Claude、Gemini等前沿大模型进行金融判断测试,结果准确率仅50%-70%,未达80%可信门槛。基于开源模型微调的自研方案在准确率和成本上反而更具优势。

桥水基金是全球最大对冲基金,管理的资产规模约1500亿美元。本次测试覆盖GPT-5.6、Claude Opus 4.5、Gemini 3.5 Pro、DeepSeek-V4等9款主流大模型,测试集包括10万条历史金融事件,覆盖股票、债券、外汇、大宗商品、衍生品五大类资产。

测试结果显示,旗舰大模型在简单趋势预测任务上准确率达65%-72%,但在复杂宏观判断、多因子归因、跨市场套利等高难度任务上准确率普遍低于55%。基于Qwen2.5-72B开源模型微调的金融专用模型在多项任务上反超旗舰大模型。业内人士分析,金融场景对大模型的”领域微调+知识库增强”要求远超通用场景能力。

桥水基金+Thinking Machines Lab的金融大模型测试结果对行业冲击巨大。测试覆盖10万条历史金融事件,包括1987年股灾、2008年金融危机、2020年疫情冲击、2022年加密货币崩盘等极端市场场景,结果显示旗舰大模型在简单趋势预测任务上准确率达65%-72%,但在复杂宏观判断、多因子归因、跨市场套利等高难度任务上准确率普遍低于55%。

基于Qwen2.5-72B开源模型微调的金融专用模型在多项任务上反超旗舰大模型,关键在于其内置了Bloomberg、Wind、同花顺iFinD等专业金融数据库,并深度融合了桥水基金创始人达里奥的「经济机器运行原理」知识库。测试报告指出,金融场景对大模型的「领域微调+知识库增强+决策可解释性」要求远超通用场景能力。桥水基金已将自研金融大模型应用于实际交易决策,成为首家规模化应用AI决策的全球顶级对冲基金。

若您对人工智能感兴趣或为人工智能创始人,可添加数智化转型网小助手思思微信加入人工智能交流群。若您在寻找人工智能供应商,可联系数智化转型网小助手思思(17757154048,微信同号)

思思企微
思思企微

若您为人工智能服务商,可添加数智化转型网小助手Jasper,加入人工智能行业交流群。

鹿鸣企微
Jasper企微

声明:本文来自数智化转型网,版权归作者所有。文章内容仅代表作者独立观点,不代表数智化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

底部图片
免责声明: 本网站(http://www.szhzxw.cn/)内容主要来自原创、合作媒体供稿和第三方投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。 本网站刊载的所有内容(包括但不仅限文字、图片、LOGO、音频、视频、软件、程序等) 版权归原作者所有。任何单位或个人认为本网站中的内容可能涉嫌侵犯其知识产权或存在不实内容时,请及时通知本站,予以删除。https://www.szhzxw.cn/134113.html
联系我们

联系我们

17717556551

邮箱: editor@cxounion.org

关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部