上海财大发布金融领域大模型评测榜单：理财AI“蚂小财”底座模型排名第一头条热点

2025-06-24 16:06 发布时间: 3小时前 192

核心提示：随着我国“人工智能+”行动加速推进，大模型技术在金融领域的应用持续落地。为全面评估金融领域大模型的专业、可靠程度，近日，上海财经大学推出的国内首个金融领域大模型评估基准升级为 6.0，新增了金融严谨性等维度并发布首份评测报告。 6.0对国内外主流大模型的评测显示，蚂蚁集

随着我国“人工智能+”行动加速推进，大模型技术在金融领域的应用持续落地。为全面评估金融领域大模型的专业、可靠程度，近日，上海财经大学推出的国内首个金融领域大模型评估基准升级为 6.0，新增了金融严谨性等维度并发布首份评测报告。 6.0对国内外主流大模型的评测显示，蚂蚁集团旗下理财AI“蚂小财”的模型底座在金融严谨性等维度表现突出排名第一，跑赢了众多通用大模型。

金融领域大模型应用评测榜单，上财

公开资料显示，上海财经大学是国内最早开展金融领域大模型测评工作的高校，并在2024年参与制定了《金融大模型应用测评指南》，这是全国首个以金融业务能力为核心的团体标准。此次，上海财经大学结合对AI企业、金融机构的调研与投资者洞察，重点完善了 6.0的严谨性评测样本，从金融学术知识、金融行业理解、金融严谨性测试、金融安全认知、金融智能体应用等关键维度，全面评估大模型在复杂金融业务场景中的表现。

同时， 6.0对国内外9款有代表性的大模型进行评测，包括-R1、GPT- 4o等通用基础模型，以及金融垂直领域模型。评测报告结果显示，参评模型在金融学术知识方面的表现整体优异，但在金融严谨性、金融行业理解等适配复杂场景的能力上表现各异。其中，理财AI“蚂小财”的模型底座、蚂蚁自研Finix大模型整体表现较好，总分跑赢了通用大模型。尤其在金融严谨性上，行业均值为70.27分，蚂小财超出均值17分显著领先。

金融领域大模型应用严谨性评测排名，上财

官方数据显示，“蚂小财”是蚂蚁集团旗下的AI理财管家，连接了蚂蚁财富平台生态内200多家基金公司、券商和财经媒体的内容与服务。在通用大模型的基础上，“蚂小财”技术团队还搭建了一套金融智能增强的技术体系，实现了金融场景内专业功能、交互体验的全面增强。

“金融领域是国内AI技术应用的焦点场景之一，但天然也对AI的专业性、严谨性等能力提出更高标准。目前国内AI在金融领域的表现逐渐提升，不断从“博闻强识”走向“专业审慎”，为下一阶段大规模应用打好了基本盘。”测评团队负责人、上海财经大学教授张立文表示，这些“AI+金融场景”的积极稳妥探索，有助于在国际AI产业竞争中保持领先身位，也将打开我国数字金融、普惠金融建设的新局面。

举报收藏

更多>同类生活资讯

推荐图文

推荐生活资讯

点击排行

• 持续更新︱河北、黑龙江等5省份陆续公布高考分	• 可复美618失利后，承认其重组胶原蛋白检测方法
• 汽车早报｜比亚迪第五艘汽车运输船正式交付丰	• 黑龙江省金融控股集团原董事长于宏接受审查调查
• 基金公司抢滩稳定币：急聘产品经理，还有子公司	• 中孟巴启动三边合作机制：扎实的双边关系打底，
• 韩国央行副行长：应逐步引入稳定币具体怎么回事	• 去年，上海公共机构能源消费总量同比下降3.77%
• “台独”就是有害垃圾！赖清德“十讲”将把台海	• 特朗普宣布以伊就“全面彻底停火”达成一致，外