0

0

金融领域最新AI评测榜出炉!理财AI“蚂小财”金融专业表现排名第一

雪夜

雪夜

发布时间:2025-07-04 13:19:33

|

514人浏览过

|

来源于php中文网

原创

随着我国“人工智能+”行动计划的加速推进,大模型技术在金融行业的落地应用不断深化。为全面衡量金融领域大模型的专业性与可靠性,近日,上海财经大学发布了国内首个专注于金融行业的大模型评估基准fineval 6.0,并推出了首份评测报告。此次升级新增了“金融严谨性”等评估维度,进一步提升了测评的全面性和专业性。根据评测结果,蚂蚁集团旗下的理财ai产品“蚂小财”的模型底座在金融严谨性等多项指标中表现优异,位居榜首,超越众多通用大模型。

金融领域最新AI评测榜出炉!理财AI“蚂小财”金融专业表现排名第一

(金融领域大模型应用评测榜单,上财)

公开资料显示,上海财经大学是国内最早开展金融大模型评估研究的高校之一,并于2024年参与制定了《金融大模型应用测评指南》,该指南是全国首个以金融业务能力为核心的技术标准。此次FinEval 6.0的更新基于对AI企业、金融机构及投资者的深入调研,重点优化了金融严谨性方面的测试样本,从金融学术知识、行业理解、严谨性测试、安全认知以及智能体应用等多个关键维度,系统评估大模型在复杂金融场景下的综合表现。

本次FinEval 6.0评测覆盖了包括DeepSeek-R1、GPT-4o等在内的9个国内外主流大模型,既有通用型基础模型,也涵盖金融垂直领域的专用模型。评测结果显示,参评模型在金融学术知识方面普遍表现良好,但在应对复杂金融场景的能力上存在明显差异。其中,蚂蚁集团旗下“蚂小财”的模型底座和其自研的Finix大模型整体得分领先,尤其在金融严谨性方面,得分远超行业平均值(70.27分),高出17分,展现出强劲的竞争力。

金融领域最新AI评测榜出炉!理财AI“蚂小财”金融专业表现排名第一

OneAI
OneAI

将生成式AI技术打包为API,整合到企业产品和服务中

下载

(金融领域大模型应用严谨性评测排名,上财)

官方信息显示,“蚂小财”作为蚂蚁集团推出的AI理财助手,已连接蚂蚁财富平台内超过200家基金公司、券商及财经媒体,整合了丰富的金融服务资源。在通用大模型基础上,“蚂小财”团队构建了一套金融智能增强体系,显著提升了金融场景下的功能专业性与交互体验。

“金融行业是国内AI技术应用的重要战场,但同时也对AI的专业性、严谨性提出了更高要求。” 上海财经大学教授、测评项目负责人张立文表示,“目前中国AI在金融领域的表现正逐步提升,正由‘广泛认知’迈向‘专业审慎’阶段,为下一阶段的大规模落地奠定基础。”他指出,这些在“AI+金融”场景中的积极探索,不仅有助于我国在全球AI产业竞争中占据有利位置,也将推动数字金融与普惠金融迈向新的发展阶段。

相关专题

更多
人工智能在生活中的应用
人工智能在生活中的应用

人工智能在生活中的应用有语音助手、无人驾驶、金融服务、医疗诊断、智能家居、智能推荐、自然语言处理和游戏设计等。本专题为大家提供人工智能相关的文章、下载、课程内容,供大家免费下载体验。

411

2023.08.17

人工智能的基本概念是什么
人工智能的基本概念是什么

人工智能的英文缩写为AI,是研究、开发用于模拟、延伸和扩展人的智能的理论、方法、技术及应用系统的一门新的技术科学;该领域的研究包括机器人、语言识别、图像识别、自然语言处理和专家系统等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

304

2024.01.09

人工智能不能取代人类的原因是什么
人工智能不能取代人类的原因是什么

人工智能不能取代人类的原因包括情感与意识、创造力与想象力、伦理与道德、社会交往与沟通能力、灵活性与适应性、持续学习和自我提升等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

628

2024.09.10

Python 人工智能
Python 人工智能

本专题聚焦 Python 在人工智能与机器学习领域的核心应用,系统讲解数据预处理、特征工程、监督与无监督学习、模型训练与评估、超参数调优等关键知识。通过实战案例(如房价预测、图像分类、文本情感分析),帮助学习者全面掌握 Python 机器学习模型的构建与实战能力。

33

2025.10.21

高德地图升级方法汇总
高德地图升级方法汇总

本专题整合了高德地图升级相关教程,阅读专题下面的文章了解更多详细内容。

72

2026.01.16

全民K歌得高分教程大全
全民K歌得高分教程大全

本专题整合了全民K歌得高分技巧汇总,阅读专题下面的文章了解更多详细内容。

131

2026.01.16

C++ 单元测试与代码质量保障
C++ 单元测试与代码质量保障

本专题系统讲解 C++ 在单元测试与代码质量保障方面的实战方法,包括测试驱动开发理念、Google Test/Google Mock 的使用、测试用例设计、边界条件验证、持续集成中的自动化测试流程,以及常见代码质量问题的发现与修复。通过工程化示例,帮助开发者建立 可测试、可维护、高质量的 C++ 项目体系。

54

2026.01.16

java数据库连接教程大全
java数据库连接教程大全

本专题整合了java数据库连接相关教程,阅读专题下面的文章了解更多详细内容。

39

2026.01.15

Java音频处理教程汇总
Java音频处理教程汇总

本专题整合了java音频处理教程大全,阅读专题下面的文章了解更多详细内容。

19

2026.01.15

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
10分钟--Midjourney创作自己的漫画
10分钟--Midjourney创作自己的漫画

共1课时 | 0.1万人学习

Midjourney 关键词系列整合
Midjourney 关键词系列整合

共13课时 | 0.9万人学习

AI绘画教程
AI绘画教程

共2课时 | 0.2万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号