0

0

北大彭宇新教授团队开源细粒度多模态大模型Finedefics

霞舞

霞舞

发布时间:2025-02-17 20:40:30

|

571人浏览过

|

来源于php中文网

原创

北京大学彭宇新教授团队在细粒度多模态大模型领域取得突破性进展,其研究成果已被iclr 2025接收并开源。该团队研发的finedefics模型显著提升了多模态大模型的细粒度视觉识别能力,在六个权威数据集上的平均准确率达到76.84%,超越了现有模型。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

图片

挑战与突破:细粒度视觉识别的瓶颈

现有多模态大模型在通用视觉任务中表现出色,但在细粒度视觉识别方面存在不足。细粒度识别要求区分同一大类下的细微差别,例如区分不同鸟类、汽车品牌和型号等。 这主要是因为缺乏足够的细粒度标注数据,导致模型难以学习到细微的视觉特征。

Finedefics模型正是为了解决这一难题而生。该团队深入分析了多模态大模型在细粒度识别中所需的三个关键能力:对象信息提取、类别知识储备和对象-类别对齐。研究发现,对象与类别的错位匹配是制约模型性能的关键。

Finedefics:巧妙的对齐策略

Finedefics模型通过两阶段训练策略巧妙地解决了对象-类别对齐问题:

  1. 属性描述构建: 利用大语言模型挖掘细粒度属性,例如描述鸟类的羽毛颜色、形状等,并将其与图像特征结合,生成更精细的图像描述。

  2. 属性增强对齐: 通过对比学习,将图像特征、属性描述和类别信息进行对齐,强化模型学习细微视觉特征与类别标签之间的对应关系。 这包括对象-属性、属性-类别和类别-类别三个层次的对比学习。 此外,模型还进行了以识别为中心的指令微调,进一步提升了模型的识别准确性。

    Originality AI
    Originality AI

    专门为网络出版商设计的抄袭和AI检测工具

    下载

图片

显著成果与未来展望

Finedefics在六个权威数据集上取得了显著成果,平均准确率达到76.84%,相比于Idefics2模型提升了10.89%。 这表明Finedefics有效地提升了多模态大模型的细粒度视觉识别能力。

图片

资源链接:

Finedefics的成功为多模态大模型在细粒度视觉识别领域的应用提供了新的方向,也为后续研究提供了宝贵的经验。 该团队的研究成果为推动细粒度视觉识别技术的发展做出了重要贡献。

相关专题

更多
github中文官网入口 github中文版官网网页进入
github中文官网入口 github中文版官网网页进入

github中文官网入口https://docs.github.com/zh/get-started,GitHub 是一种基于云的平台,可在其中存储、共享并与他人一起编写代码。 通过将代码存储在GitHub 上的“存储库”中,你可以: “展示或共享”你的工作。 持续“跟踪和管理”对代码的更改。

427

2026.01.21

github中文官网入口 github中文版官网网页进入
github中文官网入口 github中文版官网网页进入

github中文官网入口https://docs.github.com/zh/get-started,GitHub 是一种基于云的平台,可在其中存储、共享并与他人一起编写代码。 通过将代码存储在GitHub 上的“存储库”中,你可以: “展示或共享”你的工作。 持续“跟踪和管理”对代码的更改。

427

2026.01.21

http与https有哪些区别
http与https有哪些区别

http与https的区别:1、协议安全性;2、连接方式;3、证书管理;4、连接状态;5、端口号;6、资源消耗;7、兼容性。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

2059

2024.08.16

c++ 根号
c++ 根号

本专题整合了c++根号相关教程,阅读专题下面的文章了解更多详细内容。

25

2026.01.23

c++空格相关教程合集
c++空格相关教程合集

本专题整合了c++空格相关教程,阅读专题下面的文章了解更多详细内容。

29

2026.01.23

yy漫画官方登录入口地址合集
yy漫画官方登录入口地址合集

本专题整合了yy漫画入口相关合集,阅读专题下面的文章了解更多详细内容。

117

2026.01.23

漫蛙最新入口地址汇总2026
漫蛙最新入口地址汇总2026

本专题整合了漫蛙最新入口地址大全,阅读专题下面的文章了解更多详细内容。

178

2026.01.23

C++ 高级模板编程与元编程
C++ 高级模板编程与元编程

本专题深入讲解 C++ 中的高级模板编程与元编程技术,涵盖模板特化、SFINAE、模板递归、类型萃取、编译时常量与计算、C++17 的折叠表达式与变长模板参数等。通过多个实际示例,帮助开发者掌握 如何利用 C++ 模板机制编写高效、可扩展的通用代码,并提升代码的灵活性与性能。

16

2026.01.23

php远程文件教程合集
php远程文件教程合集

本专题整合了php远程文件相关教程,阅读专题下面的文章了解更多详细内容。

70

2026.01.22

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号