楼主: ewfwedwd
68 0

[经管数据集] MMVP 多模态运动捕捉数据集 [推广有奖]

  • 0关注
  • 1粉丝

已卖:488份资源

学科带头人

76%

还不是VIP/贵宾

-

威望
0 级
论坛币
1453 个
通用积分
458.1407
学术水平
6 点
热心指数
6 点
信用等级
6 点
经验
18923 点
帖子
1233
精华
0
在线时间
381 小时
注册时间
2022-11-18
最后登录
2026-9-29

楼主
ewfwedwd 发表于 2026-3-17 11:32:02 |AI写论文

+2 论坛币
k人 参与回答

经管之家送您一份

应届毕业生专属福利!

求职就业群
赵安豆老师微信:zhaoandou666

经管之家联合CDA

送您一个全额奖学金名额~ !

感谢您参与论坛问题回答

经管之家送您两个论坛币!

+2 论坛币

MMVP 多模态运动捕捉数据集



MMVP (Multimodal MoCap Dataset with Vision and Pressure Sensors) 是由北京航空航天大学、清华大学和南京大学联合研发的结合视觉和压力传感器的多模态运动捕捉数据集。


该数据集包含了诸多大范围且迅速的人体运动,像是跑步、跳绳、立定跳远之类,总计采集了 16 位受试者的逾 44k 帧同步 RGBD 帧以及压力数据。研究者借助 Azure Kinect 相机以每秒钟 30 帧的频率记录 RGBD 视频,同时运用 Xsensor 压力鞋垫以高达每秒钟 150 帧的速率捕获足底压力数据,经由手动对两种数据流进行同步,再结合像 FPP-Net 与 CLIFF 这样的深度学习算法,实现对数据的细致处理与分析。该数据集为基于视觉和压力传感器的人类运动捕捉研究给予了全新的数据资源,能够助推该领域的进展。



描述: MMVP(多模态视觉模式)基准侧重于识别「CLIP-盲对」——尽管具有明显的视觉差异,但 CLIP 认为相似的图像。 MMVP 对包括 GPT-4V 在内的最先进系统的性能进行了九种基本视觉模式的基准测试。它强调了这些系统在回答简单问题时面临的挑战,通常会导致错误的响应和幻觉的解释。



内容类型: Images (CLIP-blind pairs)

数量: 300 张图片

数据来源: 源自 ImageNet-1k 和 LAION-Aesthetics

数据收集方法: 通过比较分析识别 CLIP 盲对



323a0b95-6368-4f48-89b3-f7d98e5873a5.png




MMVP 多模态运动捕捉数据集.zip (1.05 KB, 需要: RMB 10 元)


二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

关键词:mmV 多模态 MVP 数据集 Multimodal

您需要登录后才可以回帖 登录 | 我要注册

本版微信群
扫码
拉您进交流群
GMT+8, 2026-9-30 06:37