楼主: ewfwedwd
102 0

[经管数据集] AVSpeech – 视听语音数据集 [推广有奖]

  • 0关注
  • 1粉丝

已卖:488份资源

学科带头人

76%

还不是VIP/贵宾

-

威望
0 级
论坛币
1453 个
通用积分
458.1407
学术水平
6 点
热心指数
6 点
信用等级
6 点
经验
18923 点
帖子
1233
精华
0
在线时间
381 小时
注册时间
2022-11-18
最后登录
2026-9-29

楼主
ewfwedwd 发表于 2026-5-15 12:00:15 |AI写论文

+2 论坛币
k人 参与回答

经管之家送您一份

应届毕业生专属福利!

求职就业群
赵安豆老师微信:zhaoandou666

经管之家联合CDA

送您一个全额奖学金名额~ !

感谢您参与论坛问题回答

经管之家送您两个论坛币!

+2 论坛币

AVSpeech 视听语音数据集|大规模无噪语音视频研究数据



AVSpeech 视听语音数据集|大规模纯净语音视频研究资源

AVSpeech 是面向视听语音领域的大规模纯净视听数据集,专为语音识别、唇语识别、多模态语音研究打造,数据质量高、覆盖广。



1. 内容覆盖范围

数据规模:约4700 小时纯净语音视频片段,源自29 万个公开视频

片段时长:单段3-10 秒,无背景噪音干扰

核心特点:音画强对齐,声音唯一对应画面中说话人

覆盖维度:多语种、多人物、多样面部姿态,场景丰富



2. 适用范围与可用途径

适用领域:视听语音识别、唇语识别、多模态 AI、语音增强、语音分离、学术论文实验

可用途径:高校科研、AI 算法开发、模型训练验证、竞赛项目、语音技术研发





AVSpeech – 视听语音数据集.zip (8.48 MB, 需要: RMB 5 元)

二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

关键词:Speech vsPE 数据集 SPE YouTube

您需要登录后才可以回帖 登录 | 我要注册

本版微信群
扫码
拉您进交流群
GMT+8, 2026-9-30 09:38