900人多人种人脸视频采集数据
900人多人种人脸视频采集数据,每个人均包含两段视频和一个txt文档,其中,一段视频为采集者保持自然的口型和面部表情朗读txt文档中的内容,一段视频为采集者保持面部自然表情全程静默不发声。采集者模拟视频会议场景,平视摄像头,露出腰部/胸部以上。采集多样性:多人种、多语种、多主题文档内容、横竖屏混合、多背景、多年龄段。标签准确率超过95%;视频朗读音频与文档句子匹配准确率大于95%。数据可用于跨人种的人脸识别、活体检测、数字人、视频换脸等应用场景
数据规格
数据内容
每个人均包含两段视频和一个txt文档,其中,一段视频为采集者保持自然的口型和面部表情朗读txt文档中的内容,一段视频为采集者保持面部自然表情全程静默不发声。采集者模拟视频会议场景,平视摄像头,露出腰部/胸部以上。
每个人均包含两段视频和一个txt文档,其中,一段视频为采集者保持自然的口型和面部表情朗读txt文档中的内容,一段视频为采集者保持面部自然表情全程静默不发声。采集者模拟视频会议场景,平视摄像头,露出腰部/胸部以上。
数据规模
900人
性别分布
男、女
人种分布
黄种人、白种人、黑种人
采集环境
室内
采集设备
智能手机、网络摄像头(笔记本内置摄像头或外置USB摄像头)
采集多样性
多人种、多语种、多主题文档内容、横竖屏混合、多背景、多年龄段
数据格式
mp4、MOV等视频格式
视频像素
视频总像素介于777600px和8294400px之间
准确率
标签准确率超过95%;视频朗读音频与文档句子匹配准确率大于95%。
样例展示


