ASR Dataset · 语音识别

ASR 语音识别数据 大规模· 多方言 · 多场景

汇集普通话、200+ 语种、外语与多场景采集语料,覆盖朗读、对话、远场、噪声、情感等典型条件,附带严格质检的字级转写与多维度元数据

10w + 发音人 150w h+ 时长 200+ 语种
asr.stream recognize ●LIVE
00:00.42下一站,国贸——请提前做好下车准备
00:04.18嗯,今天阴有小雨,出门请记得带伞
00:08.96明天的会议改到下午三点,
150 +发音人
150w h+时长
200+语种
01 · Catalog

按场景挑选数据集

每个数据集都是独立可授权的子集,可单独申请或组合使用,所有数据都附带元信息文件

普通话朗读

中文成人语音数据库

覆盖新闻、有声书、客服等多领域脚本,15,000+ 说话人均匀分布于不同年龄段与地区

4,000h15,000 采集人数
自由交谈类多领域

中文客服外呼语音数据库

涵盖多个领域,每个领域包含一位客户与客服的呼入与呼出对话及其对应的文本数据。

517h860+ 采集人数
方言多场景

粤语成人自由交谈语音数据库

家居、车载、街道等典型噪声场景,多麦阵列录制,附带噪声类型及 SNR 标签

1,000hSNR 0-20dB
语种对话

小语种互联网数据库

包含欧洲西语、法语、德语等多种欧洲小语种,可应用于科研、语音识别/语音模型训练或算法研究、智能科技、输入法、社交、教育、娱乐、游戏、传媒等应用场景。

1,350,000h12+ 欧洲小语种
车载垂直

中文命令词车载语音数据库

本产品适用于语音识别、机器翻译等领域,可应用于科研、语音识别/语音模型训练或算法研究、智能科技、输入法、社交、教育、娱乐、游戏、传媒等应用场景。

600 h+车载环境
大模型自由交谈

大模型语音数据库

本产品适用于大模型训练、语音识别、机器翻译等领域,可应用于科研、语音识别/语音模型训练或算法研究、智能科技、输入法、社交、教育、娱乐、游戏、传媒等应用场景。

8000 h+大模型
多语种多场景

多语种多人会议场景语音数据库

本产品适用于多语种、多人会议场景的语音识别与分析,可应用于科研、语音识别/语音模型训练或算法研究、智能科技、输入法、社交、教育、娱乐、游戏、传媒等应用场景。

200 h+多语种
多语种朗读

多语种ASR朗读语音数据库

本产品适用于多语种、朗读场景的语音识别与分析,可应用于科研、语音识别/语音模型训练或算法研究、智能科技、输入法、社交、教育、娱乐、游戏、传媒等应用场景。

200 h+小语种
多人对话对话

对话指令词数据库

本产品适用于多人对话场景的语音识别与分析,可应用于科研、语音识别/语音模型训练或算法研究、智能科技、输入法、社交、教育、娱乐、游戏、传媒等应用场景。

200 h+小语种
Next Step

申请 ASR 数据集试用样例