SEP-28k口吃事件数据集
SEP-28k口吃事件数据集是公开可访问数据集,包含播客语音片段和口吃事件标签等音频数据,围绕言语障碍相关临床表现、影像、信号或组学信息,适合用于分类、模型训练、外部验证和疾病机制探索。
基本信息
资源简介
SEP-28k口吃事件数据集包含播客语音片段和口吃事件标签等音频数据,可用于言语障碍相关分类、诊断建模、分型或外部验证。
下载信息
注册下载
Tips: 该数据集需要在对应的数据源网站注册通过后,才能进行数据下载,注册有对应要求,或者需要收费。
暂未开放公开下载
Tips: 该数据集属于公开下载,应该可以免费公开下载。
免登录有偿下载
Tips: 该数据集 Qianfanghub 可以协助提供有偿下载服务,注意,服务不针对数据相关产权,只是技术服务费。
提供高速下载与技术交付服务(收技术服务费,非数据销售)
暂未开放千方医数集,医疗数据集部分,是为社区服务的公开医疗数据集搜索引擎,并不存储或者下载原始的任何数据。 如果您有其他医疗数据需求,可以和客服联系,或者下工单。我们有强大的三甲医疗机构帮助您提供个性化的医疗数据定制、采集、标注服务。
使用方式
数据集获取
git clone https://github.com/apple/ml-stuttering-events-dataset.git
curl -L -o repo.zip https://github.com/apple/ml-stuttering-events-dataset/archive/refs/heads/main.zip
unzip repo.zip
源站 README 摘录(使用方式)
Downloading & Processing Scripts
There are two scripts used to download the raw audio files and extract into clips that correspond to the clip annotations. [WAV_DIR] refers to the folder where you are storing all of the raw audio data and [CLIP_DIR] refers to where you want to place the clips. These may be the same folder.
To download and extract clips from both datasets run the following from this directory
python download_audio.py episodes SEP-28k_episodes.csv wavs [WAV_DIR]python extract_clips.py labels SEP-28k_labels.csv wavs [DATA_DIR] clips [CLIP_DIR]python download_audio.py episodes fluencybank_episodes.csv wavs [WAV_DIR]python extract_clips.py labels fluencybank_labels.csv wavs [DATA_DIR] clips [CLIP_DIR]
The raw SEP-28k wav files are 32 Gb and clipped SEP-28k wav files are 2.6 Gb.
精度瓶颈?数据缺失?
当前公开数据无法满足您的算法精度?千方提供针对 言语障碍 的高质量、多模态真实临床数据定制解决方案。




