-
音频特征情感识别训练数据集
2025年8月30日 30 2 1
音频特征情感识别训练数据集_Audio_Feature_Emotion_Recognition_Training_Dataset 数据来源:互联网公开数据 标签:音频分析, 情感识别, 机器学习, 语音信号处理, 特征提取, MFCC, ZCR, RMS, 数据集构建 数据概述:...
-
音频样本分类数据集
2025年4月25日 30 137 129
音频样本分类数据集 数据来源:互联网公开数据 标签:大调,小调,吉他,钢琴,音色识别,音乐分类,机器学习,音效分析,音调识别,音乐信息检索 数据概述: 本数据集包含吉他和钢琴两种乐器的音频样本,主要用于区分大调和小调音色的分类任务。数据集涵盖了不同演奏者、不同音色、不同音调的音频片段,提供丰富的音色特征信息。 数据用途概述:...
-
音频文件重命名元数据映射数据集
2025年7月19日 30 189 63
音频文件重命名元数据映射数据集_Audio_File_Renaming_Metadata_Mapping 数据来源:互联网公开数据 标签:音频处理, 文件管理, 元数据, 映射关系, 数据清洗, 批量重命名, 文本分析, 数据集 数据概述: 该数据集包含音频文件重命名过程中产生的元数据映射关系,记录了原始文件名与其对应的新文件名。主要特征如下:...
-
音频文件处理与播客制作技能
2026年8月28日 30 87 56
技能概述 Audio 技能是一款面向音频处理领域的专业数据资产,版本 1.0.1,隶属于设计媒体(design-media)类别下的音频处理子领域。它专注于音频文件的处理、增强与转换,支持降噪、归一化、格式转换、转录以及播客工作流等核心任务。 该技能基于 FFmpeg 和 FFprobe 等命令行工具构建,并可选集成 SoX、Whisper 和...
-
音频异常检测声音数据集
2025年10月13日 30 26 16
音频异常检测声音数据集_Audio_Anomaly_Detection_Sound_Dataset 数据来源:互联网公开数据 标签:音频分析, 异常检测, 声音识别, 机器学习, 工业场景, 无监督学习, 数据标注, 音频信号处理 数据概述: 该数据集包含来自工业环境的声音数据,记录了正常声音和异常声音的样本,用于音频异常检测任务。主要特征如下:...
-
音频声音分类数据集
2025年8月27日 30 75 9
音频声音分类数据集_Audio_Sound_Classification_Dataset 数据来源:互联网公开数据 标签:音频分类, 声音识别, 机器学习, 深度学习, 音频特征, 声学分析, 声音事件, 数据标注 数据概述: 该数据集包含来自公开声音资源的声音片段,记录了不同声音事件的音频数据。主要特征如下:...
-
音频回复与网页朗读技能
2026年8月28日 30 17 1
技能概述 Audio Reply 是一款专注于音频处理的 AI 技能,隶属于设计媒体(design-media)类别,子领域为音频处理,当前版本为 1.1.0。该技能通过 TTS(文本转语音)技术,将文本内容转换为自然流畅的语音回复,支持两种核心触发模式:一是通过“读给我听 [公开网址]”获取并朗读网页内容,二是通过“跟我聊...
-
音频医学场景咳嗽声与手部声音识别数据集
2025年7月21日 30 80 0
音频医学场景咳嗽声与手部声音识别数据集_Audio_Medical_Cough_and_Hand_Sound_Recognition 数据来源:互联网公开数据 标签:咳嗽声, 手部声音, 音频识别, 医学诊断, 机器学习, 声音特征, 数据标注, 情感分析 数据概述:...
-
音频分类音乐声音事件数据集
2026年3月5日 30 201 187
音频分类音乐声音事件数据集_Audio_Classification_Music_Sound_Event_Dataset 数据来源:互联网公开数据 标签:音频分类, 声音事件, 机器学习, 声学特征, 音乐分析, 深度学习, 数据集, 频谱图 数据概述:...
-
音频分类识别数据集
2025年8月20日 30 100 11
音频分类识别数据集_Audio_Classification_Recognition_Dataset 数据来源:互联网公开数据 标签:音频识别, 声音分类, 机器学习, 深度学习, 语音识别, 声音事件检测, 数据集, 音频处理 数据概述: 该数据集包含多种声音的音频文件,以及一个用于提交预测结果的CSV文件,主要用于音频分类任务。主要特征如下:...
-
-
音频信号特征数据集深入解析声音特征
2025年4月25日 31 78 5
标题:音频信号特征数据集深入解析声音特征 数据内容: 该数据集包含了多种音频信号的特征参数,具体包括: 1. 频谱质心相关特征(均值和标准差) 2. 频谱带宽相关特征(均值和标准差) 3. 频谱对比度相关特征(均值) 4. 频谱平坦度相关特征(均值) 5. 频谱衰减相关特征(均值) 6. 过零率(zero_crossing_rate) 7....
-
音频MNIST时序频谱特征语音识别特征数据集
2025年4月15日 30 174 147
音频MNIST时序频谱特征语音识别特征数据集 数据来源:互联网公开数据 标签:音频特征,语音识别,时序特征,频谱特征,机器学习,深度学习,分类任务 数据概述:...
-
音视频转录说话人分离技能
2026年8月28日 30 133 91
技能概述 Transcribee 🐝 是一款面向知识管理场景的音视频转录技能,版本 1.2.1,属于信息检索与摘要总结子领域。它能够将 YouTube 视频、播客以及本地音视频文件转换为带说话人标签的清晰转录文本,满足用户对会议、访谈、课程等内容的文字化需求。 该技能基于 ElevenLabs 的说话人分离技术,支持多种主流音视频格式(如...
-
音视频语音活动检测数据集
2025年7月21日 30 182 134
音视频语音活动检测数据集_Audio_Video_Voice_Activity_Detection 数据来源:互联网公开数据 标签:语音识别, 音频分析, 语音活动检测, VAD, 时间戳, 音频处理, 机器学习, 深度学习 数据概述: 该数据集包含来自YouTube视频的音频数据,记录了语音活动检测(VAD)的结果。主要特征如下:...
-
音视频真实性检测训练数据集
2025年10月16日 30 41 25
音视频真实性检测训练数据集_Audio_Video_Authenticity_Detection_Training_Dataset 数据来源:互联网公开数据 标签:音视频, 真实性, 伪造检测, 深度学习, 图像识别, 视频分析, 数据标注, 二分类 数据概述:...
-
音视频真伪鉴别数据集
2025年11月2日 30 56 52
音视频真伪鉴别数据集_Audio_Video_Authenticity_Identification_Dataset 数据来源:互联网公开数据 标签:音视频, 伪造检测, 深度学习, 计算机视觉, 图像识别, 视频分析, 真实性判别, 多模态 数据概述: 该数据集包含音视频文件及其对应的真伪标签,用于训练和评估音视频内容的真实性鉴别模型。主要特征如下:...
-
-
音乐音频特征及元数据分析数据集
2025年9月9日 30 23 10
音乐音频特征及元数据分析数据集_Music_Audio_Features_and_Metadata_Analysis_Dataset 数据来源:互联网公开数据 标签:音乐,音频,特征提取,元数据,机器学习,音乐流派,音频分析,深度学习 数据概述: 该数据集包含来自Free Music Archive (FMA)...



