whisper_toku
收藏资源简介:
该数据集包含来自日本特摄影视系列(Tokusatsu series)的音频片段及其对应的转录文本。数据集语言为日语,包含音频文件(.wav格式)和相应的转录文本。音频片段来源于特摄影视系列剧集,转录文本基于剧集的字幕文件。数据集可用于改进日语语音识别模型,特别是在特摄影视媒体上下文中的应用。数据集可能包含源材料固有的偏见,如性别代表性和特定于特摄影视类型的语言。数据集的质量可能因原始字幕文件的准确性而有所不同。数据集由特定组织或个人策划,并根据MIT许可证分发。
数据集卡片 for Whisper Tokusatsu
数据集描述
该数据集包含来自日本特摄影视系列的声音片段及其对应的转录文本。
语言
数据集为日语(ja)。
数据集结构
数据集包含音频文件(.wav)及其转录文本。
数据实例
一个数据实例的示例:
python { audio: { path: path/to/audio/file.wav, array: [...], # 实际的音频时间序列 sampling_rate: 44100 }, text: 音声のテキスト転写がここに入ります。 # 音频的转录文本 }
数据字段
audio: 包含语音内容的音频文件。text: 音频文件中语音内容的转录文本。
数据分割
数据集没有预定义的分割。
数据集创建
源数据
音频片段是从特摄影视系列剧集中提取的。
标注
转录文本基于剧集的字幕文件。
使用数据的注意事项
数据集的社会影响
该数据集可用于改进日语的语音识别模型,特别是在特摄影视媒体领域。
偏见讨论
数据集可能包含源材料固有的偏见,包括性别代表性和特定于特摄影视类型的语言。
其他已知限制
转录文本的质量可能因原始字幕文件的准确性而异。
附加信息
数据集策展人
该数据集由[Your Name/Organization]策展。
许可信息
该数据集在MIT许可证下发布。
引用信息
如果您在研究中使用此数据集,请按以下方式引用:
@dataset{whisper_tokusatsu, author = {[Your Name]}, title = {Whisper Tokusatsu Dataset}, year = {2024}, publisher = {Hugging Face}, url = {https://huggingface.co/datasets/NekoFi/whisper_toku} }
贡献
感谢[@NekoFi]添加此数据集。




