登录后查看消息通知
遇见数据集
天津华夏声学设计院

天津华夏声学设计院

企业

天津华夏声学设计院成立于2014年,属专业技术服务业,主营建筑声学工程、建筑智能化工程设计、施工、建筑声学、电声学技术、计算机软硬件技术开发等。面向多媒体处理、深度学习等领域提供数据服务,开放满汉双文书写艺术数据集(多媒体处理、深度学习),支撑模型训练与算法优化。

多媒体处理深度学习专业技术服务
成立于 2014 年天津市104823154@qq.com

数据概览

1
数据集总量
29
总浏览量
0
关注人数
2024-11-25
最近更新
分类统计

相关机构

  • 浙
    浙江正泰电器股份有限公司
    拥有数据集:91个
    企业
  • 杭
    杭州惠合信息科技有限公司
    拥有数据集:71个
    企业
  • 宣
    宣城开盛产城开发建设有限公司
    拥有数据集:60个
    企业
  • 贵
    贵州阳光海纳生态农业有限公司
    拥有数据集:53个
    企业
  • 诸
    诸城市顺泽供水有限公司
    拥有数据集:47个
    企业

数据集列表

满汉双文书写艺术数据集
多媒体处理
深度学习
1、先获取视频的标题、描述、时长以及音频中的文字信息,使用自然语言处理技术提取关键词作为视频的标签,存储在特定的数据字段中。 2、对输入视频进行帧提取操作,针对每个视频帧,分别进行图像特征提取和音频特征提取。图像特征提取过程中,考虑帧宽度和帧高度等因素,以获取更准确的图像特征向量。音频特征提取时,结合音频采样频率和频道等信息,得到音频特征向量。 3、采用双流网络算法进行处理。构建两个并行的卷积神经网络(CNN),一个专门处理视频的图像特征向量,另一个处理音频特征向量。在两个网络的末端,将图像和音频特征进行融合。输入视频经过帧提取后,对每个视频帧进行图像特征提取和音频特征提取,得到视频的图像和音频特征向量。通过全连接层和 softmax 函数输出视频所属的类别标签以及相应的概率值并分类。 4、输入音频经过特征提取得到特征向量,在这个过程中,可以根据需要进行特征选择或降维处理,去除冗余信息。特征选择或降维时可考虑音频采样频率、频道等因素。 音频特征向量作为输入层的输入,经过隐藏层的神经元计算,通过激活函数传递信号,最后在输出层输出音频所属的类别
天津市数据知识产权登记平台2024-11-12 更新290
关于我们
遇见数据集——让每个数据集都被发现,让每一次遇见都有价值。
数发科官网www.sfktec.com
联系我们
selectdataset@iotsh.com.cn
商业合作
数据驱动未来,携手共赢发展
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15沪公网安备31010402336585号
热门搜索