five

Free Sample Dataset - 1000 High Resolution Images & Metadata|图像数据数据集|机器学习数据集

收藏
Databricks2024-05-09 收录
图像数据
机器学习
下载链接:
https://marketplace.databricks.com/details/3da47c97-478c-4935-a0e7-c61502c7c7b7/Shutterstock_Free-Sample-Dataset---1000-High-Resolution-Images-&-Metadata
下载链接
链接失效反馈
资源简介:
**Overview** This is a free sample dataset consisting of 1000 images and accompanying metadata sourced from our +550 million image library. Image types for this sample include photos, vectors, and illustrations across a vast range of content categories and settings. This sample includes a wide range of metadata fields including content descriptions and keywords that make it ideal for powering a wide variety of machine learning use cases. If you’d like to start licensing data from the full range of imagery and metadata available at Shutterstock please reach out directly to our team at sales.databricks@shutterstock.com to start using our tailored services to help ideate, curate and customize datasets for your unique business needs. **Use cases** This type of data can be licensed from Shutterstock for a wide variety of use cases including powering machine learning models that have generative capabilities. **Metadata** Sample metadata fields included in this dataset are listed below, for a full list of all metadata available from Shutterstock please contact our team at sales.databricks@shutterstock.com. **asset metadata:** id keywords image_type is_creative mature_flag date_submitted date_captured asset_location popularity_score german_description spanish_description french_description korean_description japanese_description labels moderation_labels has_model_release has_people primary_category
 **file metadata:** asset_id asset_file_size asset_file_extension asset_file_size_in_bytes width height orientation
 **model metadata:** asset_id model_release_id age_range age_in_years gender ethnicity **Our data** Shutterstock offers the largest, highest quality and most diverse collection of creative content with best-in-class metadata, giving technology businesses the scale and accuracy they need to build and sustain a wide variety of machine learning models. Our growing library of +550M images, +40M videos, +4M music and audio tracks, and +1.2M 3D models and data is human-reviewed for accuracy and IP infringement, allowing you to use our data worry-free and avoid unwanted or unlawful content. We ethically source all content from over 2 million creators in +150 countries and with over 60 million new assets added annually, our ever-growing library gives you access to fresh and diverse datasets that can be refreshed regularly to meet all your data needs.
提供机构:
Shutterstock
用户留言
有没有相关的论文或文献参考?
这个数据集是基于什么背景创建的?
数据集的作者是谁?
能帮我联系到这个数据集的作者吗?
这个数据集如何下载?
点击留言
数据主题
具身智能
数据集  4099个
机构  8个
大模型
数据集  439个
机构  10个
无人机
数据集  37个
机构  6个
指令微调
数据集  36个
机构  6个
蛋白质结构
数据集  50个
机构  8个
空间智能
数据集  21个
机构  5个
5,000+
优质数据集
54 个
任务类型
进入经典数据集
热门数据集

O*NET

O*NET(Occupational Information Network)是一个综合性的职业信息数据库,提供了关于各种职业的详细描述,包括技能要求、工作活动、知识领域、工作环境等。该数据集被广泛用于职业分析、教育和劳动力市场研究。

www.onetonline.org 收录

TILDA 400

Textile Texture Database (TILDA) for defect detection

kaggle 收录

中国1km分辨率逐月降水量数据集(1901-2024)

该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2024.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。

国家青藏高原科学数据中心 收录

YouTube-English

该数据集包含从各种YouTube频道提取的英语音频片段以及相应的转录元数据。数据用于训练自动语音识别(ASR)模型。数据来源于YouTube频道,处理过程包括下载、分割和保存音频及元数据。数据集总结部分详细列出了每个频道的视频数量、持续时间和占总数据集的百分比。

huggingface 收录

MNBVC

MNBVC数据集是一个超大规模的中文语料集,包括新闻、作文、小说、书籍、杂志、论文、台词、帖子、wiki、古诗、歌词、商品介绍、笑话、糗事、聊天记录等一切形式的纯文本中文数据。数据集不但包括主流文化,也包括各个小众文化甚至火星文的数据。

github 收录