登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Common Crawl Web Data
Common Crawl Web Data
收藏
SSH Open MarketPlace
2025-01-30 更新
2025-02-01 收录
网络爬虫
大数据
数据链接:
https://marketplace.sshopencloud.eu/dataset/Is7jNk
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
A corpus of web crawl data composed of over 25 billion web pages.
应用场景:
创建时间:
2025-01-30
相关数据集
FilmAffinity电影数据集
电影数据集
网络爬虫
通过Webscraping FilmAffinity网站收集的西班牙电影榜单数据集,包含电影及其特征信息。
github
2024-09-02 更新
37
0
🔴 REFERER 🔴 Daddy
网络爬虫
测试
Generate highly realistic HTTP referers for web scraping or testing purposes.
RapidAPI
2023-08-29 更新
8
0
百箱计划_烟台市智慧海洋大数据公共服务平台
智慧海洋
大数据
时间范围,2021年;空间范围,烟台全市;更新周期,每年;更新方式,excel表格上传增量更新;来源系统,烟台市智慧海洋大数据公共服务平台。
山东公共数据开放网
2026-01-08 更新
7
0
WebData Crawler
网络爬虫
数据抓取
This crawler will try to get any data possible from a given url, like title, description and images associated.
RapidAPI
2019-02-20 更新
18
0
Coffee Recommendation
咖啡推荐
网络爬虫
This is web scrapped data
kaggle
2021-11-30 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广