登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
数据建模综合决策项目_软件著作权信息数据集
数据建模综合决策项目_软件著作权信息数据集
收藏
尚数网
2025-11-08 收录
软件著作权
文献数据挖掘
数据链接:
https://shangshuwang.cn/sample-detail?id=580655308112661701
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
<p>数据建模综合决策项目_软件著作权信息数据集,可应用在文本挖掘与自然语言处理(NLP)、知识图谱构建、推荐系统、竞争情报分析等方面。</p>
应用场景:
创建时间:
2024-03-18
相关数据集
SetFit/tweet_sentiment_extraction
情感分析
文献数据挖掘
# Tweet Sentiment Extraction Source: https://www.kaggle.com/c/tweet-sentiment-extraction/data
Hugging Face
2022-05-12 更新
17
0
MAC
文献数据挖掘
作者识别
百万作者语料库(Million Authors Corpus,MAC)是一个新颖的数据集,涵盖了来自数十种语言的Wikipedia贡献。该数据集仅包含来自Wikipedia编辑的长且连续的文本块,并将这些文本与其作者关联起来。
Hugging Face
2025-05-28 更新
13
0
JahnaviKumar/coir-train-pairs
自然语言处理
文献数据挖掘
该数据集包含了数据集名称、查询ID、查询内容、语料库ID和语料库内容等字段。它被划分为训练集,提供了训练集的字节数和示例数,以及数据集的下载大小和整体大小。
Hugging Face
2025-10-15 更新
8
0
Marcus2112/minipile_density-proportioned_tiny
自然语言处理
文献数据挖掘
这是一个基于The Pile Deduplicated的数据集,包含文本(text)和索引(pile_idx)两种特征。数据集被划分为训练集(train)、验证集(validation)和测试集(test),分别包含842,967、500和10,000个示例。整个数据集大小为5,279,901,670字节,下载大小为2,903,588,242字节。数据集使用英语。
Hugging Face
2025-01-23 更新
13
0
spiralworks/sm_test
论坛分析
文献数据挖掘
这是一个包含论坛帖子和相关笔记的数据集,其中每个帖子都包括ID、标题、作者列表、摘要、关键词、PDF链接等信息。每个笔记则包括ID、类型、创建时间、回复对象、阅读者列表、签名和文本内容。数据集分为训练集,并提供了相应的字节数和示例数。
Hugging Face
2025-01-16 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广