登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Use python program language to extract key phrases from patent text
Use python program language to extract key phrases from patent text
收藏
科学数据银行
2022-10-19 更新
2026-04-23 收录
文本分析
关键短语提取
数据链接:
https://www.scidb.cn/detail?dataSetId=6676f729ec884e54b0b559e33a5be8c1
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Use python program language to extract key phrases from patent text
应用场景:
提供机构:
南京工业大学
创建时间:
2022-10-15
相关数据集
circle.10.9.10.10000
文本分析
机器学习
这是一个用于研究下一代预测的创造力限制的文本数据集,包含了输入文本(input_text)和目标文本(target_text)两种特征。数据集分为训练集(train)和验证集(valid),其中训练集包含10000个示例,验证集包含1024个示例。数据集的总大小为1,718,912字节。
Hugging Face
2025-05-27 更新
21
0
chiki29/indian-law-dataset-1k
印度法律
文本分析
这是一个包含文本数据的训练集,共有24607个文本示例,数据集大小为13,403,380字节。数据集被划分为了训练集,可以通过指定的配置default访问训练数据。
Hugging Face
2025-02-09 更新
8
0
cp-data-2
文本分析
自然语言处理
该数据集包含文本类型的特征,适用于文本分析任务。它有一个训练集,共有1296359个样本,总大小为约2.3GB。提供的配置文件'default'包含了访问训练集的路径信息。
Hugging Face
2025-04-16 更新
7
0
thorirhrafn/domar_data_split
文本分析
自然语言处理
该数据集包含四个主要特征:Title(标题)、Keywords(关键词)、Summary(摘要)和Text(文本),所有特征的数据类型均为字符串。数据集分为训练集(train)、验证集(eval)和测试集(test)三个部分,分别包含7461、414和415个样本。数据集的下载大小为112632160字节,总大小为229363348.0字节。
Hugging Face
2024-04-01 更新
13
0
hpprc/enwiki-paragraphs
自然语言处理
文本分析
--- dataset_info: features: - name: title dtype: string - name: passage_id dtype: int64 - name: section_title dtype: string - name: text dtype: string splits: - name: tra
Hugging Face
2024-06-12 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广