登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
文档转换
文档转换
收藏
华为云市场
2026-06-08 更新
2025-01-19 收录
文档转换
文本处理
数据链接:
https://marketplace.huaweicloud.com/contents/f455e1bd-be8b-4dc5-960a-fd91e46ae185
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
【感受科技的温度】接口可实现PDF与Word\PPT\Excel\TXT等文档的互相转换,支持设置水印等功能。【怜花数科】
应用场景:
提供机构:
杭州怜花科技有限公司
创建时间:
2025-01-15
相关数据集
usvsnsp/pile-semantic-memorization-filter-results
文本处理
数据分析
--- dataset_info: features: - name: sequence_id dtype: int64 - name: text dtype: string - name: sequence_duplicates dtype: int64 - name: max_frequency dtype: int64 - name:
Hugging Face
2023-09-19 更新
21
0
marcov/google_wellformed_query_promptsource
文本处理
机器学习
该数据集包含多个特征,包括评分、内容、模板名称、模板、渲染输入和渲染输出。数据集分为训练集、测试集和验证集,每个集的大小和样本数量都有详细说明。数据集的下载大小为10800296字节,总大小为64206696字节。数据文件路径和分割方式在配置部分有详细说明。
Hugging Face
2024-11-26 更新
8
0
daniel-kwon/yourbench_example
文本处理
问答系统
该数据集包含了文档分割、文档摘要、问题生成和回答等不同类型的配置。具体包括:文档的分割信息、原始文本、文件名、元数据(如文件大小)、摘要、多跳问题、单次提问等。每个配置都有训练集分割,可用于不同的自然语言处理任务。
Hugging Face
2025-04-11 更新
7
0
gbenson/webui-tokens-unlabelled
自然语言处理
文本处理
WebUI tokens (unlabelled)数据集包含来自gbenson/webui-dom-snapshots的超过5个字符的token。该数据集主要用于文本分类任务,87%的源数据来自英文网站,非ASCII字符被转换为视觉上相似的ASCII字符。数据集由Gary Benson整理,采用CC0 1.0 Universal许可证,主要用于开发一个DOM-aware tokenizer用于HT
Hugging Face
2024-06-21 更新
19
0
AmanKumar007/bhagavad-gita-shloka-dataset
文本处理
自然语言处理
该数据集包含两个主要特征:input_text和output_text,均为字符串类型。数据集分为训练集和测试集,训练集包含630个样本,测试集包含70个样本。数据集的下载大小为2036780字节,总大小为4433289.0字节。数据文件按照训练集和测试集分别存储在不同的路径下。
Hugging Face
2024-12-16 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广