登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
urd-pk_web_2019
urd-pk_web_2019
收藏
corpora.uni-leipzig.de
2025-03-24 收录
乌尔都语
文本语料库
数据链接:
https://corpora.uni-leipzig.de?corpusId=urd-pk_web_2019
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Urdu Web text corpus (Pakistan) based on material from 2019
基于2019年资料的乌尔都语网络文本语料库(巴基斯坦)
应用场景:
提供机构:
corpora.uni-leipzig.de
相关数据集
Xhaheen/Alpaca_urdu_2024_1
自然语言处理
乌尔都语
--- dataset_info: features: - name: input dtype: string - name: output dtype: string - name: answer_lengths dtype: 'null' splits: - name: train num_bytes: 51251741 num_
Hugging Face
2024-03-06 更新
21
0
Home Automation System in Urdu Language Dataset
家庭自动化
乌尔都语
Data collected in Urdu language for Home Automation System.
kaggle
2022-07-16 更新
14
0
Sanskrit Text Corpus
梵文研究
文本语料库
Sanskrit text corpus is a cleaned devanagri Sanskrit dataset.
kaggle
2022-04-20 更新
8
0
tyzhu/wikitext-103-raw-v1-para-permute-5
语言模型训练
文本语料库
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* dataset_info: featur
Hugging Face
2023-12-11 更新
14
0
gentaiscool/simpleqa_verified_Urdu_50_selective
问答系统
乌尔都语
该数据集包含问题解决相关的数据,每个条目包含原始索引、问题、答案、主题、答案类型、是否多步骤、是否需要推理以及相关URL等特征。数据集分为eval评估集,包含1000个示例。
Hugging Face
2025-12-14 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广