登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
urd_news_2020
urd_news_2020
收藏
corpora.uni-leipzig.de
2025-03-22 收录
乌尔都语
新闻语料
数据链接:
https://corpora.uni-leipzig.de?corpusId=urd_news_2020
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Urdu news corpus based on material from 2020
基于2020年资料的乌尔都语新闻语料库
应用场景:
提供机构:
corpora.uni-leipzig.de
相关数据集
fra_news_2020
法语新闻
自然语言处理
French news corpus based on material from 2020
corpora.uni-leipzig.de
31
0
mar_wikipedia_2021
自然语言处理
语言学
Marathi Wikipedia corpus based on material from 2021
corpora.uni-leipzig.de
13
0
11609227_mahmoodsania
语音识别
乌尔都语
本数据集包含50个独特的乌尔都语音频录音,涵盖日常对话主题,如天气、日常活动和一般陈述。音频在安静环境中自行录制,并使用专用设备(如专用麦克风或智能手机录音器)进行记录。原始音频被处理为16位PCM WAV格式,采样率为44.1kHz,并分割为单个句子级别的片段。在准备过程中,遇到了两个主要挑战:一是乌尔都语中大量依赖的送气音发音问题,通过重新录制特定句子并注重清晰发音来解决;二是音频分割技术问题
Hugging Face
2026-02-05 更新
7
0
Urdu Summary Corpus
乌尔都语
自然语言处理
乌尔都语摘要语料库包含从各种来源收集的50篇文章。从原始HTML文档中仅保留了未格式化的内容文本,移除了所有其他内容。我们为这50篇文章提供了抽象摘要。经过规范化处理后,我们进一步应用了不同的NLP工具对文章进行处理,以生成词性标注、形态分析、词形化和词干提取的文章。
github
2020-02-11 更新
22
0
Urdu OCR - Scale Invariant Feature Vectors MAT+CSV
光学字符识别
乌尔都语
Scale Invariant Urdu Optical Character Recognition
kaggle
2021-05-30 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广