登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
faded_train_001.tar.gz
faded_train_001.tar.gz
收藏
NIAID Data Ecosystem
2026-03-11 收录
CAPTCHA识别
文本识别
数据链接:
https://figshare.com/articles/dataset/faded_train_001_tar_gz/12115656
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
CAPTCHA data 1/8 for training set
应用场景:
创建时间:
2020-04-11
相关数据集
COCO-Text
文本识别
图像处理
COCO-Text数据集是由捷克技术大学等机构创建,旨在推动自然图像中文本检测与识别技术的发展。该数据集基于MS COCO数据集,包含超过63,686张图像和173,589个文本标注,涵盖了从机器打印到手写的多种文本类型。创建过程中,研究者利用了先进的OCR技术和众包平台进行文本的标注和分类。COCO-Text的应用领域广泛,包括辅助技术、机器人导航和地理定位等,旨在解决复杂场景下的文本识别问题。
arXiv
2016-06-20 更新
449
0
nopperl/pmc-image-text
医学图像分析
文本识别
PubMed Central Figures Dataset包含从PubMed Central库中的论文提取的图像-文本对,用于训练CLIP模型。数据集以Parquet文件形式存储,包含WebDataset的元数据,但图像本身未提供,需要通过论文ID和文件名从FTP服务器获取。此外,数据集还包含一个NumPy文件,用于去除与DataComp评估数据重复的样本。
Hugging Face
2023-11-09 更新
59
0
Teklia/NewsEye-Austrian-line
文档处理
文本识别
--- license: mit language: - de task_categories: - image-to-text pretty_name: NewsEye-Austrian-line dataset_info: features: - name: image dtype: image - name: text dtype: string splits
Hugging Face
2024-03-14 更新
14
0
ICDAR 2015
图像处理
文本识别
该数据集专注于从自然图像中检测和识别文本信息,它是评估所提出方法时使用的一部分基准数据集,其任务场景为文本识别。
arXiv
187
0
Textual Visual Semantic Dataset for Text Spotting
文本识别
视觉语言
这是一个用于Text Spotting的视觉语义数据集,旨在通过扩展COCO-text数据集,添加场景信息(如图像中的物体和地点),以帮助研究人员在Text Spotting系统中考虑文本与场景之间的语义关系,并提供一个共同框架。
github
2023-01-26 更新
24
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广