登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Tulu Dataset from Srinivas institute of Technology
Tulu Dataset from Srinivas institute of Technology
收藏
kaggle
2024-05-25 更新
2024-05-26 收录
自然语言处理
OCR
数据链接:
https://www.kaggle.com/datasets/swathisherigar/tulu-alphabets-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
An Annotated Dataset of Tulu Letters
《图卢语字母标注数据集》
应用场景:
创建时间:
2024-05-25
相关数据集
open-llm-leaderboard-old/details_AIDC-ai-business__Marcoroni-70B
自然语言处理
模型评估
该数据集是在Open LLM Leaderboard上对模型AIDC-ai-business/Marcoroni-70B进行评估时自动创建的。数据集由61个配置组成,每个配置对应一个评估任务。数据集由4次运行生成,每次运行的结果作为特定配置中的一个分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,还有一个名为results的配置存储了所有运行的聚合结果,用于在Open LLM
Hugging Face
2023-09-19 更新
16
0
mlfoundations-dev/top_4_ranking_stackexchange
Stack Exchange
自然语言处理
该数据集包含指令和完成情况的对,以及原始行索引和对话信息。它分为训练集,共有20万个示例,数据集总大小超过1.5GB。对话信息包括发送者和消息内容。
Hugging Face
2025-01-07 更新
6
0
owm-cog-behaviors
自然语言处理
对话分析
该数据集包含对话信息,每个对话信息包括内容和角色两个子特征,还有一个后缀特征。数据集分为训练集和测试集,训练集包含26910个示例,测试集包含1417个示例。
Hugging Face
2025-04-05 更新
3
0
AbderrahmanSkiredj1/ahadith_translation_34k
圣训翻译
自然语言处理
该数据集包含三个特征:文本(text)、标签(label)和提示(prompt),数据类型均为字符串。数据集包含一个训练集(train),大小为56339232字节,包含34088个样本。下载大小为19500537字节,数据集总大小为56339232字节。数据集的任务类别为翻译(translation),语言为阿拉伯语(ar)。
Hugging Face
2024-07-15 更新
6
0
artfultom/dataset_from_groq
自然语言处理
文本校正
俄罗斯语拼写校正数据集,包含1200对俄语句子,其中每对句子包含一个错误版本(input)和一个正确版本(target)。这些句子通常是由电影名称或演员名字组成的。该数据集适用于拼写和语法错误修正、语音识别后处理以及文本自动校正模型的训练。
Hugging Face
2025-10-12 更新
4
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广