遇见数据集

kumarmanishiiit/multilingual_dataset

收藏
Hugging Face2025-09-12 更新2025-10-25 收录
官方服务:

资源简介:

这是一个包含英语、比哈里语、博杰普尔语和印地语的文本生成数据集,适用于文本生成任务,数据集大小在1B到10B之间。

This is a text generation dataset containing English, Bihari, Bhojpuri, and Hindi, suitable for text generation tasks, with a size ranging from 1B to 10B.

提供机构:
kumarmanishiiit
二维码
社区交流群
二维码
科研交流群
商业服务