登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Word frequency lists of Chinese.
Word frequency lists of Chinese.
收藏
NIAID Data Ecosystem
2026-03-06 收录
自然语言处理
语言学
数据链接:
https://figshare.com/articles/dataset/_Word_frequency_lists_of_Chinese_/517680
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Word frequency lists of Chinese.
应用场景:
创建时间:
2010-06-02
相关数据集
HAERAE-HUB/QARV-preview
区域研究
语言学
QARV(带有地区差异的问题和答案)项目旨在收集展示不同国家地区差异的问题和答案。当前版本包含1k个问题,并正在为美国和韩国添加答案。
Hugging Face
2024-04-04 更新
20
0
AC2-VWCV101 - Numerals of West Coast Malekula languages
语言学
数字词汇
1 page manuscript. -- Numerals of West coast of Malekula, N. Hebrides. Espiegle Bay - Alau - Lambumbu - Bugeor - North side of South West Bay - South side of South West Bay - Milep - Toman or Urso? Co
Research Data Australia
15
0
Dataset of five narratives split (1200 tokens) into events
自然语言处理
事件分割
This repository contains 5 textual narratives split into events by diffirent Large Language Models
DataCite Commons
2024-07-08 更新
9
0
argilla-warehouse/personahub-fineweb-edu-4-embeddings
自然语言处理
文本嵌入
该数据集通过使用Alibaba-NLP/gte-large-en-v1.5模型从句子转换器中获取了argilla-warehouse/personahub-fineweb-edu-4-dedup数据集的嵌入。数据集包含一个pipeline.yaml文件,可用于在distilabel中使用distilabel CLI重现生成数据集的管道。数据集的特征包括id、persona、model_name_e
Hugging Face
2024-09-10 更新
16
0
prli/pubmed-full_chopped_pyt_llama_alpha_0-1
医学文本处理
自然语言处理
该数据集包含文本、元信息、句子扰动数量以及文档统计信息。文本是数据集的主要特征,元信息中包含了数据集的集合名称。文档统计信息详细记录了文档的优势分数、长度变化比例、原始句子长度、替换后的句子长度等多个统计数据。数据集分为验证集,验证集大小为4000个样本。
Hugging Face
2025-10-14 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广