登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Sample tweets text before and after preprocessing steps.
Sample tweets text before and after preprocessing steps.
收藏
Figshare
2022-08-24 更新
2026-04-28 收录
社交媒体文本处理
自然语言处理
数据链接:
https://figshare.com/articles/dataset/Sample_tweets_text_before_and_after_preprocessing_steps_/20605655
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Sample tweets text before and after preprocessing steps.
应用场景:
创建时间:
2022-08-24
相关数据集
op_dataset.pkl
编程社区
自然语言处理
该数据集包含格式化的StackOverflow帖子,包括问题、答案和帖子统计信息(如接受状态、星数和点赞数等)。对于包含代码片段的答案,还使用简单解析器提取程序语法树结构和草图。为了将数据输入序列到序列模型,用户可能需要运行适合自己需求的NLP预处理管道。
github
2020-12-15 更新
21
0
lanhf/mailong25
自然语言处理
问答系统
--- dataset_info: features: - name: context dtype: string - name: question dtype: string - name: answer struct: - name: answer_end dtype: int64 - name: answer_start
Hugging Face
2024-05-11 更新
15
0
lman63/munir2
自然语言处理
对话系统
这是一个包含指令、输入和响应字段的数据集,适用于训练和测试机器学习模型。数据集分为训练集和测试集,其中训练集有4个样本,测试集有1个样本。
Hugging Face
2025-02-09 更新
11
0
open-llm-leaderboard-old/details_AA051610__VA
自然语言处理
模型评估
该数据集是在Open LLM Leaderboard上对模型AA051610/VA进行评估时自动创建的。数据集由61个配置组成,每个配置对应一个评估任务。数据集是从1次运行中创建的,每次运行在每个配置中表示为特定的分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,名为results的配置存储了运行的所有聚合结果,用于在Open LLM Leaderboard上计算和显示聚合指
Hugging Face
2023-10-11 更新
19
0
open-llm-leaderboard-old/details_fradinho__llama-mistral
模型评估
自然语言处理
--- pretty_name: Evaluation run of fradinho/llama-mistral dataset_summary: "Dataset automatically created during the evaluation run of model\ \ [fradinho/llama-mistral](https://huggingface.co/fradin
Hugging Face
2024-04-11 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广