HW1-tabular-dataset
收藏资源简介:
这个数据集包含创建者书架上的书籍信息。数据集中选录了15本小说和15本非小说类书籍。每本书的多个属性被记录,包括页数、厚度、阅读状态(是否开始阅读、是否未读)和推荐状态(是否推荐给所有人)。原始数据集分为30个示例,并扩充到了300个额外示例。数据集的特性和分割方式都有详细描述,数据集名为“我的家书架上的书籍 - 表格数据”。
This dataset contains information about books on the creator's bookshelf. It includes 15 fiction books and 15 non-fiction books. Multiple attributes of each book are recorded, including page count, thickness, reading status (whether reading has started or the book is unread), and recommendation status (whether it is recommended to everyone). The original dataset consists of 30 samples and has been augmented with 300 additional samples. The characteristics and splitting methods of the dataset are described in detail, and the dataset is named "My Home Bookshelf Books - Tabular Data".
数据集概述
基本信息
- 数据集名称:Book Tabular Data
- 创建者:Jennifer Evans
- 语言:英语
- 许可证:MIT
数据集详情
该数据集收集了书架上书籍的测量数据,包括15本小说和15本非小说类书籍。记录了每本书的页数、厚度、阅读状态(已读/已开始/未读)以及是否推荐给所有人。原始数据包含30个样本,并通过增强生成300个额外样本。
用途
直接用途
- 评估书籍长度和厚度与阅读和推荐之间的相关性。
- 判断书籍是小说还是非小说类。
超出范围的用途
- 用于其他评估,如人们购买的书籍指标或对小说与非小说的偏好。
数据结构
特征
- FictionorNonfiction(字符串):书籍类型(小说或非小说)。
- NumPages(整数):页数。
- ThicknessInches(浮点数):厚度(英寸)。
- ReadUnfinishedorUnread(字符串):阅读状态(已读/已开始/未读)。
- RecommendtoEveryone(字符串):是否推荐给所有人。
数据划分
- original:30个样本,1345字节。
- augmented:300个样本,13747字节。
技术信息
- 下载大小:9114字节
- 数据集大小:15092字节
数据创建
创建动机
评估书架上书籍的模式,特别是与书籍类型(小说或非小说)相关的模式。
数据来源
数据直接来自书架上的选定书籍,通过测量收集。
数据处理
数据收集后通过抖动(jittering)进行增强。
数据生产者
Jennifer Evans。




