User Intent Prediction Dataset
收藏资源简介:
该数据集旨在让智能代理理解和学习跨多个移动应用的高级用户意图,例如规划晚餐可能需要使用Yelp、Maps、SMS等应用。数据集包含了训练智能代理所需的各种序列数据和模型。
This dataset is designed to enable intelligent agents to comprehend and learn advanced user intents across multiple mobile applications. For instance, planning a dinner might necessitate the use of apps such as Yelp, Maps, and SMS. The dataset encompasses a variety of sequential data and models essential for training intelligent agents.
数据集概述
数据集目标
本数据集旨在让智能代理理解和学习高级用户意图,这些意图跨越多个移动应用,例如规划晚餐可能需要使用Yelp、Maps、SMS等应用。
数据集内容
App2Vec
- 使用doc2vec对应用描述进行训练,将每个应用投影到语义空间。
- 收集智能手机上应用调用的流数据,将其视为语料库,并应用word2vec。
App序列数据
- 包含训练、测试和验证分割的app序列文件:
train.apps.int,test.apps.int,dev.apps.int。 - B/I/O标签信息文件:
train.labels.int,test.labels.int,dev.labels.int。 - CRFSuite序列标注模型。
数据集资源
- 从19名用户Android手机收集的应用调用序列 (
R1.csv)。 - 清理后的应用序列,移除了与意图无关的应用,并由参与者标注用户意图 (
R2.csv)。 - 应用级别的语音命令,包括手动转录和Google ASR最佳假设 (
R3.csv)。
引用信息
若在研究中使用此数据集,请引用以下工作:
@CONFERENCE {sunSLT2016, author = "Ming Sun, Aasish Pappu, Yun-Nung Chen, Alexander I Rudnicky", title = "Weakly Supervised User Intent Detection for Multi-Domain Dialogues", booktitle = "IEEE Workshop on Spoken Language Technology", year = "2016", publisher = "IEEE" }




