清华大学 本次发布的数据集 Qilin, Qilin数据集是由清华大学和小红书公司合作创建的多模态信息检索数据集。该数据集包含来自小红书平台上超过3000万月活跃用户的APP级信息发现会话,涵盖了搜索、DQA(深度查询回答)和推荐等多种场景。Qilin特色在于收集了丰富的APP级上下文信号和真实用户反馈,有助于深入分析用户状态转换、回访和查询重构等行为,以建模用户满意度和长期留存。数据集中的用户会话包含文本和图像内容,适用于多种检索场景下的复杂查询意图理解和会话级跨模态匹配任务。
README 内容:
关于 清华大学 , 清华大学,位于中国北京,是一所享誉全球的顶尖研究型大学,以其深厚的学术底蕴和杰出的科研能力而著称。
关于 arXiv , arXiv 是一个免费分发服务和开放获取的学术文章档案库,涵盖了物理学、数学、计算机科学、定量生物学、定量金融、统计学、电气工程和系统科学以及经济学等领域。该网站上的材料并未经过 arXiv 的同行评审。





_1769672084863.jpg)