热门标签 | HotTags
当前位置:  开发笔记 > 后端 > 正文

【分享】细粒度的评论标注语料

数据简介用户评论分析可以帮助商家倾听用户声音,分析用户满意度,从而及时进行营销策略制定、危机公关等商业决策。但现在的评论语料主要对评论做褒义贬义的粗粒度标注,而对评论内容本身无法理解。我们提供了一个

数据简介


用户评论分析可以帮助商家倾听用户声音,分析用户满意度,从而及时进行营销策略制定、危机公关等商业决策。但现在的评论语料主要对评论做褒义/贬义的粗粒度标注,而对评论内容本身无法理解。


我们提供了一个细粒度的评论标注语料,详细标注了用户评论中的评价对象和评价特征。本语料可以用于情感计算、评论抽取、口碑分析等用途。


数据格式


本语料以xml的形式提供,数据量有160多M大小。共收集了36万篇来自各大汽车论坛的帖子,并人工区分出2.7万篇包含用户对汽车评论的帖子,然后做了细粒度的标注,得到5.7万条标注结果。标注结果包括评价对象以及该对象的评价特征。


评价对象包括:

1)厂商:一汽、大众、日产、本田等

2)品牌:奔驰、宝马、奥迪、凯美瑞等

3)型号:ES240、1.8T手自一体等

4)属性:整体、外观、油耗、动力、性价比、售后、内饰等


评价特征包括:

1)评价内容:用户对厂商、品牌、型号或者属性的主观性评价描述,例如“省油”、“好看”

2)描述值:用户对属性的客观性描述,例如”油耗是12”

3)倾向性:用户评价是褒义、贬义还是中性


标注时还考虑了很多细节:

1)如果评论里包含多个评价对象,则分别进行标注。例如对“某车外观挺好看,就是空间不够宽敞”,分别对某车外观和某车空间进行了标注

2)对用户没有明确说出来的隐含对象,也做了标注。例如对“某车很漂亮”,标注出属性“外观”

3)对比较句也做了标注。例如“某车的内饰不如某车丰富”

4)对用户评价适用的条件也做了标注。例如“某车在跑高速的时候很省油”,将“跑高速”也做了标注

5)记录了程度副词。例如“很漂亮”、“太贵”


数据样例


标注例子1:蒙迪欧致胜2.3豪华版在市区开的时候,油耗到14了,太高了!


品牌 型号 属性 描述值 评价内容 倾向性 条件 原帖是否没明确说出该属性
蒙迪欧 致胜2.3豪华版 油耗 14 太高 贬义 市区开 0(明确说出了)


标注例子2:跟迈腾和奥迪相比,速腾太省油了


品牌 属性 对比品牌 评价内容 倾向性 原帖是否没明确说出该属性
速腾 油耗 奥迪 省油 褒义 1(没明确说出)
速腾 油耗 迈腾 省油 褒义 1(没明确说出)


数据下载:http://www.datatang.com/data/15722

数据堂-数据共享服务平台



推荐阅读
  • Android 九宫格布局详解及实现:人人网应用示例
    本文深入探讨了人人网Android应用中独特的九宫格布局设计,解析其背后的GridView实现原理,并提供详细的代码示例。这种布局方式不仅美观大方,而且在现代Android应用中较为少见,值得开发者借鉴。 ... [详细]
  • 优化ListView性能
    本文深入探讨了如何通过多种技术手段优化ListView的性能,包括视图复用、ViewHolder模式、分批加载数据、图片优化及内存管理等。这些方法能够显著提升应用的响应速度和用户体验。 ... [详细]
  • 本文介绍了如何利用JavaScript或jQuery来判断网页中的文本框是否处于焦点状态,以及如何检测鼠标是否悬停在指定的HTML元素上。 ... [详细]
  • 本文详细介绍了如何使用PHP检测AJAX请求,通过分析预定义服务器变量来判断请求是否来自XMLHttpRequest。此方法简单实用,适用于各种Web开发场景。 ... [详细]
  • 本文详细介绍了如何在Linux系统上安装和配置Smokeping,以实现对网络链路质量的实时监控。通过详细的步骤和必要的依赖包安装,确保用户能够顺利完成部署并优化其网络性能监控。 ... [详细]
  • 本文探讨了 RESTful API 和传统接口之间的关键差异,解释了为什么 RESTful API 在设计和实现上具有独特的优势。 ... [详细]
  • 本文详细介绍了Java编程语言中的核心概念和常见面试问题,包括集合类、数据结构、线程处理、Java虚拟机(JVM)、HTTP协议以及Git操作等方面的内容。通过深入分析每个主题,帮助读者更好地理解Java的关键特性和最佳实践。 ... [详细]
  • 在当前众多持久层框架中,MyBatis(前身为iBatis)凭借其轻量级、易用性和对SQL的直接支持,成为许多开发者的首选。本文将详细探讨MyBatis的核心概念、设计理念及其优势。 ... [详细]
  • PyCharm下载与安装指南
    本文详细介绍如何从官方渠道下载并安装PyCharm集成开发环境(IDE),涵盖Windows、macOS和Linux系统,同时提供详细的安装步骤及配置建议。 ... [详细]
  • Explore a common issue encountered when implementing an OAuth 1.0a API, specifically the inability to encode null objects and how to resolve it. ... [详细]
  • 本文详细介绍了如何解决Uploadify插件在Internet Explorer(IE)9和10版本中遇到的点击失效及JQuery运行时错误问题。通过修改相关JavaScript代码,确保上传功能在不同浏览器环境中的一致性和稳定性。 ... [详细]
  • 本文详细介绍了如何在BackTrack 5中配置和启动SSH服务,确保其正常运行,并通过Windows系统成功连接。涵盖了必要的密钥生成步骤及常见问题解决方法。 ... [详细]
  • This guide provides a comprehensive step-by-step approach to successfully installing the MongoDB PHP driver on XAMPP for macOS, ensuring a smooth and efficient setup process. ... [详细]
  • 探讨如何高效使用FastJSON进行JSON数据解析,特别是从复杂嵌套结构中提取特定字段值的方法。 ... [详细]
  • 导航栏样式练习:项目实例解析
    本文详细介绍了如何创建一个具有动态效果的导航栏,包括HTML、CSS和JavaScript代码的实现,并附有详细的说明和效果图。 ... [详细]
author-avatar
业余爱好者
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有