全国咨询热线:4008-365-895 | 申请试用 |
移动恩讯舆情 | 收藏本站| 网站地图:(XML /HTML)
当前位置:首页 > 舆情监测动态 >
【恩讯舆情系统】如何收集舆情信息并分析
2018-01-09    点击频次:    发布人:恩讯舆情监测中心
     面对舆情数据的收集分析,首先我们要考虑到网上庞大的信息量,仅依靠人工的方法难以应对网上海量信息的收集和处理,需要加强相关信息技术的研究,形成一套自动化的网络舆情分析系统,及时应对网络舆情,由被动防堵,化为主动梳理、引导。这样的系统应该具备以下功能:
  首先是舆情分析引擎。这是舆情分析系统的核心功能,包括:
1、热点话题、敏感话题识别,可以根据新闻出处权威度、评论数量、发言时间密集程度等参数,识别出给定时间段内的热门话题。利用关键字布控和语义分析,识别敏感话题。
2、倾向性分析,对于每个话题,对每个发信人发表的文章的观点、倾向性进行分析与统计。
3、主题跟踪,分析新发表文章、贴子的话题是否与已有主题相同。
4、自动摘要,对各类主题,各类倾向能够形成自动摘要。
5、趋势分析,分析某个主题在不同的时间段内,人们所关注的程度。
6、突发事件分析,对突发事件进行跨时间、跨空间综合分析,获知事件发生的全貌并预测事件发展的趋势。
7、报警系统,对突发事件、涉及内容安全的敏感话题及时发现并报警。
8、统计报告,根据舆情分析引擎处理后的结果库生成报告,用户可通过浏览器浏览,提供信息检索功能,根据指定条件对热点话题、倾向性进行查询,并浏览信息的具体内容,提供决策支持。
  其次是自动信息采集功能。现有的信息采集技术主要是通过网络页面之间的链接关系,从网上自动获取页面信息,并且随着链接不断向整个网络扩展。目前,一些搜索引擎使用这项技术对全球范围内的网页进行检索。舆情监控系统应能根据用户信息需求,设定主题目标,使用人工参预和自动信息采集结合的方法完成信息收集任务。
  第三是数据清理功能。对收集到的信息进行预处理,如格式转换、数据清理,数据统计。对于新闻评论,需要滤除无关信息,保存新闻的标题、出处、发布时间、内容、点击次数、评论人、评论内容、评论数量等。对于论坛BBS,需要记录帖子的标题、发言人、发布时间、内容、回帖内容、回帖数量等,最后形成格式化信息。条件允许时,可直接针对服务器的数据库进行操作。
  舆情分析系统的核心技术在于舆情分析引擎,涉及的最主要的技术包括文本分类、聚类、观点倾向性识别、主题检测与跟踪、自动摘要等计算机文本信息内容识别技术。这些技术一向是国内外信息工作者关注的领域。文本检索会议(TREC)、情报检索专业组会议(SIGIR)、文本检测与跟踪会议(TDT)等都是展示此类技术最新研究成果的最主要的国际会议和论坛。其中基于关键词统计分析方法的技术相对比较成熟,但在其有效性方面还有很大的提高空间。
  近年来,专家学者一直在研究更加有效的方法,其中基于语义的内容识别方法是当前研究的重中之重,虽然也取得了较大进展,但仍存在很多问题和困难需要克服。为了增加我国网络信息控制能力,我们必须迎难而上,加强相关技术的研究。
恩讯舆情监测系统

立即注册 免费试用 TRIAI FOR FREE

联系恩讯 CONDADT US

  • 北京CBD朝阳区慈云寺住邦2000四号楼1801
  • 4008-365-895

恩讯名片!