大数据舆情监测分析怎么做?

发布网友 发布时间:2022-04-21 04:39

我来回答

2个回答

热心网友 时间:2022-06-18 00:53

由于舆情数据存在于互联网的海量文本数据之中,所以进行舆情数据分析,主要用到的是文本分析的方法。因为文本数据通常是非结构化的,在拿到文本数据之后的一个关键环节是要将其转化为能被计算机理解和处理的结构化数据,才能进一步对其进行完整、系统的处理分析,提炼出有意义的部分。

大数据舆情分析方法
1.数据采集
明确分析的目的和需求后,通过不同来源渠道采集数据。
2.文本清洗和预处理
文本清洗首要是把噪音数据清洗掉,然后根据需要对数据进行重新编码进行预处理。
3.分词
在实际进行分词的时候,结果中可能存在一些不合理的情况。因此,在基于算法和中文词库建成分词系统后,还需要不断通过训练来提升分词的效果,如果不能考虑到各种复杂的汉语语法情况,算法中存在的缺陷很容易影响分词的准确性。
4.词频和关键词
词频就是某个词在文本中出现的频次。简单来说,一个词在文本中出现的频次越高,这个词在文本中就越重要,就越有可能是该文本的关键词。
5.语义网络分析
语义网络分析是指筛选统计出高频词以后,以高频词两两之间的共现关系为基础,将词与词之间的关系进行数值化处理,再以图形化的方式展示词与词之间的结构关系。这样一个语义网络结构图,可以直观的对高频词的层级关系、亲疏程度进行分析展现。
6.情感分析
情感分析,主要是分析具有情感成分词汇的情感极性(即情感的正性、中性、负性)和情感强烈程度,然后计算出每个语句的总值,判定其情感类别。还可以综合全文本中所有语句,判定总舆情数据样本的整体情感倾向。

热心网友 时间:2022-06-18 00:54

首先要拿到数据,然后抽取关键字,对关键字进行统计

声明声明:本网页内容为用户发布,旨在传播知识,不代表本网认同其观点,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。E-MAIL:11247931@qq.com