旅游酒店好评热词前20放在csv中

该博客通过Python库pandas和jieba对景区评论数据进行处理,首先读取Excel表格并按景区名称排序,然后整合各景区的评论内容。接着,提取每个景区的评论关键词,并统计热度,最后输出热度前20的评论热词,并将结果保存为CSV文件。整个过程涉及数据读取、文本处理、关键词提取和文件导出等步骤。

1.库的调用

import pandas as pd
import jieba 
import re

2.读取excel的表

#   df = pd.read_excel(**r+Excel路径**<直接在文件处复制路径>)
df = pd.read_excel(r"C:\Users\dell\Desktop\oc-ML\机器学习\week9\附件1\景区评论.xlsx")
df

3.按景区民称排序 -----用df.sort_values(' ',ascending=True)

data_1 = df.sort_values('景区名称',ascending = True)
data_1

4.把第0行的评论内容打出来列表的形式

data_1['评论内容'][0]

5.把整个评论内容打出来循环的

keywords_n = {}
word = ""
words = ""
for i in range(len(data_1)):       #在data_1的长度之内 i:是循环第几行
    if i == 0:                #打印第0行的评论内容
        word = data_1['评论内容'][i]
    if i>0 and data_1['景区名称'][i] == data_2['景区名称'][i-1]:         
        word = word + data_1['评论内容'][i]            #在景区名称相同情况下,第0行+第1行,后面的同理,像是计算1+2+3+4+5·····+100    ——————这是同一景区所有评论内容
    if i>0 and data_1['景区名称'][i] != data_2['景区名称'][i-1]:
        key = data_1['景区名称'][i-1]       #这是将不同景区区分开
        t = re.findall(r"[\u4E00-\u9FA5]",word)         #用正则表达式(re.findall())
        for j in t:
            words = words + j
        keywords_n[key] = keywords_n.get(key,words)      #相应景区对应的评论内容
        word = data_1['评论内容'][i]
        words =""
    if i == len(data_1)-1:           #这是最后一行的数据
        key = data_1['景区名称'][i]
        t = re.findall(r"[\u4E00-\u9FA5]",word)
        for j in t:
            words = words + j
        keywords_n[key] = keywords_n.get(key,words)

6.打印出所有景区

keywords_n.keys()

7.把所有景区的所有评论内容都打印出来

keywords_n

8.取热度前二十的词

for key in keywords_n.keys():
    num ={}
    words =jieba.lcut(keywords_n[key],cut_all=False)          #
    for w in words:
        if len(w)==1:
            continue
        else:
            num[w] = num.get(w,0)+1
    nnn=[]
    for s in num.keys():
        nnn.append(num[s])              #对热度词进行出栈操作
    df = pd.DataFrame()            #列的形式打印出来
    df['评论热词'] =num.keys()
    df['热度']=nnn
    df1 = df.sort_values(['热度'],ascending = 0).head(20)      #.head(20)前20

9.当前位置打出df1热度排行

df1

10.把所得数据导入到CSV文件

df1.to_csv(r"C:\Users\dell\Desktop\oc-ML\机器学习\week10\评论热词{}.csv".format(key),index = False)
内容概要:本文系统研究了在有限控制集约束下,三相并网逆变器中电流与功率双模态模型预测控制(MPC)的等效机理及其性能边界。通过构建精确的预测模型,设计合理的代价函数,并结合Simulink仿真与Matlab代码实现,深入分析了电流预测控制与功率预测控制两种策略在动态响应速度、稳态精度、谐波抑制能力和抗扰性等方面的差异与内在联系。研究揭示了在特定系统参数和运行条件下,两种控制模式之间的等效转化机制,并界定了各自的适用范围与性能极限。同时,探讨了多模态控制的切换逻辑、实时性优化及预测模型不确定性对控制性能的影响,旨在提升逆变器在复杂电网环境下的综合控制品质与鲁棒性。; 适合人群:具备电力电子、自动控制或新能源并网等相关专业背景,熟悉Matlab/Simulink仿真环境,从事研究生及以上层次科研或从事高端电力电子装备研发的工程技术人员。; 使用场景及目标:①深入理解模型预测控制在并网逆变器中的具体实现方法与理论基础;②掌握电流与功率双模态MPC控制器的设计、仿真建模与性能对比评估流程;③为高动态、高精度并网控制系统的方案选型、参数优化与工程化应用提供坚实的理论依据和技术参考。; 阅读建议:建议结合所提供的Simulink仿真模型与Matlab源代码进行同步实验验证,重点关注预测模型的建立过程、控制律的数学推导以及不同工况下的仿真结果对比分析,宜配合现代控制理论、电力电子变换技术及并网标准等相关资料进行系统性学习。
内容概要:本文针对高渗透率电动汽车随机充电行为对配电网承载能力造成的脆弱性问题,提出了一种基于Matlab代码实现的广义需求响应协同优化研究方法。通过构建涵盖一次设备安全、负荷平稳性、电能质量和系统效率的多维评价指标体系,结合熵权法与模糊综合评价模型,科学量化不同渗透率下电动汽车接入对配电网的综合影响。研究深入分析了电动汽车无序充电对电网电能质量、负荷特性及设备安全的冲击机理,揭示了配电网承载能力的脆弱性根源,并通过仿真手段评估系统在多种工况下的响应特性。最终,研究旨在挖掘配电网承载能力极限,提出基于广义需求响应的协同优化策略,以提升电网韧性、运行效率与安全稳定性。; 适合人群:具备电力系统基础知识和Matlab编程能力,从事新能源、智能电网、电动汽车等领域研究的研究生、科研人员及工程技术人员。; 使用场景及目标:①用于评估高比例电动汽车接入对配电网安全性与稳定性的影响;②为制定有效的广义需求响应策略提供模型支持与仿真工具;③支撑相关课题研究、论文复现与科研项目开发。; 阅读建议:文中提供的完整资源可通过指定公众号或百度网盘链接获取,包含仿真代码、模型文件与参考文献,建议结合目录结构系统学习,并关注后续关于极端工况优化与系统可靠性提升的研究方向。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值