影刀RPA 自动化舆情监控关键词预警与报告生成作者林焱写在前面品牌负面舆情一旦爆发几个小时内可能蔓延全网。靠人工每天刷微博、知乎、新闻根本来不及。影刀可以帮你搭一套7×24小时的舆情监控系统定时采集多个平台的内容→关键词匹配→情感初步判断→有风险立即推送告警。本文从零到一搭建这套系统。一、系统架构拼多多店群自动化报活动上架数据来源 ├── 微博关键词搜索 ├── 知乎话题搜索 ├── 新闻网站RSS订阅 └── 百度指数品牌声量 处理流程 采集数据 → 关键词过滤 → 情感判断 → 风险评分 → 告警/汇总报告二、RSS新闻监控最简单稳定的方案很多新闻网站提供RSS订阅不需要爬虫就能获取内容是舆情监控的首选数据源。importfeedparserimportrequestsimportjsonimporttimeimportdatetimeimportrefromcollectionsimportdefaultdictdefmonitor_rss_feeds(feed_urls,keywords,lookback_hours24): 监控RSS新闻中的关键词 feed_urls: RSS地址列表 keywords: 监控关键词列表 lookback_hours: 只看最近N小时的内容 cutoff_timedatetime.datetime.now()-datetime.timedelta(hourslookback_hours)matched_articles[]forfeed_urlinfeed_urls:try:feedfeedparser.parse(feed_url)forentryinfeed.entries:# 解析发布时间ifhasattr(entry,published_parsed):importcalendar pub_timedatetime.datetime.fromtimestamp(calendar.timegm(entry.published_parsed))else:pub_timedatetime.datetime.now()# 只处理时间窗口内的文章ifpub_timecutoff_time:continue# 标题摘要全文搜索full_textf{entry.get(title,)}{entry.get(summary,)}matched_keywords[kwforkwinkeywordsifkwinfull_text]ifmatched_keywords:matched_articles.append({来源:feed.feed.get(title,feed_url),标题:entry.get(title,),摘要:entry.get(summary,)[:200],链接:entry.get(link,),发布时间:pub_time.strftime(%Y-%m-%d %H:%M),命中关键词:, .join(matched_keywords),})exceptExceptionase:print(fRSS采集失败{feed_url}-{e})returnmatched_articles# 配置RSS源RSS_FEEDS[https://36kr.com/feed,# 36氪https://www.huxiu.com/rss/,# 虎嗅https://www.ifanr.com/feed,# 爱范儿https://news.qq.com/rss/tech.xml,# 腾讯科技# 还可以添加各平台的搜索RSS如百度新闻、Google News的搜索结果RSS]# 监控关键词KEYWORDS[品牌A,品牌A食品,品牌A安全,公司名称,产品名]articlesmonitor_rss_feeds(RSS_FEEDS,KEYWORDS)print(f发现{len(articles)}篇相关文章)三、情感分析判断正面/负面fromsnownlpimportSnowNLP# pip install snownlp# 负面词汇词典可自定义扩展NEGATIVE_WORDS[投诉,举报,欺诈,虚假,问题,缺陷,召回,致癌,危险,事故,处罚,罚款,违规,索赔,退款,维权,曝光,负面,差评,中毒,过期]POSITIVE_WORDS[好评,推荐,优质,创新,突破,荣获,获奖,上市,合作,融资,获批,认证]defanalyze_sentiment(text): 情感分析返回风险级别 returns: (sentiment_score, risk_level) # SnowNLP情感得分0-1越接近1越正面try:sentiment_scoreSnowNLP(text).sentimentsexcept:sentiment_score0.5# 无法判断时返回中性# 负面词计数negative_countsum(1forwordinNEGATIVE_WORDSifwordintext)positive_countsum(1forwordinPOSITIVE_WORDSifwordintext)# 综合判断风险级别ifnegative_count3orsentiment_score0.2:risk_level高风险elifnegative_count1orsentiment_score0.4:risk_level中风险elifpositive_count2orsentiment_score0.7:risk_level正面else:risk_level中性returnsentiment_score,risk_level,negative_count# 对采集到的文章进行情感分析forarticleinarticles:score,risk,neg_countanalyze_sentiment(article[标题] article[摘要])article[情感得分]round(score,3)article[风险级别]risk article[负面词数量]neg_count# 按风险排序articles.sort(keylambdax:[高风险,中风险,中性,正面].index(x.get(风险级别,中性)))四、实时告警推送defsend_alert(articles,webhook_url): 推送高风险内容告警 high_risk[aforainarticlesifa.get(风险级别)高风险]ifnothigh_risk:returnalert_contentf## ⚠️ 舆情风险告警\n\nalert_contentf发现 **{len(high_risk)}** 条高风险内容请立即关注\n\nfori,articleinenumerate(high_risk[:5],1):# 最多显示5条alert_contentf**{i}. [{article[标题]}]({article[链接]})**\nalert_contentf 来源{article[来源]}| 时间{article[发布时间]}\nalert_contentf 命中关键词{article[命中关键词]}\nalert_contentf{article[摘要][:100]}...\n\niflen(high_risk)5:alert_contentf\n 还有{len(high_risk)-5}条未展示请查看完整报告\n# 发送到企业微信群importrequests payload{msgtype:markdown,markdown:{content:alert_content}}resprequests.post(webhook_url,jsonpayload)print(f告警已推送{resp.json()})ALERT_WEBHOOKhttps://qyapi.weixin.qq.com/cgi-bin/webhook/send?key你的keysend_alert(articles,ALERT_WEBHOOK)五、每日舆情汇总报告importopenpyxlfromopenpyxl.stylesimportPatternFill,Font,Alignmentdefgenerate_daily_report(articles,output_fileNone):生成每日舆情汇总Excel报告ifoutput_fileisNone:date_strdatetime.datetime.now().strftime(%Y%m%d)output_filef舆情监控报告_{date_str}.xlsxwbopenpyxl.Workbook()# Sheet1概览ws_summarywb.active ws_summary.title每日概览totallen(articles)risk_countsdefaultdict(int)forainarticles:risk_counts[a.get(风险级别,未知)]1ws_summary.append([舆情监控日报,datetime.datetime.now().strftime(%Y-%m-%d)])ws_summary.append([])ws_summary.append([风险级别,数量,占比])forrisk_levelin[高风险,中风险,中性,正面]:countrisk_counts.get(risk_level,0)ws_summary.append([risk_level,count,f{count/total*100:.1f}%iftotalelse0%])ws_summary.append([合计,total,100%])# Sheet2明细ws_detailwb.create_sheet(明细数据)headers[来源,标题,风险级别,情感得分,命中关键词,发布时间,摘要,链接]ws_detail.append(headers)# 设置标题样式forcellinws_detail[1]:cell.fontFont(boldTrue)cell.fillPatternFill(start_color1565C0,fill_typesolid)cell.fontFont(boldTrue,colorFFFFFF)# 风险级别对应颜色risk_colors{高风险:FF6B6B,中风险:FFB347,中性:E0E0E0,正面:90EE90}forarticleinarticles:row[article.get(来源,),article.get(标题,),article.get(风险级别,),article.get(情感得分,),article.get(命中关键词,),article.get(发布时间,),article.get(摘要,),article.get(链接,),]ws_detail.append(row)# 按风险级别着色riskarticle.get(风险级别,中性)colorrisk_colors.get(risk,E0E0E0)fillPatternFill(start_colorcolor,fill_typesolid)forcellinws_detail[ws_detail.max_row]:cell.fillfill# 调整列宽ws_detail.column_dimensions[B].width40ws_detail.column_dimensions[G].width50ws_detail.column_dimensions[H].width50wb.save(output_file)print(f舆情报告已生成{output_file})returnoutput_fileTEMU店群矩阵自动化运营核价报活动六、完整定时执行流程defrun_sentiment_monitoring():完整的舆情监控流程print(f[{datetime.datetime.now().strftime(%Y-%m-%d %H:%M)}] 开始舆情监控...)# 1. 采集articlesmonitor_rss_feeds(RSS_FEEDS,KEYWORDS,lookback_hours2)# 2. 情感分析forarticleinarticles:textarticle[标题] article[摘要]score,risk,neg_countanalyze_sentiment(text)article.update({情感得分:score,风险级别:risk,负面词数量:neg_count})# 3. 告警send_alert(articles,ALERT_WEBHOOK)# 4. 每天早上8点生成日报ifdatetime.datetime.now().hour8:report_filegenerate_daily_report(articles)print(f日报已生成{report_file})print(f监控完成共分析{len(articles)}条内容)# 在影刀中设置每2小时执行一次run_sentiment_monitoring()七、踩坑记录坑1SnowNLP对网络语言识别不准SnowNLP是基于微博语料训练的对中规中矩的新闻文章识别准确率约70%。提高准确率的方法结合自定义负面词典负面词数量比情感得分更可靠。坑2RSS源有些不稳定部分媒体的RSS地址会变化或停更。建议定期检查RSS是否还有更新超过7天没新内容的RSS源标记为失效。坑3中文分词影响关键词匹配直接字符串匹配品牌A in text可以用但对品/牌/A这类被分词打散的情况无效。建议同时用jieba分词后匹配品牌A in .join(jieba.cut(text))。坑4同一条内容被多个源重复收录同一篇文章可能出现在多个RSS源里需要URL去重。用文章链接的MD5作为唯一标识已处理的链接存到文件或SQLite里避免重复告警。总结舆情监控系统的三个核心数据采集RSS是最稳的免费方案、情感判断规则词典SnowNLP双保险、及时告警企业微信群机器人实时推送。搭好后高风险内容第一时间到手机不再靠人工刷屏。署名林焱
企业数字化 ERP 产品动态
相关推荐
业务分析岗位适合考哪些证书?懂业务也要懂工具和AI 业务分析岗位的核心价值是“把业务问题翻译成数据问题,再把数据结论翻译回业务决策”。以下五类证书,对应业务分析不同维度的能力需求。一、数据分析类认证——指标、报表和业务洞察业务分析的基础是“看懂数据”。CDA认证是国内参与人数最多的数据分析认… · 2026/9/22 18:32:27
OpenClaw+Kimi K2.5+Moltbook企业级AI工作流部署指南 1. OpenClawKimi K2.5Moltbook部署方案概述这个组合堪称当前最强大的AI工作流解决方案之一。OpenClaw作为自动化控制中枢,Kimi K2.5提供核心AI能力,Moltbook则负责交互界面呈现。三者的结合可以打造出一个智能程度极高的工作助手系统。我在实际部署过程中… · 2026/9/25 23:40:00
WordPress开网站很慢?新手入门看这3点救急 WordPress开网站很慢?新手入门看这3点救急 网站被黑挂马,后台登录进去全是乱码,或者打开页面转圈圈半天不出内容,新手入门最怕遇到这种事。这种时候别慌,也别急着重装系统,90%的情况不是服务器挂了,而是你的代码或者配置拖了后腿。很多老… · 2026/9/27 2:09:43
全网最详细sqllab1-2关解析 关卡1
思路:提示get传参id尝试id1,正确返回用户名密码,尝试ida,无回显,确认为字符型尝试id1--,正常回显,可自主闭合id1 order by 4-- 不可以,order by 3可以,确认行数只回显示2个,根… · 2026/9/27 2:09:43
论文AI率高但重复率合格,适合用哪些免费降AI工具? 论文AI率高但重复率合格,适合用哪些免费降AI工具?
查重报告已经符合学校要求,AIGC报告却提示摘要或正文AI率高。你想改,又担心改完出现新的相似表述,把已经合格的重复率重新抬上去。工具同时宣传降重和降AI࿰… · 2026/9/27 2:09:36
天津定制网站建设商店设计避坑指南:5个安全注意事项保命 天津定制网站建设商店设计避坑指南:5个安全注意事项保命 域名和服务器配置一团糟,导致网站被黑、数据泄露,这是天津很多做定制商店的团队最容易踩的坑。 很多老板觉得只要页面好看就行,却忽略了底层的安全防护,结果上线不到一个月就被挂马。… · 2026/9/27 2:09:36
2026 重复率和 AI 率同时超标?一站式AI智能降重工具实测攻略 一、前言:2026 高校论文审核新难题随着高校学术审核体系不断升级,知网、维普等主流检测平台全面上线AIGC 智能检测功能,当代毕业生的论文写作与修改迎来双重考验。以往论文仅需攻克重复率超标问题,如今还要规避 AI 写作痕迹检测风… · 2026/9/27 2:09:30
上海建设网站制作避坑指南:报价透明与UI规范全解析 上海建设网站制作避坑指南:报价透明与UI规范全解析 域名解析指向错误,服务器响应超时,这两样东西搞不懂,你的上海建设网站制作项目就算彻底烂尾了。很多老板在找服务商谈 建站报价… · 2026/9/27 2:09:30
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现 简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01
汕头网站建设制作厂家避坑指南:5大注意事项救急 汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习 简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现 简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01
汕头网站建设制作厂家避坑指南:5大注意事项救急 汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习 简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01