首页/新闻资讯/正文详情

AI 引用来源监测:看 AI 摘要都引用了哪些站

发布时间:2026/9/27 2:04:37 来源:云帆数科 栏目:资讯中心
AI 引用来源监测:看 AI 摘要都引用了哪些站
做 GEO(生成式引擎优化)最常见的困惑是:内容发出去了,但 ChatGPT、Perplexity、AI Overview 到底引用了谁?没有数据就只能靠猜。这篇给一个数据化思路:用搜索接口拿带 AI 摘要模块的结果,把 AI 回答里出现的来源域名统计出来,和自然排名的域名分布做对比——AI 偏爱哪些站,一眼看得出来。和 09-10 的AI Overview 监测篇的分工:那篇回答哪些词会触发 AI 摘要(触发率),这篇回答AI 摘要引用了哪些来源(来源结构)。一个是开关监测,一个是引用资产盘点。前提先说清楚文档说明 search 端点在结果页出现 AI 摘要等模块时会一并返回(模块出现才有,不是每个词都有)。ai_overview属于这种可选模块,字段结构以实际返回为准——所以下面脚本的主逻辑是原样落盘 从返回里提取域名,不预设字段名,提取不到的记空值。口径见 SerpBase 官方文档对 ai_overview 模块的说明。脚本importcsv,json,pathlib,re,requestsfromdatetimeimportdate APIhttps://api.serpbase.dev/google/searchKEY你的 API KeyQUERIES[rust 还是 go,serp api 怎么选,免费 搜索 api]DOMAIN_REre.compile(rhttps?://([^/\\s\]))defserp(q:str)-dict:resprequests.post(API,headers{X-API-Key:KEY,Content-Type:application/json},json{q:q,hl:zh-CN,gl:cn},timeout30)returnresp.json()raw_dirpathlib.Path(ai_raw)raw_dir.mkdir(exist_okTrue)rows[]forqinQUERIES:dataserp(q)bodyjson.dumps(data,ensure_asciiFalse)# 1) 原样落盘:模块字段以实际返回为准,先攒数据再离线分析(raw_dir/f{date.today()}_{abs(hash(q))%99999}.json).write_text(body,encodingutf-8)# 2) 从整个返回体提取 http(s) 域名(含 AI 摘要模块里的引用)domains{d.lower().removeprefix(www.)fordinDOMAIN_RE.findall(body)}organicdata.get(organic,[])[:10]organic_domains{i.get(link,).split(/)[2]foriinorganicif://ini.get(link,)}rows.append({查询词:q,是否带AI摘要:ai_overviewinbody,全返回域名数:len(domains),自然结果域名数:len(organic_domains),})withopen(ai_citation.csv,w,newline,encodingutf-8-sig)asf:wcsv.DictWriter(f,fieldnames[查询词,是否带AI摘要,全返回域名数,自然结果域名数])w.writeheader()w.writerows(rows)print(已写入 ai_citation.csv,原始返回在 ai_raw/)跑两周后,把ai_raw/里的 JSON 按AI 摘要模块出现和未出现分两组,统计两组各自的域名频次——高频出现的域,就是 AI 在这个话题上偏爱的引用来源。三条判读经验先攒数据,后定口径。AI 摘要模块的字段结构文档没冻结,今天写死的解析路径下周可能失效。原样落盘 离线分析,比在线解析稳得多——这也是脚本把落盘放在第一步的原因。对比才有信息量。单看AI 引用了谁意义有限;和同 query 的自然排名域名分布对比,才能看出 AI 是否偏好不同类型来源(比如更偏官方文档、更偏知乎)。差异大的话题,就是 GEO 的发力点。触发率低就先扩样本。如果跑一轮只有两三个词带 AI 摘要,先扩查询词数量;样本低于 20 个带模块的结果时,域名统计没有意义。成本每查询词 1 credit,10 个词一轮 10 credits,一天两轮一个月 600 credits。按 $10/20k 的标准包算一个月三毛钱——比起拍脑袋决定 GEO 方向,这个数据便宜得可以忽略。FAQ能直接拿到 AI 摘要引用了哪些链接吗?模块出现时会一并返回,但字段结构以实际返回为准;脚本用从整个响应体提取 http(s) 链接的兜底方案,不依赖具体字段名,模块没出现时也能从自然结果里提取域名做对照。和 09-10 的 AI Overview 监测篇重复吗?不重复。那篇统计触发率(哪些词有 AI 摘要),这篇统计引用来源结构(AI 引用了谁);触发率是门槛指标,来源结构才是优化依据。样本要多大的?单话题至少 20 个带 AI 摘要的查询结果,域名频次排名才稳;低于这个数只适合看趋势,不适合下结论。把 QUERIES 换成你的目标话题,先跑两周攒数据,第三周开始你就有了一份AI 偏爱谁的真实名单——比任何 GEO 教程里的猜测都管用。

相关推荐

240GB流量击穿与频繁OOM:从云端瘫痪到客户端自治的本地优先架构重构实录
240GB流量击穿与频繁OOM:从云端瘫痪到客户端自治的本地优先架构重构实录

文章目录1. 灾难现场回溯:我遭遇的千篇级任务云端三重崩塌1.1. 开发环境与故障基线:为什么轻量云主机不堪重负?1.1.1. 数据膨胀系数与双向网络 I/O 成本爆炸1.2. 内存黑洞:我看 dmesg 时的 OOM 强杀惨状1.2.1. Linux 内核 OOM Kil… · 2026/9/27 2:04:31

AI项目上线后没人用-先看数据再决定救不救
AI项目上线后没人用-先看数据再决定救不救

AI项目上线后没人用-先看数据再决定救不救 先说一个 AI 项目组最不想看到的场面。 上线那天热热闹闹,全公司发了邮件,供应商驻场培训了两天,头一周后台登录量蹭蹭涨。一个月后,供应商撤了,后台的日活曲线一路往下掉&am… · 2026/9/27 2:04:31

重庆云阳网站建设公司速查手册:告别改需求拖一周
重庆云阳网站建设公司速查手册:告别改需求拖一周

重庆云阳网站建设公司速查手册:告别改需求拖一周 找重庆云阳网站建设公司做站,最怕啥?不是贵,是改个按钮颜色拖你一周,改个文案还要等“排期”。… · 2026/9/27 2:04:31

应用场景:灵巧手;运动监控(WIFI,蓝牙,USB;灵巧手命中率为零,看来还是要机器学习下
应用场景:灵巧手;运动监控(WIFI,蓝牙,USB;灵巧手命中率为零,看来还是要机器学习下

应用场景:灵巧手;运动监控(WIFI,蓝牙,USB;灵巧手命中率为零,看来还是要机器学习下 · 2026/9/27 2:36:35

电流Average、RMS与AC值的本质区别与工程选型指南
电流Average、RMS与AC值的本质区别与工程选型指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/27 2:36:35

Flutter for OpenHarmony 实战:三方库 large_file_handler 的鸿蒙化适配指南
Flutter for OpenHarmony 实战:三方库 large_file_handler 的鸿蒙化适配指南

环境搭建指引:https://atomgit.com/CPF-Flutter/flutter_samples/blob/master/docs/ohos/getting-started/flutter-oh-env-setup.mdlarge_file_handler 解决的是一个很具体的问题:把大文件(Flutter 资源或远程 URL)复制到应用的本… · 2026/9/27 2:36:35

图解步骤拆解:建设好学校网站避免无人问津
图解步骤拆解:建设好学校网站避免无人问津

图解步骤拆解:建设好学校网站避免无人问津 网站做好了没人访问,这是很多校长和IT负责人最头疼的事。投入几十万建的系统,老师懒得登,学生找不到入口,家长看不见动态。别急着甩锅给流量不足,90%的问题出在建设初期的逻辑混乱。今天这篇图解步骤,不… · 2026/9/27 2:36:23

网站建设岗位主要做什么:3个核心注意事项助你避坑
网站建设岗位主要做什么:3个核心注意事项助你避坑

网站建设岗位主要做什么:3个核心注意事项助你避坑 刚入行做网站建设,最让人头大的往往不是写代码,而是那些琐碎的流程。很多人卡在 备案流程一头雾水… · 2026/9/27 2:36:23

禾赛发布全球体积最小超高空间解析力激光雷达MT系列:以“小光斑”撬动高精建模新范式
禾赛发布全球体积最小超高空间解析力激光雷达MT系列:以“小光斑”撬动高精建模新范式

2026年9月15日,在德国慕尼黑InterGEO 2026测绘地理信息展上,禾赛科技正式发布面向高精建模领域的新一代旗舰产品——禾赛超高空间解析力激光雷达MT系列。官方资料显示,MT系列以同类测绘精度产品中体积最小的机身,集成超小光斑、3.5mm超高测距精度及无限加密扫描三大核心技术… · 2026/9/27 2:36:23

MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现

简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01

汕头网站建设制作厂家避坑指南:5大注意事项救急
汕头网站建设制作厂家避坑指南:5大注意事项救急

汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01

多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习

简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01

MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现

简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01

汕头网站建设制作厂家避坑指南:5大注意事项救急
汕头网站建设制作厂家避坑指南:5大注意事项救急

汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01

多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习

简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码