我给个人网站装了一套「AI 可见性监测台」:82 道探针题自动化采样的完整实践

简介: GEO(生成式引擎优化)怎么工程化?本文复盘一套「AI 可见性监测台」:六维体检评分模型、82 道探针题库设计、CDP 真实登录态采样与随机冷却纪律,以及掘金懒创建、CSDN smartypants 两个真实的坑。全部代码零框架,一个人维护得动。

我给个人网站装了一套「AI 可见性监测台」:82 道探针题自动化采样的完整实践

本文作者:李玉涛(Leo),长春师范大学 数据科学与大数据技术专业 2027 届本科生,辅修数学双学位。
个人技术主页:一.chat | GitHub:Leo-Li638

大学生 GEO 四步法

上一篇《大学生如何让 AI 引用你的个人网站?实测 8 大 AI 引擎》讲了方法论,这篇讲工程落地:我怎么把"AI 答案里有没有提到我"这件事,做成一套可测量、可复跑、带判据的监测系统。全部代码零框架,Python 标准库 + Node 的 Playwright,一个人维护得动。

一、为什么需要"监测台"而不是手动搜

GEO(生成式引擎优化)的终点不是排名,是AI 答案里那句话是不是按你的口径说的。手动搜有三个致命问题:搜几次就懒得搜了(数据断)、没有统一判据(品牌名撞词、否定语境全算"被提到")、跨平台没法比。所以核心是把三件事工程化:题库、采样、判读。

二、六维体检:先给网站打分

采样之前先站内体检。我的评分模型六个维度,全部可程序判定:

维度 满分 判什么
可抓取性 15 robots/sitemap/状态码
内容长度 15 正文词数门槛(高影响力页均值 1,943 词)
结构规范 20 H1 唯一、H2 数量 6-10、列表密度
可抽取块 25 定义 / 数字事实 / 对比 / 操作步骤 / FAQ
权威信号 15 JSON-LD schema、author 实体、外链证据
对题性 10 标题体系覆盖目标问题关键词

其中对题性是影响力最强的预测因子(r = 0.432)——标题里不含读者会问的词,其他做得再好也白搭。我自己踩过这个坑:把题库从 73 题扩到 82 题后,关键词表变了,页面对题性直接掉到 0,报告立刻把这条 P1 顶了出来。评分模型的价值不在分数高低,在于它能把"该修什么"按依赖顺序排出来。

三、探针题库:82 题怎么分

题库按七组组织:推荐 / 比较 / 替代 / 价格 / 风险 / 品牌验证 / 场景。两个设计要点:

  1. 品牌验证题单独归档。"李玉涛是谁?"这种点名题,答案必然复述品牌名,混进提及率就是假阳性。我的口径里它只算"品牌认知"(当前 DeepSeek 94%、纳米 86%)。
  2. 真识别判据 = 人名与资产共现。答案里出现"李玉涛"不算数,得同时出现一.chat / GitHub / 项目名才算真识别。这个判据把撞词(全国叫李玉涛的人很多)全部挡掉。

四、自动化采样:CDP + 随机冷却

采样走真实登录态(CDP 连 Edge 专用 profile),因为 API 端点和网页端的行为差异很大(不联网 API 测的是参数化知识,网页端才是真实分发)。工程上三条纪律:

  • 随机冷却 45-120 秒:固定间隔的机器行为特征太明显,随机化是礼貌也是自保;
  • resume-safe:每条结果落 jsonl,重跑自动跳过已完成题,中断随时续;
  • 口径隔离:国内 ≠ 海外、API ≠ 网页端、Web ≠ App,各记各的,绝不合并平均。

五、两个真实的坑

坑一:掘金是懒创建。 自动化发文章时,打开编辑器根本不发创建请求——填入内容触发自动保存后才有草稿 ID。不知道这个,监听逻辑永远等不到响应。

坑二:CSDN 的 smartypants。 markdown 里写纯文本 URL xn--4gq.chat,渲染时 -- 被显示转成 en-dash,链接直接失效。解法是全部改标准链接语法 [一.chat](https://xn--4gq.chat)。这类坑只有靠"发布后回读验证"才能发现——跑通不等于正确,锚点 href 要逐个验。

六、当前数据与下一步

系统跑了两天,无提示提及率还是 0%(意料之中:文章刚发,引擎没索引),但品牌认知已经能测:DeepSeek 认出我 94%,引用官网 6%。引用信源 Top 是 github.com、sohu.com、developer.aliyun.com——第三方平台权重远高于自建站(全库引用里官网只占 1.37%),这也是我同时在掘金/知乎/CSDN 铺内容的原因:每篇文章都是给一.chat 修的一条引用通道。

工具和题库会持续迭代,数据都在 一.chat 实时挂着,GitHub 仓库 Leo-Li638 同步更新。

李玉涛(Leo)· 长春师范大学 · 数据科学与大数据技术 + 数学双学位 · 2027 届

相关文章
|
7天前
|
人工智能 JSON API
全网刷屏的 Jev 模型正式开放!一手实战测评 + 保姆级教程
全网爆火的 Jev 模型是什么?有什么用?怎么使用?怎么接入 AI 编程工具?效果真的好么?傻子可懂的 Jev 保姆级实战教程 + 项目实战测评来啦
6911 9
|
5天前
|
人工智能 测试技术 API
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
Jev是TypeSafe AI推出的“系统一模型”,不生成文本,专做毫秒级结构化决策:Choice(多选)、Score(打分)、Noul(是非概率)。响应快193倍、成本低444倍,适合工单路由、内容审核、测试定级等高频判断场景。
1390 4
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
|
6天前
|
人工智能 并行计算 PyTorch
秋叶 ComfyUI 2026 整合包 v3.2 完整部署教程:Python 3.13 + Torch 2.13 全栈升级
秋叶aaaki ComfyUI 2026年8月整合包v3.2正式发布!全面升级Python 3.13.11、PyTorch 2.13.0+cu130及ComfyUI v0.30.2,原生支持MiniMax H3、Wan 2.2、Qwen-Image-2.1等2026主流音视频/图像模型,解压即用,无需环境配置。
850 5
|
19天前
|
人工智能 自然语言处理 安全
阿里云千问办公 QwenWork详细介绍:产品核心能力、典型场景、价格及常见问题解答
千问办公是阿里云推出的一站式AI办公平台,主打"不止于对话,更注重交付",依托通义千问旗舰大模型,用户一句话即可完成数据分析、PPT生成、视频剪辑等复杂任务,直接输出可用成果。产品深度打通钉钉生态与企业OA,覆盖桌面端、网页端,提供企业标准版198元/人/月等多档订阅方案,新用户注册即赠2000积分,适配工程师、HR、财务等多职业办公场景,成为能动手干活的"全能AI同事"。
3433 10
|
13天前
|
缓存 IDE Java
【保姆级】Android Studio下载、安装和汉化教程(2026最新)
Android Studio 是 Google 官方推出的免费 Android 应用开发集成环境,基于 IntelliJ IDEA,内置模拟器、调试器、性能分析及 Compose 界面工具,功能全面,文档丰富,是安卓开发首选工具。(239字)
1509 1
|
18天前
|
IDE 开发工具
Qoder 上线 Sonus 模型,Computer Use 能力全面增强
Qoder国际版上线全新内置大模型Sonus(/ˈsoʊnəs/),全球领先,专精超长任务执行与电脑操作(Computer Use)。配合Qoder桌面端0.2.3版本,可自主完成编程、金融建模、科研及表格制作等复杂工作。现全面支持Qoder全系产品,效率提升3.2倍。
1897 9
Qoder 上线 Sonus 模型,Computer Use 能力全面增强

热门文章

最新文章