AEO · AI定位 · 案例研究

AI定位:我们如何衡量答案引擎会引用 transgenia.org 的哪些段落、把无实体名称的段落从 77% 降到 38%,并发现了新关键词

你的网站可能说的都是真话,却没有任何答案引擎能把这些话归属到你。Transgenia 在衡量自家页面的 AI定位时发现了这一点:69 个段落中有 53 个没有提到公司名称,而价格 FAQ 的回答是“视情况而定”。以下是我们测量了什么、改了什么、今天生产环境显示了什么,以及我们有意排除了什么。

简短回答。 Transgenia 用 7 个 TypeSafe 问题(jev-1.13.0)按段落计算 P(被引用) 来衡量 AI定位:transgenia.org 的 69 个段落中,77% 没有提到 Transgenia。用已公开的事实重写后,生产环境显示无实体段落降至 38%,私立诊所价格查询的 P(被引用) 从 0.31 升至 0.94。任何没有段落达到 ≥ 0.70 的问题都是新关键词。

真正的问题:69 个段落中有 53 个没说出是谁在说话

打开这个案例的数据。 2026年9月20日,我们评估了 transgenia.org 的 69 个段落:56 条 FAQ 回答和 13 个实体段落(Organization.description、两条 meta description、“关于我们”和“服务”页的首段,以及 llms.txt 中的 blockquote)。**53 个(77%)**没有提到 Transgenia;引用它们的引擎将不知道该把数据归属给谁。

最显眼的内容最不可引用。 13 个实体段落的综合得分平均为 0.52,而 FAQ 为 0.74。服务页的首屏文案(hero)得分 0.11–0.36,marketing_fluff 为 0.78–0.91;22 个段落不含任何可核查的事实,13 个属于回避式回答:只说“视情况而定”或“联系我们”,不给任何标准。

潜在客户真正会输入的问题。 对于“在墨西哥的私立诊所实施 Odoo 要多少钱”,没有任何段落达到 P(被引用) 0.70;最高只有 0.31。对于“谁在墨西哥为中小企业实施 Odoo”,排名最高的段落(0.92)是 llms.txt 里的一段英文 blockquote,而引擎几乎不会把它展示给西班牙语用户。

AEO 的教训:说真话还不够;必须带着名字、带着事实、用提问者的语言去说。

AI定位:这门学科叫什么(AEO、GEO),追求什么

SEO 追求点击;AEO 追求引用。 这门学科对同一件事有三个名字:AEO(Answer Engine Optimization,答案引擎优化)、GEO(Generative Engine Optimization,生成式引擎优化),以及人们在西班牙语里实际输入的“posicionamiento en IA”(AI定位)或“面向人工智能的 SEO”。目标是让 ChatGPT、Claude、Perplexity 或 Gemini 把你网站的某个段落当作来源,并把它归属到你的品牌。

本案例新增的内容。网站 AEO 优化权威指南中,我们解释了完整定义、llms.txt 和 FAQPage 结构化数据;这里不再重复。本案例把那份指南变成一套按段落计算的度量,以及一个能发现网站尚未回答的关键词的循环。

我们如何衡量在 AI 引擎中的定位:每个段落一个概率,而不是一种直觉

一次调用,七个问题。 评估量表对每个段落提出 7 个 TypeSafe 问题:2 个 Score 类型(直接回答、值得引用)和 5 个 Noul 类型(自成一体、提到实体、可核查事实、宣传性语言、回避式),在对 jev-latest 模型的单次 system_one 调用中一并解析;在 TypeSafe 的生产 API 中,该别名于 2026-09-20 解析为 jev-1.13.0

综合得分在代码里,不在模型里。 权重:directness 0.30、自成一体 0.15、实体 0.10、可核查 0.20、非宣传 0.10、非回避 0.15;citation_worthy 不计入综合得分,作为独立对照。第二个用于重排序的 Noul 会对每一对(查询,段落)提问:引擎会不会引用这个段落?6 个查询 × 69 个段落 = 414 次调用,平均延迟 198 毫秒。

便宜且稳定,因此可以当阈值用。 完整研究(585 次已缓存调用)按公开价格每百万输入 token 0.042 美元计算,成本 ≈ 0.02 美元。在对 8 个段落的 5 次重复中,每个问题的平均标准差为 0.0083(最大 0.0359),综合得分的标准差为 0.0049;没有任何段落跨越 0.70 或 0.30 的分界线。注意别把它解读为准确性:这些段落是西班牙语,而 Jev 主要以英语训练,所以这是针对本内容的一次测量,而不是基准测试。

隔离原因:一个词让 P(被引用) 提升了 +0.51

单词对照。 在一句完全相同的话里只加上“Transgenia”,names_entity 从 0.01 升到 0.98,综合得分从 0.84 升到 0.94,“Transgenia 是什么”的 P(被引用) 从 0.17 升到 0.68。对另一条 FAQ 的第二次对照把 P(被引用) 从 0.30 提到 0.41。实体名称不是虚荣,而是归属:AI 中的品牌定位从这里开始。

schema 里重写的一句话。 首页的 Organization.description 得分 0.81,却没有提到 Transgenia 是 OpenAI Partner Network 中的 OpenAI Select Partner,而这项资质在 schema 的其他地方是有的。用法定名称、成立年份、合作伙伴和语言重写后升至 0.95,“哪家墨西哥公司是 OpenAI Select Partner”的 P(被引用) 从 0.05 升到 0.96。首页的 meta description(159 个字符)从 0.59 升到 0.92。面向 AI 的结构化数据只有在其中的文本本身可被引用时才有帮助。

为被引用而重写:这项指标迫使我们公开价格

“视情况而定”的天花板。 诊所价格 FAQ 的第一次重写没有公开数字(三个范围变量、15 分钟的 QuickLook 和免费演示),综合得分从 0.53 升到 0.73,P(被引用) 从 0.14 升到 0.55,但 evasive 停在 0.45。cookbook 说得直白:只有公开一个价格区间才能进一步推动这个查询。

我们公开的是汇总开票数据,不是报价单。 Transgenia 从自己的开票记录中提取区间:2025–2026 年开票的两家墨西哥城私立诊所,第一年在 24,000 至 92,000 MXN 之间(平均约 58,000 MXN;月度咨询方案 3790 MXN 起),以及 2023 至 2026 年开票的 B2B 贸易商,通常每年 110,000–320,000 MXN(平均约 190,000 MXN)。均为 16% 增值税(IVA)前价格,并取决于范围。公开区间后,诊所 FAQ 的综合得分从 0.731 升到 0.930,P(被引用) 从 0.53 升到 0.89,evasive 从 0.50(门禁基线)降到 0.03;贸易商 FAQ 的 P(被引用) 从 0.51 升到 0.91。

理智性检查。 重写后的贸易商 FAQ 用诊所查询来评估时没有提升(0.12 → 0.10),本该如此:贸易商的回答不应赢得诊所的问题。硬性规则:可衡量的透明度,而不是承诺。

发布前的门禁:金丝雀、留出集与零虚构

每个 pull request 三层检查。 第一层是确定性的、不调用 API:所有 JSON-LD 都能解析,每条 FAQ 的可见文本与 JSON-LD 中的一致,faq.json 和 i18n 都能解析。第二层用 ci_baseline.json 运行评估量表:未改动的段落下降不能超过 0.05,改动过的段落必须提升或综合得分达到 ≥ 0.60,新段落必须达到 0.60。第三层是金丝雀:每个潜在客户查询的最高 P(被引用) 相对基线下降不能超过 0.05。

一个永不撰写文案的循环。 autoresearch 循环(JevOps 模式:提出、隔离评估、只应用得分更高的、记住)接收来自人或代理的 old/new 提案。Jev 评估 old 与 new 的量表得分、对照 site_facts.json(21 条经核实的事实,每条都有来源和日期)核查事实,并运行金丝雀;只有在综合得分增益 ≥ 0.05、无依据声明 ≤ 0.50、names_entity ≥ 0.85 且没有任何金丝雀查询从 ≥ 0.70 跌到 < 0.65 时才接受。每个决定都记录在 autoresearch_memory.jsonl 中。

各批次及其失败数。 P4–P6(首屏文案、卡片和方法论 FAQ):23 次重写,平均综合得分 0.517 → 0.756;一条变差(0.553 → 0.543),三条低于 0.60。P8:10 条中 10 条被接受(9 条计分外加一条不计分的中文镜像),计分项的平均综合得分 0.559 → 0.904;一条提案在第一轮因文本存在性检查(presence_ok=false)被拒,修正后接受。P9:4 条中 4 条,0.493 → 0.913。门禁背后的草稿优先(draft-first)与人工批准(VoBo)框架见Transgenia 如何用受治理的 AI 代理运营:先建治理的方法

用 AI 发现新关键词:你的网站没有回答的问题

从 Google Suggest 到潜在客户的问题。 我们从 Google Suggest(es-MX)中的种子词出发,例如“posicionamiento en IA”(AI定位)、“cómo aparecer en ChatGPT”(如何出现在 ChatGPT 中)或“auditoría SEO con IA”(AI SEO 审计),收集它们的自动补全:这是真实需求,按人们实际的写法呈现。有些种子词没有返回任何自动补全,其中包括“cómo saber si ChatGPT cita mi sitio”(如何知道 ChatGPT 是否引用了我的网站):Suggest 没有自动补全,说明这种表述没有可测的需求,但它恰恰是本案例所回答的问题,所以我们把它用在了 FAQ 中。基于种子词和补全词,我们按潜在客户会输入的方式撰写问题。

阈值定义了新关键词。 每个问题都与网站上每个现有段落进行评分。如果没有段落达到 P(被引用) 0.70,就说明有需求却没有可引用的回答:这个问题就是一个新关键词,为它撰写内容并重新测量。用人工智能找到的关键词来自“缺失”的证据,而不是直觉。

用金丝雀和留出集防止自欺。 我们维护 11 条用于优化并在每个 PR 中验证的金丝雀查询,以及 8 条密封的留出集(holdout)查询,只在生产审计时打开。两者之间的差距(平均最高 P(被引用) 0.93 对 0.70)暴露出针对已知问题过度拟合的文案。留出集中 0 个段落 ≥ 0.70 的四个缺口是:Cofepris(墨西哥联邦卫生风险防护委员会)监管的库存(0.52)、Odoo 迁移(0.36)、对照 SAT(墨西哥税务管理局)验证 CFDI(墨西哥电子发票)的代理(0.69)和按项目计算的利润率(0.68)。P9 撰写了这些内容(迁移的综合得分 0.22 → 0.90,CFDI-SAT 0.24 → 0.95);2026-09-21,这四条转为金丝雀,并密封了四条新的留出集查询。

今天生产环境显示了什么:对线上 HTML 的 AI SEO 审计

我们审计的是生产环境,不是代码仓库。 2026-09-21,我们把 transgenia.org 线上 HTML 的 27 个文件(带缓存穿透)与 origin/main 进行比对:27 个完全一致,0 个漂移。门禁在该快照上通过,168 个西英双语段落状态为 ok,重排序成本 ≈ 0.022 美元(534,976 个输入 token)。

指标之前(2026-09-20)生产环境(2026-09-21)
无实体名称的段落69 个中 53 个(77%)77 个中 29 个(38%)
平均综合得分0.700.77
P(被引用) 私立诊所 Odoo 价格0.31(0 个段落 ≥ 0.70)0.94(2 个段落 ≥ 0.70)
P(被引用) B2B 贸易商 Odoo 价格未测量(新查询)0.95
P(被引用) Transgenia 身份0.95(10/69 ≥ 0.70)0.96(23/77 ≥ 0.70)
P(被引用) 墨西哥 Odoo 实施商0.92(5 ≥ 0.70)0.94(7 ≥ 0.70)
P(被引用) 受治理的 AI 代理0.740.93
P(被引用) 墨西哥的 OpenAI Select Partner0.91(1 ≥ 0.70)0.96(4 ≥ 0.70)
P(被引用) 将 ChatGPT 或 Claude 与 Odoo 集成0.830.83(无变化)

按页面看及尚待完成的部分。 生产环境的平均综合得分:关于我们(Nosotros)0.95、首页(index)0.94、诊所页 0.85、贸易商页 0.85、AI 解决方案页(soluciones-ia)0.83、AI 实施页(implementacion-ia)0.79、服务页(servicios)0.76、加入我们(join-us)0.61。仍有 11 个段落低于 0.60,join-us 仍排在最后。审计结论:GREEN,留出集的四条查询以 0 标记为明确例外。

我们有意不测量的内容。 本案例中的所有数字都是由 jev-1.13.0 估算的 P(被引用),而不是在 ChatGPT、Perplexity、Gemini 或 Claude 中观察到的实际引用。我们也没有测量流量、Google 排名、线索或可归因于这次改动的收入:没有数据来源,Transgenia 不会凭空编造。

成本多少、如何开始:自己做,还是找一家 AI定位机构

算力只要几美分;判断力不是。 对 69 个段落运行评估量表的成本 ≈ 0.0032 美元(75,911 个 token,平均延迟 233 毫秒),重排序 ≈ 0.0079 美元,生产审计 ≈ 0.022 美元。对任何 AI定位服务商(包括 Transgenia)应该要求的不是算力,而是门禁:有来源的经核实事实、密封的留出集,以及发布前的人工批准。Transgenia 在向任何人推荐这套门禁之前,先把它用在了自己的网站上。

  1. 诊断。 提取网站上现有的段落(FAQ、meta description、Organization、首屏文案),运行 7 个问题的评估量表,并针对潜在客户会输入的问题做重排序。标记没有实体名称的段落和 0 个段落 ≥ 0.70 的查询。
  2. 只读试点。 用你已经公开的事实重写,用同一个模型评估 old 与 new,只接受增益 ≥ 0.05 且不破坏任何金丝雀查询的改动。没有 diff 和人工批准,什么都不上生产。
  3. 治理。 把门禁放进 CI,密封一组留出集,每次部署后带缓存穿透审计生产环境。失败的留出集查询就是你的下一批关键词。

如果你想在决定之前看到这套技术栈的真实运行,我们按行业的演示运行在 100% 模拟数据上,QuickLook 时长 15 分钟。

查看演示 →

常见问题

如何知道 ChatGPT 是否引用了我的网站?

目前还无法直接得知:Transgenia 不测量在 ChatGPT 中观察到的引用,而是测量答案引擎针对每个潜在客户问题引用你网站每个段落的概率,由 TypeSafe 的 jev-1.13.0 模型估算。在生产环境中,私立诊所价格查询从 0.31 升到 0.94。这是一个估算值,不是在聊天中核实过的引用;配套的评估量表在对 8 个段落的 5 次重复中显示平均标准差为 0.0083,这证明的是可重复性,而不是准确性。

面向人工智能的 SEO 叫什么:AEO、GEO 还是 AI定位?

三个名字指向同一件事:AEO(Answer Engine Optimization)是优化内容以便答案引擎引用你的内容,GEO(Generative Engine Optimization)从生成式引擎的角度命名同一个目标,而 AI定位(posicionamiento en IA)是人们在西班牙语里搜索它的方式。Transgenia 使用 AEO 这个名称,并用 7 个 TypeSafe 问题和每个段落 0 到 1 的综合得分来衡量它。

如何让我的公司出现在 ChatGPT 和 Perplexity 的搜索结果中?

说出实体名称、公开可核查的事实,并直接回答字面问题。Transgenia 用一次对照实验验证了这一点:在一句完全相同的话里只加上 Transgenia 这个词,P(被引用) 从 0.17 升到 0.68;公开真实的价格区间则让私立诊所价格查询在生产环境中从 0.31 升到 0.94。没有名字、没有事实,引擎就无法把答案归属给你。

什么是 AI SEO 审计,它到底测量什么?

它是逐段落的测量,而不是一份建议清单。Transgenia 的审计用 7 个 TypeSafe 问题(直接回答、自成一体、提到实体、可核查事实、宣传性语言、回避式和值得引用)评估每条 FAQ、meta description 和首屏段落,在代码中计算综合得分,并针对 11 条金丝雀查询和 8 条留出集查询估算 P(被引用)。最近一次对线上 HTML 的审计成本 ≈ 0.022 美元。

如何用人工智能找到新关键词?

从真实需求出发,测量缺口。Transgenia 从 Google Suggest(es-MX)的种子词出发,按潜在客户会输入的方式撰写问题,并把每个问题与网站上现有的段落逐一评分;如果没有段落达到 P(被引用) 0.70,这个问题就是一个新关键词。Cofepris(墨西哥联邦卫生风险防护委员会)监管的库存(0.52)、Odoo 迁移(0.36)、CFDI-SAT(墨西哥电子发票与税务局)代理(0.69)和按项目计算的利润率(0.68)就是这样出现的。

测量一个网站的 AI定位要花多少钱?

算力只要几美分。Transgenia 对 69 个段落的完整研究(585 次已缓存调用)成本 ≈ 0.02 美元,生产审计 ≈ 0.022 美元,按 TypeSafe 于 2026-09-20 公布的价格计算(每百万输入 token 0.042 美元)。真正花时间的是编辑工作:用经核实的事实重写,并在发布前通过门禁。

关于作者与 Transgenia

Efraín Carreón OrtizCentrum Transgenia 的总经理(Director General),这是一家墨西哥精品科技公司。他持有 Anthropic 颁发的官方 Claude Code 徽章(Claude Partner Badge),可在 Credly 上验证。

Transgenia 是 OpenAI Partner Network 中的 OpenAI Select Partner,也是 Anthropic 的 Claude Partner Network 的注册合作伙伴。我们在自己的生产环境中运营十二个受治理的 AI 代理,并在医疗和 B2B 领域陪伴可验证的实施项目。

联系我们:LinkedIn预约 15 分钟会谈联系页面

继续阅读

← 返回博客
Transgenia, Verified IT agency on Vai.me