尧图精选

论文解析:《GEO: Generative Engine Optimization》--KDD 2024

🕒 发布时间:2026/10/1 20:22:18 📁 来源:尧图网络
【作者】巷子GEO技术研究团队想要英文原版的小伙伴可以留言索取。如果说过去二十多年互联网内容增长的核心问题是“如何让网页在 Google 搜索结果里排名更高”那么生成式 AI 搜索出现之后一个更加关键的问题正在形成“当用户不再点击十条蓝色链接而是直接从 AI 的答案里获得信息时如何让自己的内容被 AI 看见、引用并成为答案的一部分”这正是 **GEOGenerative Engine Optimization生成式引擎优化**试图回答的问题。2024 年发表于 KDD 的论文《GEO: Generative Engine Optimization》由 Pranjal Aggarwal、Vishvak Murahari、Tanmay Rajpurohit、Ashwin Kalyan、Karthik Narasimhan 和 Ameet Deshpande 等作者完成。论文提出了 GEO 这一概念并构建了 GEO-bench 数据集对不同内容优化策略进行了系统实验。论文最值得关注的地方并不是它告诉我们“文章里多放几个关键词”或者“写得更权威”——恰恰相反它的实验结果证明传统 SEO 的一些经典技巧在生成式搜索环境下可能已经失效。而真正影响 AI 搜索引用的是另一套逻辑。一、首先要理解GEO 为什么会出现1. 搜索引擎正在从“找答案”变成“生成答案”传统搜索引擎的基本模式其实非常简单用户输入 Query → 搜索引擎返回网页 → 用户点击网页 → 用户自己寻找答案。Google、Bing 等传统搜索引擎本质上是一个“信息导航系统”。论文指出传统搜索引擎虽然极大改变了信息获取方式但其核心产物仍然是一个相关网页列表。生成式搜索则不同。以论文研究时所涉及的 BingChat、Google SGE、Perplexity 等系统为例其基本逻辑变成用户提问 → 系统拆解/改写问题 → 搜索多个来源 → 模型理解来源 → 综合信息 → 生成最终答案 → 在答案中引用来源。也就是说搜索引擎不再只是把用户送到答案所在的网站而开始直接生产答案。论文将这一类系统统一称为“generative engines”即生成式引擎Generative EngineGE。这意味着互联网内容分发发生了一个非常重要的结构性变化。二、SEO 与 GEO 最大的区别争夺的东西变了传统 SEO 最核心的目标是Ranking排名因为传统搜索结果是网页 A网页 B网页 C网页 D所以一个网站从第 10 名提升到第 1 名意味着巨大的曝光和点击差异。但 AI 搜索的答案可能长这样“根据多个来源目前可以得出三个主要结论……①……②……③……”然后一个答案里面同时出现多个来源。这时候问题变了。你的网站可能不是“第一名”但可能在 AI 回答中被引用被引用很多次被用于回答关键问题被放在答案开头被模型大量改写成为用户进一步点击的来源。所以GEO 优化的对象不再只是 Search Ranking而是 Source Visibility / Citation Visibility。论文明确指出传统搜索中的排名指标无法直接适用于生成式引擎因为生成式引擎会将多个网站的信息融合到一个结构化回答中而且不同来源的引用长度、位置和表现形式都可能不同。这其实是整篇论文最重要的理论转变。三、GEO 真正优化的是什么论文给 GEO 下的核心定义可以概括为通过修改网站内容提高网站在生成式引擎回答中的可见度。论文原文将其称为“Generative Engine Optimization”并将其定义为一种面向生成式引擎的内容优化范式。这里有一个非常值得注意的概念Impression ≠ Ranking在 SEO 里排名越高 ≈ 曝光越高。但在 GEO 里被引用 ≠ 被充分展示。例如假设 AI 回答有 500 个字。你的品牌被引用一次但 AI 只用了“该公司成立于 2018 年。”另外一个网站虽然排名不高却被 AI 用了 150 个字解释核心观点。从传统搜索排名来看两者可能无法直接比较。但是从生成式答案中的“存在感”来看后者显然更强。所以论文提出了一个非常重要的研究问题我们究竟应该如何定义“一个网站在 AI 回答里的曝光”这也是论文的重要理论贡献之一。四、论文提出了三个层次的 GEO Visibility论文设计了专门针对生成式引擎的 Impression Metrics。其中最容易理解的是1. Word CountAI 到底用了你多少内容论文定义了一个Word Count指标。简单来说与某个网站相关的回答内容越多这个网站获得的“曝光”越高。如果 AI 回答 100 个词其中有 30 个词来自对某个网站内容的引用或使用那么这个网站的 Word Count Impression 就比较高。论文认为这个指标的直觉非常简单AI 使用你的内容越多用户实际接触到你的信息就越多。五、但论文很快发现字数还不够假设网站 A在 AI 回答第 1 段贡献 30 个词。网站 B在 AI 回答最后贡献 50 个词。仅仅统计字数B A。但是现实中的用户阅读行为可能完全不是这样。用户往往首先阅读回答开头。因此论文进一步提出Position-Adjusted Word Count也就是不仅看 AI 使用了你多少内容还要看这些内容出现在什么位置。论文通过一个随位置衰减的函数对回答中不同位置的引用赋予不同权重。越靠前的内容获得的权重越高。这其实揭示了 GEO 与 SEO 一个非常深层的共同点位置依然重要。但是SEO 优化的是“网页的位置”GEO 优化的是“信息在生成答案中的位置和存在感”。这是一个非常重要的概念迁移。六、论文更进一步Visibility 不只是“出现多少”如果只看字数和位置仍然不够。比如一个网站在回答中出现了 100 个字但这些内容完全是无关的。另一个网站只出现 30 个字但这 30 个字恰恰是回答用户问题最关键的信息。谁的价值更高显然不能简单看字数。因此论文进一步提出Subjective Impression它综合考虑多个维度Relevance与用户问题的相关性Influence回答对该来源的依赖程度Uniqueness内容是否独特Position用户感知中的位置Count用户感知中的内容量Follow-up / Click likelihood用户是否可能进一步点击Diversity内容是否提供了不同的信息论文使用 G-Eval 类方法通过语言模型对这些维度进行评价。这意味着论文实际上在告诉我们GEO 的核心 KPI 不应该只是“有没有被引用”而应该是“你的内容在 AI 答案中贡献了多少有效信息”。七、那么问题来了到底怎样才能让 AI 更愿意引用你这才进入论文真正有意思的实验部分。研究者设计了9 种 GEO 方法GEO 方法核心思想Authoritative让表达更权威、更有说服力Statistics Addition增加统计数据Keyword Stuffing增加查询相关关键词Cite Sources增加来源引用Quotation Addition增加可信来源的直接引用Easy-to-Understand简化语言Fluency Optimization提升文本流畅性Unique Words增加独特词汇Technical Terms增加专业术语这些策略覆盖了内容结构、表达方式、证据、引用、关键词等多个维度。这里最值得注意的是研究者故意把 Keyword Stuffing 也放进来了。因为 Keyword Stuffing 是传统 SEO 的典型思路。所以这个实验实际上是在问过去 SEO 有效的方法进入生成式搜索之后还有效吗答案非常有意思。八、实验结果关键词堆砌基本没用了论文结果表明Keyword Stuffing 并没有带来明显提升。它的 Position-Adjusted Word Count 甚至低于没有优化的 baseline。论文作者进一步明确指出传统 SEO 中广泛使用的 Keyword Stuffing对生成式引擎回答几乎没有改善。这其实是整篇论文最值得 SEO 从业者警惕的结论之一。因为传统搜索引擎的很多优化逻辑本质上围绕关键词 → 匹配 → 排名而生成式引擎的处理逻辑变成语义理解 → 来源检索 → 内容理解 → 信息综合 → 答案生成因此你不再是在告诉搜索引擎“我有这个关键词”。而是在告诉生成模型“我这里有值得被理解、验证、综合和引用的信息。”九、真正表现突出的是“证据型内容”论文最值得关注的结果来自三个方法Cite SourcesQuotation AdditionStatistics Addition论文数据显示这三类方法带来了明显的 visibility 提升。其中论文报告Position-Adjusted Word Count 提升约30%–40%Subjective Impression 提升约15%–30%Table 1 中Baseline 的 Position-Adjusted Word Count 为 19.3而Quotation Addition27.8Statistics Addition25.9Cite Sources24.9这说明一个非常重要的规律AI 更容易理解和引用“有证据结构”的内容。十、为什么“统计数据”特别有效假设你写“新能源汽车近年来发展非常迅速。”这是一句典型的定性描述。但如果写成“根据某机构的数据2023 年新能源汽车销量同比增长 X%。”信息结构发生了变化。后者拥有主体 数据 时间 来源它不仅更具体而且更容易被生成式引擎识别为一个可以直接用于回答用户问题的事实单元。论文的实验也支持这一点Statistics Addition 是表现较强的 GEO 方法之一。因此从 GEO 的角度看“观点”是内容“证据”才是可被模型复用的信息单元。十一、“引用”为什么有效这是另一个非常关键的发现。假设一篇文章说“研究表明某方法可以提升效率。”这是一个没有出处的陈述。而另一篇文章写“根据某大学某项研究该方法可以提升效率。”第二种表达对于生成式引擎而言多了一层可验证性。论文认为Citation 的价值之一就在于给事实提供验证来源从而增强生成回答的可信度。所以 GEO 与传统 SEO 的一个重要差异是传统 SEO 更强调“相关性与权威性”GEO 更进一步强调“可引用性与可验证性”。十二、“引用名人/专家原话”也有效论文中的 Quotation Addition 同样表现突出。其基本逻辑是不要只是自己说。而是让相关领域中的可信来源说。例如普通表达AI 搜索正在改变用户获取信息的方式。GEO 化之后某研究者在相关研究中指出生成式搜索正在改变传统信息检索模式……这里发生了一个变化作者观点 → 外部证据 → 可引用信息论文发现Quotation Addition 对多个指标都有显著提升。十三、但有一个非常反直觉的结果写得更“权威”并没有明显变好研究者原本认为如果生成模型倾向于遵循语言指令那么更加有说服力、更加权威的语言应该提高内容曝光。结果却没有出现显著提升。论文认为这可能意味着生成式引擎对于这种简单的文风变化已经具有一定鲁棒性。这给我们一个非常重要的启示GEO 不是“把文章写得像 AI 喜欢的文章”。而是“让内容本身变得更容易被 AI 识别、验证、提取和引用。”两者完全不同。十四、GEO 真正重要的不是“关键词”而是 Information Architecture如果把论文所有实验结果抽象成一个更高层次的模型我认为可以把 GEO 内容拆成四层第一层Topic你在讨论什么↓第二层Claim你到底提出了什么事实、观点或结论↓第三层Evidence你的事实从哪里来数据是什么研究是谁做的原始来源在哪里↓第四层Citation / AttributionAI 能不能明确知道这条信息属于谁这四层越清楚内容就越容易成为生成式答案中的“信息组件”。所以GEO 的本质并不是“讨好 AI”而是提高内容的信息可抽取性、可验证性和可引用性。十五、论文还有一个非常重要的发现GEO 对“小网站”可能尤其重要这一部分非常值得企业和独立创作者关注。研究者进一步测试如果所有网站都同时进行 GEO 优化会发生什么结果发现GEO 对原本搜索排名较低的网站帮助尤其明显。例如论文报告Cite Sources 对 SERP 第 5 名网站带来了 115.1% 的 visibility 增长。与此同时排名第一的网站在该方法下的 visibility 反而下降了 30.3%。这揭示了一个很有意思的结构性变化。传统 SEO 的竞争优势往往来自域名权重外链网站历史品牌影响力SERP 排名而生成式搜索增加了一个新的竞争维度你的内容是否具有足够高的信息价值可以被生成模型直接吸收进答案这意味着一个排名靠后的专业网站也可能因为内容结构优秀而在 AI 回答中获得较高曝光。当然这并不意味着“排名不重要”。论文自己也没有得出这样的结论。它只是证明GEO 有可能部分改变传统 SERP 排名与最终内容曝光之间的关系。十六、GEO 不是一个固定技巧而是“Query × Domain”的组合问题这也是这篇论文非常重要的第二层贡献。研究者发现不存在一种 GEO 方法可以适用于所有问题。例如论文的 Table 3 显示GEO 方法更适合的领域/问题类型AuthoritativeDebate、HistoryFluency OptimizationBusiness、Science、HealthCite SourcesStatement、Facts、Law GovernmentQuotation AdditionPeople Society、Explanation、HistoryStatistics AdditionLaw Government、Debate、Opinion这意味着未来 GEO 很可能不是“给所有文章统一套一个 GEO 模板。”而更可能是根据 Query Intent、Domain、Content Type 动态选择优化策略。这实际上把 GEO 从“写作技巧”推向了一个真正的优化问题。十七、GEO 甚至可以组合使用研究者进一步测试了多个 GEO 策略组合。他们选择Cite SourcesFluency OptimizationStatistics AdditionQuotation Addition进行两两组合。结果发现Fluency Optimization Statistics Addition表现最好并且比单独使用某一种 GEO 策略进一步提高超过5.5%。这个结果意味着GEO 不是简单的“选择一个技巧”而可能是一个多目标、多策略优化系统。如果进一步抽象可以写成GEO Strategy f(Query, Domain, Intent, Content Type, Evidence Type)也就是说未来真正成熟的 GEO 系统很可能会自动判断这个 Query 是事实型还是观点型是商业决策还是知识解释用户更需要数据、引用、案例还是专家观点然后动态修改内容。十八、论文还做了一个很重要的现实世界验证如果只在实验室里有效意义其实有限。因此作者又拿真实部署的生成式引擎Perplexity.ai做了实验。结果仍然支持论文的核心发现Quotation AdditionPosition-Adjusted Word Count 提升约22%Statistics Addition相关指标最高提升约37%Cite Sources最高提升约9%Keyword Stuffing反而比 baseline 低约10%这一部分非常重要。因为它说明论文提出的 GEO 方法并不完全依赖研究者自己构造的生成式搜索系统。至少在论文研究的 Perplexity.ai 实验中部分规律得到了迁移验证。十九、从这篇论文我们可以重新定义“高质量内容”传统内容营销经常讲写给用户而不是写给搜索引擎。GEO 出现以后这句话可以进一步升级既要写给人也要让机器能够准确理解你写给人的内容。真正适合生成式搜索环境的内容至少应该具备1. 清晰让模型容易理解。2. 具体减少没有信息量的空泛表达。3. 有数据尽可能把重要判断转化为可验证的数据。4. 有来源告诉 AI这个事实从哪里来5. 有引用对于重要观点提供可信来源的直接表达。6. 有结构让事实、观点、证据之间的关系清晰。7. 有独特信息不要只是重复互联网上已经高度同质化的内容。二十、从 GEO 的角度重新理解“内容原创”这是我认为这篇论文可以进一步推导出的一个重要问题。过去 SEO 时代原创 ≈ 不抄袭。但在 GEO 时代原创 ≠ 仅仅重新组织已有信息。如果你的文章只是A 网站说过 → B 网站说过 → C 网站说过 → 我把它们重新总结一次。那么生成式引擎很容易把你看作已有信息的二次表达。真正具有 GEO 价值的原创内容更应该包含第一手数据原始研究独家案例实验结果专家访谈独特观点自己的数据分析原创方法论因为这些内容具有一个非常重要的属性Information Uniqueness论文在 Subjective Impression 中也专门考虑了“Uniqueness”。所以从长期来看GEO 可能会进一步提高“原创一手信息”的价值。二十一、但是必须注意这篇论文不能被理解成“GEO 定律”这也是学术解读时最需要强调的地方。论文自己在 Limitations 中明确指出生成式引擎仍然处于快速演化阶段随着系统变化GEO 方法可能需要不断调整。此外用户 Query 的性质也会发生变化因此 GEO-bench 需要持续更新。更重要的是由于搜索算法是黑盒研究者没有评估 GEO 对传统搜索排名本身的影响。所以我们不能简单地说“论文证明了以后所有 AI 都喜欢统计数据。”这不是论文真正证明的。更准确的说法是在论文构建的实验环境、GEO-bench 数据集以及 Perplexity.ai 的测试中Statistics Addition、Quotation Addition、Cite Sources 等方法表现出了较明显的 visibility 提升。这是科学论文与行业“经验法则”之间必须保持的边界。二十二、这篇论文真正伟大的地方它把 GEO 从“概念”变成了“研究问题”如果只看今天的行业讨论GEO 很容易被理解成“AI SEO。”但从这篇论文的学术框架来看这个理解其实太浅。论文实际上做了三件非常重要的事情。第一件事定义问题过去没有一个统一的问题叫“如何优化内容在生成式搜索中的曝光”论文正式提出 GEO。第二件事定义指标它提出Word CountPosition-Adjusted Word CountSubjective Impression试图回答什么叫“被 AI 看见”第三件事定义 Benchmark论文构建了GEO-bench包含10,000 个 Query25 个不同领域多种 Query 类型不同难度informational / transactional / navigational 等不同意图并划分为8K train1K validation1K test这一步非常关键。因为没有 Benchmark就很难真正比较不同 GEO 方法。二十三、因此GEO 的本质不是“写作技巧”而是一个优化问题如果用数学语言重新理解论文传统 SEO 更接近Maximize Search Ranking而 GEO 变成Maximize Citation / Content Impression同时又受到Query RelevanceContent QualityCitation PositionInformation UniquenessCredibilityUser Intent等多个变量影响。论文把 GEO 方法抽象成一个从原始网站内容 (W) 到优化后内容 (W’) 的转换函数。即f : W → W′目标是在不了解生成式引擎内部算法的情况下通过修改内容提高网站在生成式回答中的 visibility。这就是为什么论文称它为一种Black-box Optimization Framework二十四、这也是 GEO 与传统 SEO 最本质的区别可以用下面这张表理解维度SEOGEO优化对象搜索排名AI 回答中的曝光核心目标RankCitation / Visibility内容单位页面信息片段/事实/观点重要信号Keywords、Links 等Relevance、Evidence、Citation、Uniqueness用户行为搜索→点击提问→直接阅读答案竞争方式谁排得更前谁的信息被 AI 采用得更多内容逻辑面向搜索索引面向机器理解与答案生成关键词较重要不再是核心数据/证据有帮助论文实验显示尤其重要外部引用有帮助论文实验显示尤其重要个性化相对有限更重要优化环境相对稳定黑盒、动态、多模型因此GEO 不是 SEO 的简单升级版。更准确地说GEO 是在“搜索结果页面”逐渐变成“生成式答案页面”之后对内容分发机制的一次重新建模。二十五、如果我是内容团队负责人我会如何利用这篇论文这里可以把论文直接转化成一个非常实用的 GEO 内容框架。一篇准备获得 AI 搜索引用的文章可以按照下面的结构设计Step 1明确回答一个 Query不要写“关于新能源汽车的全面介绍”而是写“2025 年中国新能源汽车市场增长的主要原因是什么”Step 2给出明确结论第一段直接回答问题。不要让 AI 自己从 3000 字中寻找你的核心观点。Step 3给每个重要结论增加 Evidence例如结论 → 数据 → 时间 → 来源Step 4增加一手引用如果是专家观点专家 → 身份 → 原话 → 来源Step 5增加独特信息例如自己调查的 100 个用户自己测试的 20 个产品自己统计的数据企业内部案例原创实验Step 6提高语言可读性论文同样发现 Fluency Optimization 和 Easy-to-Understand 可以带来明显的 visibility 改善。Step 7不要为了 GEO 强行堆关键词论文已经给出了非常明确的实验信号Keyword Stuffing 在生成式搜索中表现较差。二十六、一个更值得关注的未来从 GEO 走向 AEO / AI Visibility Optimization论文发表于 2024 年。它研究的还是比较早期的生成式搜索系统。但是它提出的问题可能比“GEO”这个名字本身更重要未来互联网的内容价值到底由谁决定过去搜索引擎决定你排第几。未来生成模型可能决定你的信息是否进入答案。再往前一步AI Agent 可能直接阅读网站比较产品选择供应商生成推荐调用服务完成交易。那么届时我们优化的甚至不再只是“让 AI 引用我。”而会变成“让 AI 在做决策时能够识别、理解、信任并选择我的信息。”这可能是 GEO 最值得继续研究的方向。二十七、最后重新看这篇论文它真正改变的不是 SEO而是“互联网内容的分发逻辑”《GEO: Generative Engine Optimization》最后的结论非常清楚论文提出 GEO建立生成式引擎的 visibility metrics并发布 GEO-bench实验显示部分 GEO 方法可以让内容在生成式回答中的 visibility 提升最高约40%。但如果把这篇论文浓缩成一句话我更愿意这样理解SEO 时代你要努力让搜索引擎找到你的网页GEO 时代你要努力让生成式引擎找到、理解、信任并引用你的信息。因此真正的 GEO 思维不是“我要怎么骗过 AI”而是“我的内容是否足够清晰、具体、有证据、有来源、有独特信息并且能够被机器准确理解和复用”这两种思维看起来只差一个字实际上代表了完全不同的内容生产范式。结语GEO 的终点可能不是“被 AI 引用”《GEO: Generative Engine Optimization》最有价值的地方在于它第一次把一个正在发生的产业变化转化成了一个可以被定义、测量、实验和优化的学术问题。它告诉我们搜索正在从“Document Retrieval”走向“Answer Generation”。因此内容竞争也会从谁拥有更好的搜索排名逐渐扩展为谁拥有更容易被机器理解、验证、引用和综合的信息。而这可能意味着未来内容行业的一条重要规律不是“谁写得最多”而是谁拥有更多值得被 AI 使用的信息。从这个角度看GEO 并不是 SEO 的一个新技巧而可能是生成式互联网时代内容分发机制的一次范式迁移。论文信息Aggarwal, Pranjal; Murahari, Vishvak; Rajpurohit, Tanmay; Kalyan, Ashwin; Narasimhan, Karthik; Deshpande, Ameet. (2024).GEO: Generative Engine Optimization. Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD ’24).论文 DOI 为 10.1145/3637528.3671900。一句话带走SEO 优化的是“搜索结果中的位置”GEO 优化的是“生成答案中的信息存在感”。这也是理解整个 GEO 领域最重要的第一性原理。
上一篇/下一篇内容由系统自动关联 返回资讯列表 →