凭什么SEO在生成式引擎中失效了?

本文写作灵感来源于普林斯顿大学发表在ACM会议上的一篇论文《GEO:生成式引擎优化》

一、GEO的诞生是为了解决什么问题?

大模型的到来,为搜索引擎引入了一种全新的范式,那就是通过生成式引擎来收集和总结信息,并回答用户的问题。

我们需要先了解一下 大模型生成式引擎 的区别是什么。

大模型来自中文对 LLM 的翻译,而 LLM 是 Large Language Model 的缩写,其实翻译过来应该叫大语言模型,但是我们平时都喜欢直接叫大模型,读起来不绕口,而且听起来也挺厉害。大模型的功能,就是理解和生成内容。你可以把它想象成一个函数,就是给它一个输入,它经过一个处理,最终给出一个输出。

生成式引擎呢,它的概念在边界上要比大模型更加宽泛。我们可以理解为,生成式引擎是基于大模型这一底层技术而构建的“应用系统”,或者说是“工具”。它的定义就是“能够利用大模型产生内容的系统。也就是说,生成式引擎是在大模型的基础上,额外给它加上了一些功能,比如搜索能力数据处理逻辑的规则用户界面等,从而构建出一个应用,比如大名鼎鼎的ChatGPT,千问,豆包等。

大模型、以及大模型带来的整个行业,整个社会的变迁,也就是近几年的事情。在2022年ChatGPT横空出世以前,这种类似的技术还只是各大高校实验室里面的玩具。所以借助大模型这种技术来回答用户的问题,截至目前算得上是新兴技术,随着它的发展,我们把它归类到了生成式引擎这一统一框架下面,主要特点就是可以生成准确且个性化的回复,我想大家在刚开始使用大模型的时候一定已经有过这样的感悟。

时过境迁,在大模型出现之前,没有人想到搜索引擎这么好用的东西,居然有朝一日会被取代。甚至于我们整个的,基于搜索引擎的“搜索问题-获取答案”的逻辑都发生了巨大转变。但就像古人说的福祸相依,凡事都具有两面性。

好的方面是,用户获取知识的效率得到了前所未有的提升,大模型带来的范式极大地提升了用户体验。以往我们通过搜索引擎寻找解决问题的方法时,首先得想好搜什么问题,搜出来后出现一堆的页面,我们还得挨个挑选,在排除掉广告、钓鱼网站和无效帖子后,可算找到那么几个看上去有用的网站。这还没完,一个个点进去查看、筛选、比对,运气好的好可以得到想要的答案,运气不好也就不了了之了。而现在有了大模型的帮忙,直接点开豆包、千问、或者元宝,亦或是国外的ChatGPT, Google Gemini,随口问一句就行了,AI会默默地帮你搜索信息,整理信息,总结信息,并将归纳好的有用的知识,直接喂给你。这才叫做呼之即来,唾手可得。

坏的方面是,这项技术给第三方利益相关者,比如网站和内容创作者,带来了巨大的挑战。就比方说我,我现在在写这篇文章,这篇文章写完后会发布到多个平台,比如微信公众号,CSDN,知乎,小红书等,但是我永远不能确切地知道我创作的内容什么时候会被AI所引用,又会以怎样的方式被展示给AI的对面的“那个人”。最重要的是,万一AI大模型引用了我的内容,却没有告诉用户这是我创作的内容,那我作为内容创作者岂不是被大模型“白嫖”了?正是这种不确定性带来了很大的风险

因为我是创作者,自然而然地我会以内容创作者的视角来看待这个挑战,至少我不希望我的权益收到侵害。那么要解决这个问题,就必须引入一个极其重要的概念,也就是我们今天这篇文章的主角——GEO。它的全称是 Generative Engine Optimization,我们把它翻译成“生成式引擎优化”。

上面我们已经讨论过大模型和生成式引擎的关系,如果说生成式引擎现在还没有“心”(heart),但它至少一定有“”(brain),这个“脑”就是大模型。所以我们做“生成式引擎优化”,做GEO,说白了还是冲着它的大脑去的。不过冲着大脑去并不是要去改变大脑本身,毕竟人类的大脑我们还没研究明白呢。大脑本身的结构是不变的,大模型还是那个大模型;大脑的作用机制也是不变的,包括它的思考方式,计算方式,处理方式等。那GEO到底改变了大模型的什么?

改变了大模型接收到的信息。也就是说大模型的“输入”变了。我们希望是这样的:大模型接触到我们想让它接触到的内容,那么经过大模型的处理后,它就会给出我们想要的结果。所谓“想要的结果”就是大模型在回答用户的问题时,如果它引用了创作者的内容,理应为其打上标签(Tag),告诉用户本次回答采用了谁谁谁的观点。

经过大规模的基准测试,以及严格评估,我们发现GEO工作可以让内容的可见性比使用GEO之前提高多达40%。这个数据来自普林斯顿大学的论文:https://arxiv.org/pdf/2311.09735。


二、GEO是如何提升可见性的?

创作者本身要持续创作优质内容,这是根本,也有一些小技巧可以提升内容在大模型回答中的可见性,比如在文章中多引用一些权威的统计数据,一些相关度高的引用,相关来源的引述,这些都可以显著提高内容的可见度。

虽然目前已经有数不清的人都在用生成式引擎,但是并没有一套标准的,描述它的框架,比如用户的输入和模型的输出直接存在什么关系?

我们尝试引入了一个描述它们之间关系的函数(function),这个函数是这样的。f(GE) := (qu, PU) -> r.

这里的qu,代表用户输入的问题;r呢,是大模型给出的响应结果;而 PU 就表示个性化的用户信息。

这个公式一出来就很容易描述生成式引擎了,很明显PU 会影响到 qur 的一个映射。r 是大模型给出的响应结果,通常是包含了很多引用的结构化文本。

那么对于一个理想的生成式引擎来说,就应该尽可能保证响应结果涉及到的所有称述,都应该有引用作为支撑。而放过来,生成式引擎给出的每处引用,也应该都有对应的文本进行论述。说人话就是,我说话要引经据典,提高我的信服力,但是我不能随便引用,毕竟改变不是乱编,戏说不是胡说。

传统搜索引擎是根据网页的平均排名来决定内容的可见性,创作者不但知道内容的曝光程度,还知道这么提升展现度。但是生成式引擎不是。因为大模型在每次回答中都可能回应引用多方消息源。这里面有很多的因素,比如被引用网站的体量,内容的独特性,以及呈现方式等,都会影响到引用的真实可见度。所以说SEO的概念和对应的方法,在生成式引擎中失效了。


三、GEO策略推荐

要想提升展示指数,创作者应该根据GEO的策略定期优化自己的内容,比如说,可以让个人风格体现的更加明显,或者并入一些新的内容尽力组成结构化的文本。一个好的GEO优化策略,就像是一个“黑箱”优化方法,我们并不需要知道生成式引擎底层的算法是如何设计的,但是经过GEO策略,我们的内容获得了更好的展示。

经过评估,我们推荐下面的 GEO策略

  1. 权威性提升:努力让自己的文本风格读起来更具有说服力,看起来更权威。
  2. 增加统计数据:不要只是一味的陈词滥调,你要增添一些具体的数据,大模型就喜欢可以量化的东西,而不是天马行空的定性讨论。
  3. 传统关键词要有:“关键词堆砌法”本来是SEO的专利,但是好的SEO本来就可以促进GEO的提升,经典方法之所以称为经典,就是说明人家有用。所以,让自己的内容里面多包含一些来自查询的关键词,不是什么坏事。
  4. 引用来源、添加引述:你引用了可靠的消息数据源,大模型也就会相应地认为你是可靠的。
  5. 通俗易懂:写文章也好,写文案也罢,说话首先要说人说,别让大模型都读不懂你的内容,你还指望他引用你呢?
  6. 流畅度:这个没得说,同样的题材,有人写出来就是一气呵成,有人就和便秘似的。大模型选哪个咱都门儿清。
  7. 独特性:如果你确实发表了一些高明的见解和独特的方法,放心,大模型可不会放过你。

希望GEO的出现,可以帮助更多的创作者知道如何在生成式引擎的大背景下,去优化他们的内容。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值