AI是怎么挑选引用来源的?
谢尔盖·卡尔普(纽约), 联合创始人 / CTO
当AI回答关于产品、服务或公司的问题时,它通常不会只靠自己的“记忆”。它先在网上搜索,拿到一批页面,挑出最相关的几个,再用自己的话复述,并注明用到了哪些页面。这种做法叫检索增强生成,即RAG。
核心要点
AI在网上检索,然后引用那些能访问、能直接回答问题、事实可核实、并被其他网站佐证的页面。
哪些页面更常被引用:
- 进得去的。网站对搜索引擎和AI爬虫开放,加载快,正文不依赖沉重的脚本就能看到。
- 直接回答问题的。开头先给简短答案,随后是细节、表格和列表。
- 事实可核实的。价格、工期、地点、公司信息和署名作者俱全,而且这些事实与其他来源对得上。
- 有他人佐证的。这家公司在第三方网站上被提到:目录站、行业媒体、点评平台。
每个AI平台找页面的方式各有不同。Google AI Overviews和AI Mode建立在Google索引之上,Microsoft Copilot依托Bing。ChatGPT、Claude和Perplexity则用自家的爬虫(OAI-SearchBot、Claude-SearchBot和PerplexityBot),同时也借助搜索合作方。但什么算一个好来源,各家的标准是相似的——正因如此,AI搜索优化才变得足够可预测、可以规划。
这里有个很实际的推论:一家公司进入回答分两步。第一步,它的页面得先被找到、被读到,这是经典SEO的活儿。第二步,它那一段内容得比竞争对手更有用,这是生成式引擎优化(GEO)的活儿。所以GEO是建立在扎实的传统SEO之上,而不是取而代之。
回答本身也会变。同一个问题问两遍,引用的网站可能不同,这取决于措辞、用户所在地,以及索引有多新。所以目标不是守住某个固定位置,而是尽可能多地出现在客户的各种问题里。完整机制我们在AI搜索排序因素一文里做了拆解。
AI搜索优化自2002年起从事SEO,把网站变成AI愿意选用的来源。费用为每月290美元,含前10小时工作时长,每增加1小时45美元。预约通话:我们会让您看清,在您这个行业里,AI为什么引用某些网站、而不引用另一些。