内容授权协议如何影响品牌在 AI 搜索结果中的可见性
了解与 OpenAI、Google 和 Perplexity 签订的 AI 内容授权协议如何决定您的品牌是否出现在 AI 生成的答案和搜索结果中。
了解出版商与AI平台之间的授权协议如何影响内容引用、在AI搜索结果中的可见性,以及对新闻机构和内容创作者的流量影响。
出版商与AI公司的授权协议直接决定内容在AI生成答案中的呈现方式和可见性。拥有正式协议的出版商通常能获得更好的归属标注、曝光度和报酬,而没有达成交易的出版商则常常面临归属错误、流量减少,且其用于AI训练的内容得不到任何补偿。
出版商授权协议已成为决定内容如何在AI生成的答案和搜索结果中出现的最重要因素之一。这些新闻机构与OpenAI、Google、Perplexity等AI公司之间的协议从根本上重塑了数字内容的可见性格局。当出版商与AI平台谈判达成正式合作关系时,他们获得了控制其内容在AI回答中被使用、训练和引用的能力。没有这些协议的出版商则面临岌岌可危的处境——其内容可能被爬取、用于训练并在AI回答中出现,却没有得到适当的归属标注或报酬。
出版商协议与AI引用之间的关系并非直截了当。虽然理论上授权协议应该改善归属标注和可见性,但实际情况更为复杂。一些拥有正式合作关系的出版商仍然遭遇归属错误,其内容被从转载版本而非原始来源引用,或者发现其内容出现在AI回答中却未带来有意义的网站流量。这些协议的财务条款差异巨大:中等规模出版商的固定授权费用在每年100万至500万美元之间,而像News Corp这样的大型新闻机构在五年期内的金额则超过2.5亿美元。
各AI平台上的引用模式显示与授权协议存在直接关联。 对ChatGPT、Google AI Mode和AI Overviews中成千上万个相同提示词的研究分析表明,拥有正式协议的出版商获得显著更稳定的引用。例如,ChatGPT在每个查询中提及品牌2.37次,但仅引用0.73次,这表明该平台会综合来自已授权来源的信息,但并非始终提供归属标注。相比之下,Google AI Overviews引用来源的频率要高得多(14.30次引用对比6.02次提及),这可能反映了不同的授权协议要求强制透明化来源标注。
AI回答中的可见性层级主要由授权状态决定。拥有重大协议的出版商——如News Corp(OpenAI)、Financial Times(OpenAI)、Associated Press(多个平台)和Dotdash Meredith(OpenAI)——在相关查询的AI生成答案中稳定出现。这些出版商受益于系统性地被纳入AI训练数据,并且通常拥有确保适当归属标注的合同要求。没有协议的中等规模出版商尽管产出高质量内容,但出现频率不稳定甚至完全不出现。小型出版商和独立创作者在AI搜索结果中几乎完全不可见,形成一种赢家通吃的格局——只有规模庞大、资源充足的机构才能谈判获得有意义的可见性。
| 出版商层级 | 授权协议状态 | 引用频率 | 流量影响 | 补偿模式 |
|---|---|---|---|---|
| 大型出版商 | 与多个平台有正式协议 | 一致,高可见性 | 最小但有保障 | 5年内5000万至2.5亿美元以上 |
| 中型出版商 | 有选择性协议或正在谈判中 | 引用不稳定 | 中等程度下降 | 每年100万至1600万美元 |
| 小型出版商 | 无正式协议 | 罕见或缺失 | 显著下降 | 零补偿 |
| 独立创作者 | 无法获得协议 | 几乎不可见 | 严重流量损失 | 无补偿 |
尽管授权协议日益增多,AI平台在准确和一致的引用实践方面仍然存在问题。 Tow数字新闻中心对八种主要AI搜索工具(Perplexity、Google AI Overviews、Bing Chat、ChatGPT、Claude、Gemini、Meta AI和Grok)进行的一项综合研究发现,超过60%的AI生成回答包含不正确或误导性信息。更重要的是,当AI搜索引擎提供来源时,它们经常引用被转载或重新发布的版本而非原始出版商,从而剥夺了原创新闻机构的直接流量和归属标注。
即使在拥有正式授权协议的出版商中,这种引用问题仍然存在。包括Grok和Gemini在内的一些平台经常生成无效或伪造的URL,误导用户并阻止他们访问合法的新闻来源。这个问题源于AI模型的训练方式和回答生成方式——它们会综合多个来源的信息,但缺乏健全的机制来追踪和正确标注原始来源。拥有授权协议的出版商拥有更多合同上的筹码来要求更好的归属标注实践,但各平台的执行情况仍然不一致。
授权协议补偿差异巨大,取决于出版商的规模、内容质量和谈判能力。News Corp与OpenAI的五年期协议价值超过2.5亿美元,是公开披露金额最高的交易。这相当于每年约5000万美元,用于获取华尔街日报、巴伦周刊、MarketWatch、纽约邮报及其他News Corp旗下内容的使用权。据报道,Financial Times每年从OpenAI获得500万至1000万美元,而Dotdash Meredith至少获得1600万美元,用于授权People、Better Homes and Gardens、Allrecipes和Investopedia的内容。
然而,这些授权费用必须与AI搜索蚕食所造成的流量损失进行权衡。Semrush在2025年9月的研究显示,93%的AI模式搜索以未点击来源网站告终。被AI回答引用的出版商获得了归属标注,但流量微乎其微。对于拥有授权协议的大型出版商而言,来自AI公司的保证收入可能抵消流量损失。对于中型出版商来说,经济账就不那么乐观了——每年200万至500万美元的授权协议可能无法弥补价值数百万美元的广告收入的10%至15%的自然搜索流量下降。小型出版商和独立创作者面临最糟糕的局面:没有授权协议、没有补偿,而且随着用户依赖AI摘要而非访问原始来源,流量遭受重大损失。
出版商对AI爬取的抵制日益加剧,尽管经济激励促使他们允许访问。到2025年5月,阻止率已达到相当高的水平:美国前50大新闻网站中有32%阻止OpenAI的搜索爬虫,40%阻止OpenAI的训练爬虫,56%阻止Perplexity,58%阻止Google Gemini,平均60%阻止Anthropic爬虫。这种广泛的抵制发生在出版商有机会谈判授权协议的情况下,表明业界对底层经济模式和对内容使用失去控制深感担忧。
Cloudflare的按爬取付费(Pay Per Crawl)计划于2025年7月启动,代表了出版商议价能力的重要转变。该平台使出版商能够为AI公司可以接受、谈判或拒绝的每次页面爬取设置微支付费率。Cloudflare的数据揭示了鲜明的爬取与引荐比例:Google为14:1,OpenAI为1,700:1,Anthropic为73,000:1——这意味着Anthropic爬取内容的频率是其产生引荐流量的73,000倍。由于全球16%的互联网流量流经Cloudflare,这一基础设施赋予出版商有意义的筹码来要求补偿。支持该计划的出版商包括Condé Nast、TIME、Associated Press、The Atlantic、ADWEEK、Fortune和Stack Overflow。
Real Simple Licensing(RSL) 于2025年9月推出,旨在为AI内容访问创建标准化、机器可读的授权框架。由RSS创建者Eckart Walther和前Ask.com CEO Doug Leeds联合创立,RSL使出版商能够直接在robots.txt文件中嵌入授权条款。该协议提供四种定价模式:按爬取付费、按推理付费(AI模型引用内容时收费)、订阅访问以及免费但需注明来源。收入分成模式在出版商的內容出现在AI回答中时,分配50%给出版商。
然而,截至2025年10月,尚无主要AI公司承诺遵守RSL标准。 OpenAI、Google、Anthropic和Meta均未签约,这限制了RSL的有效性——它更多是作为一个集体谈判的信号,而非可执行的机制。微软于2025年9月宣布的Publisher Content Marketplace,代表着首家大型科技公司尝试建立双边市场,出版商可以在其中向AI产品出售内容。试点项目涉及未具名的出版商,微软将自己定位为比竞争对手更对出版商友好。这些市场化举措表明,业界认识到仅靠双边授权协议是不够的,需要系统化的框架来实现可持续的内容补偿。
Anthropic于2025年9月与作者达成的15亿美元和解,创下了公开报道中最大的版权赔偿纪录,并从根本上改变了AI内容授权的经济格局。该和解涵盖约50万本据称从盗版来源获取的书籍,每位作者获得约3000美元的补偿。法官William Alsup的裁决区分了合法获取的内容(可能构成变革性合理使用)和盗版内容(明显不构成合理使用),为AI公司创造了直接向版权持有者获取授权而非从灰色市场爬取内容的法律激励。
这项和解为AI训练背景下的版权估值设定了每部作品3000美元的基准,为出版商和作者提供了切实的谈判筹码。支付时间表持续至2027年,若案件进入审判阶段,Anthropic可能面临每部作品高达15万美元的法定赔偿金。该和解的先例压力促使其他AI公司寻求正式授权,而非冒险使用盗版来源。正在进行的版权诉讼——包括大英百科全书和Merriam-Webster对Perplexity的诉讼,以及Penske Media对Google的诉讼——继续检验AI公司在系统性地复制综合性参考作品或在AI回答中综合已授权内容时,是否可以主张合理使用。
出版商现在必须应对复杂的局面——授权协议提供了一定的保护,但无法保证正确的引用或有意义的流量。最成功的策略包括多种途径:与主要AI平台谈判正式授权协议,通过Cloudflare的Pay Per Crawl或类似机制实施技术控制,参与像RSL这样的集体谈判框架,以及制定针对AI可见性优化的内容策略。出版商还应使用旨在追踪跨平台AI引用和品牌提及的工具来监控其在AI回答中的出现情况。
对于无法获得正式授权协议的内容创作者来说,情况仍然充满挑战。然而,有几种策略可以提高可见性:创建AI系统认为有价值的全面原创内容;建立强大的维基百科存在感(出现在47.9%的ChatGPT引用中);在Reddit等平台上发展活跃社区(在Perplexity引用中占主导地位,达46.7%);以及保持新鲜、定期更新的内容(65%的AI引用针对过去一年内发布的内容)。AI引用中的时效性偏好意味着常青内容策略必须被持续推送所取代,才能维持可见性。
如果正式授权协议未能带来更好的引用表现,请按顺序检查以下故障模式。首先,确认您没有被通过内容的转载版本或重新发布版本引用而非原始版本——这是有据可查的模式,AI平台会引用最容易找到的副本而非原始来源,即使存在授权协议,也会剥夺原始发布者的流量和归属标注。其次,检查您品牌的提及与引用比率是否异常偏低;被提及的频率与实际作为来源链接的频率之间存在巨大差距,表明平台在综合使用您的内容却没有始终标注来源——即使在已授权的合作伙伴中这也是已知问题。第三,确认您的爬虫没有被技术层面阻止——鉴于行业中主要爬虫的阻止率已达到50%至60%,常见情况是出版商已谈判达成协议,但独立的技术团队仍在阻止协议本应授权访问的爬虫。第四,如果引用存在但带来的流量极少,这不一定意味着协议出了问题——它反映了更广泛的模式,即无论授权状态如何,绝大多数AI辅助搜索都以无点击告终,因此流量恢复并不是正确的成功衡量标准;归属标注和补偿才是。最后,检查引用中是否存在无效或伪造的URL,这是某些平台上有据可查的问题,即使底层内容关系是合法的,也会误导用户。
了解与 OpenAI、Google 和 Perplexity 签订的 AI 内容授权协议如何决定您的品牌是否出现在 AI 生成的答案和搜索结果中。
了解新闻出版商如何为AI模型提供训练数据、协商许可协议,并通过内容合作与归属标准影响AI搜索引擎。
社区讨论内容许可协议如何影响出版商在 AI 生成答案中的可见性。出版商跟踪引用率的真实经验分享。