先锋 趋势 方法 投研 作者
AI时代内容价值的转移:Cloudflare CEO Matthew Prince
返回节目精读

AI时代内容价值的转移:Cloudflare CEO Matthew Prince

摘要

  • Cloudflare的布局远不止CDN,Prince描述的是为AI塑造的互联网重建网络。 主持人提到Cloudflare约660亿美元的市值和18亿美元的过去12个月收入。Prince表示,主要AI公司中80%是Cloudflare客户,公司的网络位置正延伸至安全、边缘推理、爬虫权限和支付。

  • AI正在打破支撑互联网内容30年的流量交换体系。 Prince称,相比10年前,同样的内容获得一次Google点击的概率下降了10倍;与“过去的Google”相比,来自OpenAI的转介难了750倍,来自Anthropic的转介难了3万倍。当用户消费的是原作的衍生内容而非原作本身,创作者会同时失去产品销售、广告收入,甚至“被读到”的精神回报,最终可能让互联网和以其为训练数据的模型一起陷入内容饥荒。

  • 在出版商制造稀缺性、并能通过技术手段执行之前,内容市场不可能形成。 Cloudflare的“内容独立日”于7月1日启动,默认阻止AI训练,对付费和免费客户一视同仁。Cloudflare正与IETF及其他标准组织合作制定爬虫声明和更细粒度的权限,例如允许人类访问、但要求机器人付费。robots.txt只是“街边路牌”;Prince称,一些知名公司用类似俄罗斯或伊朗黑客的手段绕过封锁,并暗示部分违规AI公司可能很快被点名。

  • Prince希望AI奖励的是信息增量,而不是Google时代的参与度套利。 搜索让出版商迷信流量,催生了为制造“最大皮质醇反应”而反复测试的标题;模型则更像瑞士奶酪,会删去重复内容,留下的空洞反而更有价值。Spotify证明了新的分发体系可以把蛋糕做大:iTunes出现前,音乐行业规模约为80亿-90亿美元,如今仅Spotify每年支付的金额就超过100亿美元。

  • Google是决定定价能否落地的闸门,因为其他模型供应商担心它拥有免费内容的特权访问权。 Prince希望把普通搜索索引与答案框、AI Overviews和Gemini中的内容改造分开:“那是另一笔交易。”他认为用2000万美元买下一整个内容档案是“极其天真”的做法,更支持让报酬与AI订阅或广告收入挂钩,使创作者能在旧有经济模式崩解时参与上行收益。

  • 如果模型效率大幅提升、工作负载从超大规模数据中心扩散到设备和边缘,推理经济学将有利于Cloudflare。 Cloudflare在2020年推出NVIDIA边缘GPU时“无人问津”,但同一套理念4年后迅速起飞。Prince预计,未来5-10年,行业会在GPU上“速通过去30年的CPU效率提升”;推理效率提高100倍,将利好Cloudflare按用量收费的模式,却会打击出租整块GPU的超大规模云厂商。

  • 代理流量可能把Cloudflare的网络位置变成身份、权限和支付基础设施。 Cloudflare每天处理约15万亿次请求,按访问次数进行微支付的规模已经大到Bitcoin、甚至按Prince的说法大到Solana都难以承受。Prince设想用加密签名的身份和权限区分人类、由人类指挥的代理、自主代理和浏览器,并规定抓取的数据可以如何再次使用。

精读

1. Cloudflare诞生于互联网缺失的一层

  • 主持人先介绍Cloudflare的经营规模:约660亿美元市值、约18亿美元过去12个月收入,以及遥遥领先的全球CDN覆盖。Prince马上纠正了这一分类:“我们从来没有真正把自己看作CDN。”公司最初的问题是:防火墙能否迁移到云端,同时不让互联网变慢。

  • Cloudflare于2010年9月推出,成立时间接近15年。Prince给出的更大叙事是架构层面的:如果20世纪60、70、80年代的设计者当时知道互联网会变得如此核心,Cloudflare就是“网络本该有的样子、互联网本该有的样子”——更快、更可靠、更安全、更高效,也更注重隐私。

  • “零号客户”解释了产品线为何不断扩张。免费防火墙为公司提供了所需数据,但服务数百万客户也带来了各种非典型网站、来自四面八方的攻击、公共政策问题和内部安全需求。在有人险些窃取Cloudflare域名后,公司又自建注册商业务:先从一项覆盖面广的服务起步,再“解决由此自然产生的所有问题”。

2. AI摧毁搜索创造的转介经济

  • Prince把旧互联网的价值来源归纳为3类:销售产品或订阅,以内容为基础销售广告,或者因被阅读而获得认可。“人们创作内容只有2个原因:要么变富,要么出名。”Wikipedia和大部分开放互联网都依赖第3种、非财务性的激励。

  • 搜索主导了30年的价值创造,但AI正在成为新的界面——甚至在Google内部也是如此。结构性变化在于,用户消费的是原作的衍生品,而不是原始作品;答案框和AI Overviews则在点击发生之前就已经回答了问题。

  • Cloudflare的数据把恶化程度说得很清楚:与10年前相比,获得同样一次Google点击已经难了10倍。相对于“过去的Google”,Prince认为OpenAI难了750倍,Anthropic难了3万倍。对于Pew关于AI Overviews减少链接点击的发现,他的评价是:“这有点像,嗯,废话。”

  • 主持人把代理商业和内容区分开来。Prince认为,商业相对容易处理,因为商家希望代理购买自己的商品,尽管信息聚合商可能被绕过。内容则从一个更糟糕的默认状态出发——模型免费拿走内容;流量消失,可能同时让独立出版业和“它们引擎的燃料”陷入枯竭。

3. 版权无法解决衍生内容悖论

  • 这位“改过自新的法学教授”Prince认为,版权法存在一个令人不安的倒置:AI输出越具有衍生性,越可能被认定为合理使用。但正是这种转化,让用户更不可能访问来源。加州在同一周内作出的2项判决得出了相反结论,也强化了他的警告:今天的法律可能救不了出版商。

  • 他与主要AI公司的沟通在原则层面更令人鼓舞:“你说得完全对。我们应该为内容付费。”问题在于竞争对称性。没有哪家实验室愿意付费,而Google或其他竞争对手仍能免费获取同样的材料,尤其是在每家公司都相信自己的技术最终会在公平赛道上胜出的情况下。

  • Prince的逻辑是绝对的:“要有经济,就必须有市场。要有市场,就必须有稀缺性。”在与美联社、Ziff Davis等机构展开、覆盖纸媒、音频、视频、音乐和电影的讨论后,Cloudflare于7月1日将AI训练访问设置为默认阻止,并向所有客户免费提供这项服务,无论客户付费与否。

  • robots.txt依然过于粗糙,也过于依赖自愿遵守。Prince把它比作路边的标志,司机完全可以视而不见。Cloudflare正与IETF及其他标准组织合作制定爬虫声明和更细粒度的权限,例如“人类可以免费获取我的内容,但机器人必须付费”。他还指称一些知名公司用类似黑客的手段绕过封锁,并暗示部分公司可能很快被点名。

4. 更好的市场会付钱给填补知识空白的创作者

  • Prince指责Google——不是因为它是最糟糕的参与者,而是因为这家总体上有益的公司拥有有害的激励机制——教会创作者把流量当作价值代理指标。Huffington Post式的标题测试追求“最大皮质醇反应”,Demand Media和BuzzFeed则围绕愤怒、重复和新闻的轻微变体优化,而不是推动知识进步。

  • 他的替代性比喻是“一大块瑞士奶酪”。AI模型总体上接近人类知识,但其算法会删掉固体奶酪中已经存在的信息;留下的孔洞反而异常有价值。因此,内容市场应该奖励填补这些孔洞的人,而不是奖励最能刺激皮质醇反应的人。

  • Daniel Ek和Spotify是Prince最有力的商业案例。iTunes上线前一天,音乐行业规模约为80亿-90亿美元;如今仅Spotify每年支付的金额就超过100亿美元。Spotify还会把无人回答的搜索发布给音乐人,Prince称,其中一些人每年创作满足这些明确未满足需求的音乐,收入“确实达到数千万美元”。

  • 主持人问,Mercor、Surge或Scale等专家数据公司是否已经在做这件事,并提到Med-PaLM 2的表现超过了平均医生。Prince不接受“有用的人类内容会耗尽”这一想法:实验和发现仍在继续。他设想的更黑暗场景是,5个政治或地理上的AI孤岛各自雇用记者和科学家,而不是向那些能被所有模型共享其知识的独立创作者付费。

5. Google必须失去特殊地位,价格才能真正出清

  • 规模上的问题在于,支付给数据标注公司的总金额可能约为100亿美元,远低于开放互联网的广告经济。Prince认为内容本身有价值,但创作者犯下的错误是签署了无法随AI业务规模增长的协议;他支持让报酬与订阅收入或广告收入的一定比例挂钩。

  • 在Prince看来,出版商以2000万美元的固定价格交出全部内容,是“极其天真的交易”。随着AI经济扩张,补偿也应同步增长:可以按订阅费或未来广告收入的一定比例计价,让创作者在AI挤压广告和转介收入的同时分享上行收益。

  • 眼下的直接战场,是阻止Google继续成为“特殊的独角兽”。Google过去的交换是用索引权换取流量,但Prince称,如今Google拿走的内容规模不变,返还的流量却只有原来的1/10。10年前封锁Google不可想象,6个月前还很激进,如今已成为积极讨论的话题;搜索索引应与答案框、AI Overviews和Gemini的内容改造明确区分。

  • Condé Nast、Dotdash Meredith、The New York Times和Reddit等大型出版商可以谈判直接协议。Cloudflare可能承担的是长尾市场:集中授权、微支付,或为训练和搜索分别设定费率。Prince给创作者的建议是重新夺回控制权,利用谁在持续尝试抓取其内容的数据,提出“公平的价值交换”,而不是继续免费开放访问。

6. 能效提升将把推理推向设备和边缘

  • Cloudflare在2020年与NVIDIA合作,将GPU部署到网络边缘;发布时“鸦雀无声”,连一条销售线索都没有。4年后,基本相同的新闻稿却“像暴风一样起飞”。Prince预计,大量推理会在设备端运行,而过大或资源消耗过高的模型则会转移到距离最近的网络边缘。

  • 部分本地执行不是可选项,而是硬性要求。一辆无人驾驶汽车看到红球后又看到孩子,不能让刹车是否启动取决于网络状况。因此,手机、汽车和Cloudflare设施面临的共同约束就是能效,因为边缘节点无法假设自己拥有一座新建100兆瓦数据中心的能源条件。

  • Prince回忆,2011年他曾告诉Intel,Cloudflare只关心“每瓦核心数”,而Intel当时建议使用水冷。当更现代的GPU产能可能需要“你自己的封存核电设施”时,他听到了类似的回声。Apple证明高效加速器是可能的,Prince认为,能耗长期维持在如此高位“没有任何物理学上的理由”。

  • Prince认为DeepSeek带来的启示是真实的科学进步:训练和推理效率确实提高了,只是在美国被关于中国的争论掩盖。压缩和剪枝可以移除概率极低的分支,而不破坏性能。他预计,不久后手机就能运行当前一代ChatGPT的同等版本;未来5-10年,GPU系统将速通过去30年的CPU效率提升,也包括Spectre等安全问题带来的经验教训。

  • Prince总体上支持开放模型:更多开放模型运行在Cloudflare上,公司也与Meta密切合作开发Llama。他认为“开源模型会毁灭世界”的说法过于歇斯底里;对于合成病原体等风险,他会选择监管打印这些东西的机器,而不是监管提出方案的模型。

7. 代理让网络成为身份与结算层

  • Prince称,主要AI公司中80%是Cloudflare客户,不断推动公司增加能力。Cloudflare按完成的工作收费,而不是按预留硬件收费,因此推理效率提高100倍将是“对我们来说是好消息”,对“超大规模云厂商来说是坏消息”。Prince并不打算打造前沿模型,而是在寻找AI领域的“VMware”:能够切分昂贵GPU,让客户无需预留整台机器或承诺使用1年。

  • MCP或其继任者将把代理连接到各类服务,而其中大量流量都必须经过Cloudflare。Prince预计,多个代理基础设施供应商会通过标准互联,安全与支付能力则叠加到网络之上:加密货币“仍然需要网络”,AI同样需要。

  • 内容微支付可能让Prince过去曾怀疑的区块链思路重新获得生命,但Cloudflare每天处理约15万亿次请求,规模已经超过Bitcoin,甚至按他的说法也超过Solana。最终系统必须区分人类、与人类关联的代理和自主代理,并为每一类主体提供不同权限。

  • 浏览器带来了同样的治理问题:如果一个浏览器会立即把抓取到的材料输入LLM,它可能应该获得更窄的访问权限。Prince设想用加密签名声明身份和获准用途;Elad Gil则提到零知识证明,可以在不泄露凭证的情况下证明身份资质。“所有基础组件”早已存在,只是直到最近几个月,它们组合后的整体形态才开始显现。