再建一个数据中心,兄弟

Ade Adepoju
Ade Adepoju2小时前
再建一个数据中心,兄弟
Ade Adepoju
Ade Adepoju
Ade Adepoju 是 Subzero Labs 的联合创始人兼首席执行官,也是专用智能区块链 Rialo 的两位核心工程师之一。在创立 Subzero Labs 之前,他是 Mysten Labs 的早期工程师,在构建 Sui Network 方面发挥了奠基性作用,更早之前,他曾在 Netflix 从事分布式系统工作,并在 AMD 从事先进微处理器技术相关工作。 横跨 Web 2.0 与 Web3 的深厚基础设施经验组合,是 2025 年 Pantera Capital 选择领投 Subzero Labs 2000 万美元种子轮融资的重要原因之一。如今,Ade 领导 Subzero Labs 搭建全球新金融(neofinance)基础设施的工作,其中包括 Latch——公司面向 AI 智能体的政策赋能(policy enablement)技术栈。

关于诱导需求、裁员,以及我们尚不会使用的 AI 的真实成本

如果你在 X(原推特)上关注过公共交通话题,你一定见过这个梗。

「再加一条车道,兄弟。」

一个蜡笔画风的公路工程师站在高速路旁,指着他想要新增的车道,因为路太堵了。他的表情很真诚。这次他要把问题解决。只要再多一条车道,拥堵就会消失。

拥堵几乎从来不会消失太久。

新车道带来新出行。新增容量创造新增需求。经济学家称之为诱导需求。德州的 Katy 高速被扩建成世界上最宽的高速之一。洛杉矶的 405 高速花了 10 亿美元扩建。几十年间的高速扩建都在重复同样的模式:容量增加,使用量随之填满,拥堵重新出现。

梗图里的工程师还是会一遍又一遍地要求「再多一条车道」。

现在,在 AI 数据中心上,我们来到了同样的时刻。

「正确基础设施」的推销话术

每个季度,超大规模云厂商都会再发一则公告。又一个百亿级项目。又一座园区。又一座变电站。又一份电力协议。又一场水资源之争。又一个被告知「这就是进步代价」的乡郡。

理由永远相同。

AI 需求在爆炸式增长。我们需要更多算力。如果不建,美国就会落后于中国。企业拿不到所需的容量。开发者会被束缚。创新会放缓。

再建一个数据中心。

再建一个千兆瓦园区。

再圈一块 2,700 英亩的地。

再做一次电网升级。

然后,我们就够用了。

不过是同一个工程师,换了一张蓝图。

这是一场世代级的基础设施豪赌,而且相当一部分已经签约落地。

这不是在说 AI 不需要基础设施。某些新的容量是必要的。

问题在于:在迫使买方证明他们在聪明地使用现有容量之前,我们是否应该继续以现在这样的速度承诺新增容量?

眼下,那些爆炸式增长的需求,有一部分是真正的新增生产力。还有一部分,是完全可以避免的消耗——由糟糕的默认配置、失控的重试、过期却仍然有效的凭证、性能远超所需的模型,以及从未被要求证明其成本合理性的工作负载所制造出来的。

被诱导出来的需求

算力并不存在一条固定的需求曲线。它会向所有可用的供给弯曲过去。

把前沿模型廉价地交到开发者手中,很多工作负载就会默认跑在前沿模型上。给智能体一个大预算,很多智能体就会把预算花光。给团队不受限的 API Key,账单就会一路涨,直到有人注意到。

等到有人注意到时,这个工作负载早就上线了。

一个创始人,在客服流水线的每一个步骤都调用昂贵模型,只因为工程师当时为了快速上线,默认就选了那个模型。流水线能跑。账单开始变得刺痛。后来才有人发现,这个工作负载里有大半其实可以跑在更便宜的模型上,几乎没有任何可测量的质量损失。

这不是离谱的边角案例。这往往就是快速迭代的 AI 开发的常态。
默认是错的。浪费是隐形的。账单来得很晚。

同样的事情到处在发生。

一个检索系统把重复内容都做了嵌入。一个客服智能体在重试里死循环。一个写代码的智能体拿最贵的模型处理最琐碎的修改。外包方的 Key 在合同结束后继续有效。离职员工的 Key 在离岗后依然能用。一个生产环境的 Key 最后出现在某个人的笔记本电脑里。

他们未必是恶意的。只是系统根本没人管。

当 AI 行业说需求在爆炸时,其中一部分确实是真实的生产力。还有一大部分,是坏默认、过期凭证、缺失的预算控制,以及无人监管的机器劳作。

增加算力并不能解决这个问题,它只会喂养这个问题。连像亚马逊这样的公司都在报告这一点。

这就是诱导需求。这就是那条高速公路。

「人出、机进」的心态

在员工人数下降、AI 预算上升的背景下,这两者常常被明确地绑在一起。微软已经明说,它的裁员并不等同于单纯用 AI 来替代。Sam Altman 也承认,对某些裁员把原因归因到 AI 上,是他所谓的「AI 洗白」:用 AI 作为借口,为本来无论如何都会发生的裁员辩护。CEO 们的调研也在显示,他们不得不基于 AI 来规划调整。

数据真正清晰地展示出的,是优先级的重新分配。Challenger 描述说,科技公司正在围绕 AI 重组,自动化某些岗位,并把预算重新分配到新的能力上。具体的某个员工和具体的某块 GPU 并不需要一一对应,这种资本迁移依然是真实存在的。

这反而让那个不舒服的问题变得更尖锐,而不是更柔和。

如果这场交易不是用人换 AI 生产力,也不是完全用人换一无所获,那么机器这一侧的账本到底是什么?没人能给出有力的答案,因为 AI 开支正在变成人工成本,却完全没有用接近管理工资的严谨度来管理它。

人类员工有管理者、有预算、有权限控制、有公司卡、有门禁卡、有离职流程、有绩效评估和审计回溯。

机器员工,往往只有一个 API Key。

我们正在把预算,从人类工资转移到机器工资,然后却把机器工资当作一堆密码来管理。没有所有者。没有管理者。没有有效期。没有消费政策。没有「凭条」。没有「每个有用结果的成本」。没有证明机器劳作的价值足以配得上机器的成本。

API Key 是新的公司卡

一家公司绝不会说:「有个前员工的公司卡一直没收回,没人知道它在刷什么,我们几个月后才发现。」这会被视为显而易见的运营失败。但在 API 这一层面,这种事天天都在发生。

一个模型服务商的 Key 能制造开支。一个云厂商的 Key 能创建基础设施。一个 Stripe 的 Key 能移动资金。一个 GitHub 的 Key 能把代码推到线上。一个数据服务商的 Key 能访问付费数据集。一个广告平台的 Key 能烧掉广告预算。一个交易所的 Key 能交易资产。

它们不只是秘密信息。它们是经济权力。

太多 API Key 仍然被当成密码在对待。它们需要被当成机器用的公司卡来管理。

外包团队、开发商、营销代理、审计机构、兼职团队、员工和智能体,都需要对这些资源拥有此起彼伏的访问权限。今天,公司要么授予过度访问,要么把一切拖慢。项目结束了,访问仍然存在,开支继续流出。

这不仅是安全问题。这也是会计问题,是治理问题,也是基础设施问题。

当地人很清楚

公众对数据中心的反弹不只是「别建在我家后院」的排斥(NIMBYism)。人们能感受到那种矛盾。盖洛普的一项民调最近发现,十个美国人中有七个会反对在自己城市建设 AI 数据中心。

数据中心消耗巨量电力。取决于冷却设计和地点,它们也可能消耗大量水和土地。它们带来真实的热量、噪音、电网输送之争,以及地方政治压力。好处常常显得遥远、私有、或带着高度不确定性。代价却是本地的。

基础设施负担被集中压在乡郡。经济收益却被摊薄,并且往往被别处攫取。好处被承诺在未来。代价却先一步到来。

这是政治上不稳定的。到 2026 年,它不再只是预测。

行业不应该对数据中心变成全国性的政治斗争感到惊讶。如果 AI 基础设施向社区索要土地、电力、水和耐心,这个行业就应该有能力证明,这些算力被用得很值。

而现在,很多买方做不到。

用人换不计量的机器,是错的

把这些层面叠在一起看。

一个 CFO 看了 AI 投资论,批准了扩建,裁员为此腾出预算,然后向董事会保证账算得过来。算力被预配好了。工作负载上线了。默认配置是错的。Key 没人管。昂贵模型被严重滥用。智能体重试过多。旧凭证继续有效。账单涨得比预期快得多。

董事会问为什么。回来的答案是:AI 需求在爆炸,我们需要更多容量。于是 CFO 签下下一份合同。循环重演。

与此同时,被取代的员工看着公司在 AI 系统上大笔花钱,而这些系统能否真正带来承诺的生产力,却未必说得清。一位县委员要接到关于电力、水资源、土地和噪音的愤怒来电。电网运营方试图让账面平衡。一位当地居民被告知,这就是未来。

太多时候,这场交易并不是用人换生产力,而是用人换不计量的机器
劳作。用人换坏默认。用人换混乱。等到这些混乱变得昂贵,行业给出的答案不是自律,而是再建一个
数据中心。再来一个,兄弟。

真正的答案

真正的答案不只是多建数据中心。

真正的答案,是聪明地使用我们已经有的数据中心。

这对行业来说是句不太好说出口的话,因为激励并不完全一致。服务商往往是在消费上涨时赚钱。买方则是在有用结果增加时获胜。这两条曲线并不相同。

买方的利益是具体的。

买方想要的是:能完成任务的最小模型。能解决问题的最少调用。在项目结束时自动失效的 Key。只在正确设备上才生效的凭证。一旦智能体偏离策略就会被切断的执行。只有在商业论证真实可信时才获批的例外。

这些都不需要新建数据中心。它需要的,是对我们已经拥有的算力进行智能的配置。

通往解决方案的道路很无聊

把工作负载与模型大小匹配到合适的程度。能批处理的就批处理。能缓存的就缓存。该约束的就约束。该授权超标的就明确授权。运行在错误配置上的,就直接拒绝。 credential,从错误的设备、由错误的持有者、用于错误的工作。按“有用结果”计量成本。自动过期访问权限。终止失控的循环。将低风险工作路由到低成本模型。只有在质量确有需要时才升级到更贵的模型。生成凭证 / 回执。

市场已经开始注意到这一点。今夏起,CFO 和董事会开始收紧那些远超预算的 AI 账单。模型路由从论文概念走进董事会的词汇表,各团队开始寻找办法,把例行工作交给更便宜的模型,同时不牺牲质量。模型提供商自己也开始推出管理开支上限,因为客户要求能有办法控制账单。

很好,这一波是真实且姗姗来迟的。提供商现在支持会在触达额度时直接拒绝调用的硬性支出上限、按用户限额,以及审批流程。

但请注意这一波的边界。这些控制手段只管到单一提供商、单一项目或单一应用内部的消耗。路由能选一个更便宜的模型,上限能拦住失控的账单,但两者都没有回答更大的“权限”问题:到底是哪台机器、从哪个运行环境、代表谁、为了什么目的、访问了哪些外部资源,以及事后有什么可携带的证明。成本控制不等于可编程、可验证的权限管理。

AI 需要的是完整的规范约束,而不仅是“成本”这一半。不是因为 AI 有多坏,而是因为 AI 正在变成“劳动力”。而劳动力需要管理。

AI Agent 所缺失的那一层

这就是我们认为 AI 正在缺失的那一层,它刻意要比整个 FinOps 堆栈更窄。

经济权限应当在执行之前被治理:谁和什么可以花钱、从哪个设备和运行环境、为哪类工作负载、在什么限制之下。并且在最后要有一份真实的人可以核验的回执。

数据中心的扩建有一部分确实是必要的。AI 是真的,而真实的事物需要基础设施。但如果需求是失管的,那么所需的建设规模会更大、更快、更难被证明其合理性。正确的道路不是账单出来之后再看一个更漂亮的仪表盘,而是在“凭证”层面加上控制,在花钱发生之前就加以约束。

朝正确的方向前进

再建一个数据中心,哥们。

我们保证这次一定奏效。算力马上就要上线了。浪费率马上就要降下来了。利润率马上就要显现了。工作负载马上就要变得高效了。当地居民马上就要接受了。电网马上就能扛住了。那一万亿美元的租约马上就会显得保守。董事会马上就要看到生产率的提升。

就再来一个。

也许其中一部分产能是必须的。但在整个行业再次向社区索要更多土地、更多水、更多电力和更多耐心之前,买方应该先能回答一个更简单的问题。

我们是否已经在很好地使用现有的算力?不是在一页 PPT 或一份政策备忘录里。

而是在回执里:用了哪个模型。哪个工作负载需要它。哪个密钥授权了它。这才是下一场 AI 基础设施之战的焦点。不是“要不要算力”,而是“有治理的算力”对“浪费的算力”。

别再盲目建设。先把手里的用好。

免责声明和风险警告:本文提供的信息仅用于教育和信息目的,基于作者的意见。它不构成财务、投资、法律或税务建议。加密货币资产具有高度波动性并面临高风险,包括失去全部或大部分投资的风险。交易或持有加密资产可能不适合所有投资者。本文表达的观点仅为作者的观点,不代表Yellow、其创始人或高管的官方政策或立场。在做出任何投资决定之前,请务必进行自己的全面研究(D.Y.O.R.)并咨询持牌金融专业人士。