AREX Feed Article
10 亿次月请求,0.5 个 infra 工程师:Factory 把整个后端押给了 Vercel
Next.js 只能写前端?一家 $1.5B 的 AI 公司不这么想
在大多数技术团队的认知里,Next.js 是一个前端框架,Vercel 是部署前端应用最快的平台。至于后端,API 服务、中间件、Webhook 管线,那是 AWS、GCP 或者 Kubernetes 集群的领地。
Factory 打破了这套叙事。
这家估值 $1.5B 的 AI 编程平台公司,把整个生产后端跑在了 Vercel 上。不是"部分静态页面",不是"营销站点",是承载全部客户 API 请求的后端基础设施。一个月 10 亿次请求,p95 延迟 350 毫秒。
8 月 4 日,Vercel 官方发布了一篇客户案例,详细记录了 Factory 如何在 Next.js 上建起这套架构。推文发出后迅速引发讨论,144 次赞,8.7 万次浏览。
Vercel CEO Guillermo Rauch 亲自转发并写道:"Vercel is the Vercel for backends." 这条转推获得 280 次赞和 5.3 万次浏览。
Factory 工程师 Alvin Sng 的回应更直接:"Outsource your infra. That's how we scale to billions of requests with 35 engineers and 0.5 infra engineers." 149 次赞,2.4 万次浏览,53 人收藏。
10 亿次月请求,p95 延迟 350 毫秒
Factory 从 2023 年创立起就使用 Vercel。三年间,同一个 Next.js 应用从简单的 Web 应用膨胀为覆盖 API 路由、中间件、Webhook 处理器和日志管线的全栈后端。
核心数据:
- 月请求量:10 亿次
- p95 响应延迟:350 毫秒以下
- 团队规模:35 名工程师,0.5 个专职基础设施工程师
- 每日内部部署次数:数十次,由 Factory 自研的 Droid agent 自动完成
Factory 技术团队负责人 Nikita Lilichenko 在案例中表示:"我们每天处理数千万次 API 请求。从第一天起就在 Vercel 上,基础设施从未拖慢我们。"
API 路由、中间件、Webhook:一个应用吃掉全部后端负载
Factory 对 Next.js 的使用方式,与大多数团队完全不同。
API 路由承载客户 API。 Factory 的客户 API 作为 Next.js 应用的一个独立区域启动,直接处理外部请求。团队从不需要单独搭建 API 网关或负载均衡器。
中间件管理认证与路由。 每个请求经过 Next.js 中间件层完成身份验证和路由分发,覆盖 Web 端、桌面端和 CLI 全部产品表面。
Webhook 和日志管线跑在同一个应用里。 分析数据通过 Webhook 处理器流入下游系统,日志通过 drain 管线输出到监控平台。没有独立的微服务,没有额外的基础设施决策。
唯一需要调优的是内存上限和函数执行时长。两项参数都可以在 Vercel 上直接调高,不需要迁移。
Fluid Compute 是这套架构的性能底座。它让函数实例在请求间保持温热,消除了传统 serverless 的冷启动惩罚。对延迟敏感的 API 服务来说,冷启动意味着用户体验断崖。Fluid Compute 通过复用空闲实例和字节码缓存,把 p95 延迟压到了 350 毫秒。
安全层面,Vercel WAF 承担了网络层的防护。Factory 开放自助注册后,自动化攻击随之而来,机器人批量创建虚假账户,恶意 IP 涌入。WAF 的路由级规则、速率限制和 DDoS 防护持续运行。团队通过 Vercel Observability 监控流量模式,发现异常后直接封禁。
Lilichenko 说:"我们每天数千万请求,我没为 API 的安全性失眠过。Vercel 的 WAF 和速率限制一直开着,一直在工作。"
Factory 还把自研的 Droid agent 接入了 Vercel。非技术团队的成员通过 Factory Desktop 或 CLI 命令 Droid 直接构建和部署内部分析仪表板、客户演示环境、一次性工具。Droid 通过编程接口操作 Vercel 的配置、构建和部署流程,工程团队设置护栏并审查高风险操作,其余由 agent 自主完成。
35 个人,每个月把收入翻一倍
Factory 由 Matan Grinberg 和 Eno Reyes 于 2023 年在旧金山创立。Grinberg 从 UC Berkeley 物理系退学,与普林斯顿同学 Reyes 一起启动了这家公司。他们的核心主张:软件工程不应该是逐行写代码的劳动,而应该由自主系统并行生产。
产品形态是名为"Droid"的 AI coding agent,覆盖软件开发生命周期的每一个阶段,从 triage 到 plan、execute、validate、ship、monitor。Factory 的平台模型无关,部署方式从 SaaS 到完全气隙私有化都支持。
2025 年 9 月,Factory 完成 $50M Series B,由 NEA 领投,Sequoia、J.P. Morgan、Nvidia 等跟投。2026 年 4 月,仅 7 个月后,Factory 再获 $150M Series C,由 Khosla Ventures 领投,估值达到 $1.5B。总融资额超过 $3.2 亿。
增长数据同样激进:过去连续 6 个月,收入每月翻倍。客户名单包括 Nvidia、Adobe、EY、Palo Alto Networks、Adyen。平台上每天有数十万开发者在用 Droid。
联合创始人在 Series C 公告中写道:"我们正在构建 agent-native 开发的确定性平台。软件不再逐行编写,而是由并行运行的自主系统生产。"
当 AI 编程公司不养 infra 团队
Factory 的选择在 AI 编程赛道里并不常见。
同赛道的 Cursor、Copilot、Devin 等产品,大多把后端部署在 AWS 或 GCP 上。Factory 的"全押 Next.js + Vercel"路线,在创业公司中不算罕见。但放在 $1.5B 估值、服务几十万开发者的规模上,是一个强烈的表态。
对一家以速度为核心竞争力的 AI 公司而言,基础设施不是差异化来源。花时间搭建 Kubernetes 集群、调参负载均衡器、配置 CI/CD 管线,不如把这些精力全部投到产品上。
Alvin Sng 那条"35 个工程师,0.5 个 infra 工程师"的推文引发共鸣,是因为这个数字把一种直觉变成了可量化的现实。少养一个 infra 团队,省的不只是钱。整个组织的注意力没有被分散。
Vercel 也需要这个案例。过去一年,Vercel 的定位从"部署前端的最佳选择"转向"agentic infrastructure for apps and agents"。2026 年 6 月,Vercel 推出新框架和 enterprise controls,AI Gateway 流量从 200 万增长到 2000 万。Factory 的案例是 Fluid Compute 迄今为止最重量级的背书。10 亿次月请求,不是一个演示项目的数字。
基建不再卡脖子之后
Factory 的故事本质上是对一条老问题的回答:初创公司应该在什么时候自己建基础设施?
Factory 的答案是:不建。
三年,10 亿月请求,$1.5B 估值。这个路径上没有任何一步被 Vercel 卡住。团队不需要分散精力做基础设施决策,全部注意力放在产品上。从单一的 Web 应用扩大到覆盖整个 SDLC 的平台,从 coding agent 演进到多 agent 协作的 Missions 系统。每一步都发生在同一个 Next.js 应用里。
Nikita Lilichenko 在案例末尾说:"我们在快速增长,并且信任 Vercel 会和我们一起扩展。"这不是客套,是 Factory 三年生产实践的结论。
参考链接: