Serverless账单正在被重算:Vercel Fluid Compute实测,AI应用成本直降40%

10月15日,Vercel Ship 26大会将在旧金山登台。Blackbox、Anthropic、SpaceXAI等团队会现场分享AI Agent的生产经验。大会还没开,Vercel这套新底座已经值回票价。Fluid Compute、AI SDK 6、Workflow SDK三件套,正在把Next.js从”前端框架”变成一台Agent运行时。开发者最关心的账单问题,这次有了实测数据。

45秒的流式响应,只按2秒计费

传统Serverless的死穴在AI场景暴露无遗。一条流式对话响应动辄30到60秒,容器在绝大多数时间里只是干等着Token往外蹦。每个请求独占一个实例,几百个实例同时”睡觉”,账单却照收不误。

Fluid Compute换了打法。一个容器同时处理多个并发请求,Rust内核每秒多次向路由层上报指标,扩缩容看真实CPU压力,请求量只是参考。

数字摆在这里:99.37%的请求感知不到冷启动;单个实例扛得住250以上并发;计费模型叫Active CPU,只在真正执行计算时收钱。一条45秒的LLM流式响应,CPU实际干活约2秒,旧模型收45秒的钱,新模型收2秒。

Suno在Beta阶段接入后,函数负载成本省下约40%。GitHub上Vercel工程师Malte Ubl的总结更实在:Sandbox、Builds、Functions共享同一套Fluid内核,一处优化全线受益。

一个小提醒:2025年4月之前创建的老项目默认没开Fluid,不手动切换,就还在按旧方式付钱。

AI SDK 6:Agent有了正式的”接口”

2025年12月发布的AI SDK 6,把Agent能力做成了正经抽象。

ToolLoopAgent类自动处理多步工具调用,定义好工具和系统提示词,循环跑到任务完成或触达步数上限。真正戳中痛点的是工具审批:给任何一个工具加上needsApproval: true,Agent执行前会暂停等人工确认。删数据、发邮件这类有副作用的操作,终于有了一道闸门。

MCP支持也转正了。@ai-sdk/mcp包完整支持OAuth、PKCE、Token刷新、资源和提示词,接上任何MCP服务器,远端工具就像本地定义一样可用。调试侧有@ai-sdk/devtools,跑一条npx命令,localhost:4983的查看器里能看到每一步的输入输出、Token消耗和原始载荷。没有它,排查一个五步Agent循环能折磨人到深夜。

模型层走AI Gateway,25家以上供应商即插即用,OpenAI、Anthropic、Google、DeepSeek都在列。切换模型改一行代码,从anthropic/claude-opus-4-6换成openai/gpt-5.2就完事。

Workflow SDK:50步任务不再”一锤子买卖”

普通Agent把整个循环塞进一次函数调用。Vercel Pro的函数超时5到13分钟,跑50步串行工具调用的研究任务,中途超时或崩溃,全部进度归零。

Workflow SDK用use workflow把每次LLM调用和工具执行拆成独立的持久化步骤。50步任务变成50次函数调用,每步独享完整超时时限,已完成的步骤绝不重跑,对话状态在步骤间自动留存。长任务从”赌运气”变成了工程问题。

老项目先看一眼开关

这套组合拳适合三类人:给产品加AI功能的Next.js团队、正在搭Agent但被超时和账单折磨的开发者、想把Sandbox跑成代码执行后端的平台方。

动手顺序也简单:老项目先在控制台开启Fluid Compute;新项目直接pnpm create next-app起步,AI SDK 6默认随行;长任务把循环逻辑迁到use workflow。Ship 26之后官方大概率还有一轮更新,眼下这套栈已经能上生产。

Serverless为请求而生,Agent为任务而生。执行模型的这次换底,赶上AI应用爆发的节拍,账单数字就是最好的证明。


评论

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

苏ICP备2025163703号-2   警徽苏公网安备32010502011527号