AI Gateway 自动模型路由开放公测
Cloudflare AI Gateway 自动模型路由已开放公测,将模型设为 cloudflare/auto 后,网关可依据任务能力、请求格式、凭据、预算和上游健康状态选择模型,并考虑长会话缓存重写成本。公测期间...
AI Gateway 自动模型路由已进入公测。将模型设置为 cloudflare/auto 后,网关可以按任务能力、请求格式、凭据、预算和上游健康状态自动选择模型。这减少了开发者在多模型场景下手动指定与切换模型的复杂度。
路由决策还会考虑长会话中的缓存重写成本。对于上下文较长或重复内容较多的任务,这意味着网关不仅评估单次推理费用,也会权衡缓存重写带来的额外开销。实际应用中,这可能同时影响请求成本和响应质量。
公测期间路由功能本身免费,但推理调用仍然计费。工程团队需要把这两类成本分开监控,避免将免费的路由能力误认为整体免费。建议在部署前对关键任务执行基准测试,用实际负载评估自动路由后的输出质量和成本变化。
目前零数据保留过滤、完整 Responses API 以及 WebSockets 支持仍处于后续计划中。依赖这些能力的现有应用需要先核对兼容性,确认是否有可行的替代方案,或等待相关支持补齐后再接入。
自动路由统一到 cloudflare/auto 入口可以简化集成,但路由算法的权重、可选上游模型范围等细节尚未披露。团队在公测阶段应保持对模型行为的验证,不宜将自动选择完全替代对具体任务质量和成本的主动监控。