GPT-6.1 Sol Ultrafast 向 API 用户开放
OpenAI 通过 Responses API 为 gpt-6.1-sol 模型开放 service_tier: "ultrafast" 服务层级,面向低延迟工程任务,支持美国和欧盟数据驻留以及全球处理。该层级使用...
OpenAI 已经通过 Responses API 为 gpt-6.1-sol 开放 service_tier: "ultrafast" 服务层级。这个选项主要面向对延迟敏感的工程任务,例如需要快速响应的实时交互和自动化流程,让开发者在模型调用链路上多了一种低延迟选择。
开发者可以在请求中设置 service_tier 参数来启用 ultrafast,该层级支持美国、欧盟数据驻留以及全球处理。这意味着部署位置可以与数据合规策略进行匹配,尤其对有区域监管要求的服务会比较有帮助。目前全球处理具体包含哪些区域尚未列出,合规确认仍需以官方文档为准。
需要留意的是,ultrafast 使用独立的限额,并且成本高于默认层级。官方没有披露具体价格增幅、限额数值或性能对比数据,因此在切换前需要单独评估预算、容量和延迟收益是否匹配。
对于频繁调用工具的智能体,还可以复用 WebSocket 连接来减少网络开销。这种方式适合工具调用密集的 Agent 场景,但官方没有说明 WebSocket 复用是否需要额外配置或权限。
考虑到这些限制,ultrafast 更适合延迟敏感且对额外成本有明确预期的工程团队。上线前建议在测试环境比较延迟改善与费用增长,并持续监控独立限额的消耗,避免在生产阶段出现非预期的超额。
对延迟敏感且具备容量规划能力的团队,可以优先在非关键流量中验证 ultrafast 的实际收益。之后再决定是否扩大到更多请求,是相对稳妥的推进方式。

