Baseten正式成为OpenAI B2B市场中首批开放模型推理提供商之一,并实现与Codex的原生集成。即日起,OpenAI企业客户可通过现有的OpenAI承诺额度,在Codex或通过Responses API调用由Baseten提供服务的开放模型。对企业而言,这意味着能以更高的性价比获取智能服务。

随着代理式编程(Agentic coding)成为AI最广泛的应用场景,OpenAI的Codex和GPT模型已成为扩展代码生成工作流的主流选择。Baseten支持的开放模型向OpenAI客户开放后,组织可优化跨开放和封闭模型的代理工作流,将特定任务路由至最匹配的模型,推动“多模型未来”加速落地。

代理式编程驱动多模型工作流规模化

目前,领先的AI公司正转向采用混合模型组合,以在智能、成本、延迟和容量之间取得最佳平衡。顶尖工程团队通过静态或自适应路由器,将任务分配给在特定场景下具备最佳性价比和性能的模型。鉴于开放模型与封闭模型的迭代周期已缩短至数周,单一模型难以长期满足所有工作需求。

为保持竞争优势,企业需即时访问最新模型,并获得快速、可靠且能无缝集成至编排框架及网关的推理服务。Baseten提供高性能基础设施原语和开发者工具,支持原生集成至各类技术栈。

强化代码生成的多模型智能能力

在生产环境中实现最佳性价比,要求模型在大规模调用下保持性能、可靠性和灵活性的一致性。Baseten针对企业级扩展提供了以下关键能力:

  • 全栈性能优化:针对代码生成中多次交互、长提示词及大上下文窗口带来的推理压力,Baseten从工具链到底层引擎进行了全链路优化。
  • 多云容量与可靠性:为解决代码生成突发性流量导致的容量瓶颈,Baseten在超过20家云服务商的90多个集群上运行,采用双活部署模式。当某提供商或区域出现故障时,流量自动重定向。此外,其与200多家计算提供商合作,优先接入新容量,确保供给超前于需求。
  • 零日模型访问:Baseten在主要开放模型发布当天即在Model APIs上上线支持。用户只需更新一行代码,即可在发布首日评估并使用最新的顶级模型,无需等待季度评估周期。
  • 开发者与代理体验:除推理服务外,Baseten(含已并入的Blaxel)为每个代理提供独立的沙箱环境,以支持代码执行需求。
  • 企业级治理:推理服务运行于美国境内基础设施,对所有提示词实行零数据保留(ZDR)。针对高合规场景,支持区域锁定部署、细粒度身份验证(AuthN)和授权(AuthZ),并提供详细的使用情况审计。
  • 应用研究与工程支持:前线工程师协助调整部署参数以满足延迟目标,应用研究人员支持后训练定制。例如,LangChain利用Baseten Loops为LangSmith Engine训练了定制模型。

此次与OpenAI的合作是构建最佳多模型代理式编程体验的重要一步。凭借对前沿开放模型的零日访问权、快速可靠的推理服务以及有保障的云容量,Baseten致力于加速AI采用并提升每美元投入所获得的智能价值。

若希望通过OpenAI承诺在Codex中原生访问开放模型,可申请加入等待名单;如需更多技术细节,可直接联系其工程团队。