Baseten
Baseten 让团队无需构建自己的服务堆栈即可部署和运行生产环境中的机器学习模型。该机器学习推理平台支持开源、自定义和微调模型,运行在针对低延迟、跨云可用性和大规模扩展优化的基础设施上。产品涵盖专用部署、预优化模型 API、使用 Loops SDK 的训练,以及用于分发专有模型的 Baseten for Model Labs。
通用 GPU 租赁提供原始计算能力,而 Baseten 作为 Baseten 推理堆栈的一部分,提供定制内核、高级解码和缓存。这种权衡适合需要低于 300 毫秒转录或 2 倍嵌入吞吐量的团队,无需雇佣服务基础设施团队,尽管专业版和企业版仍需销售洽谈。
包括 Cursor、Notion、Writer 和 OpenEvidence 在内的客户在该平台上运行大型语言模型、转录、嵌入、图像生成、文本转语音和复合 AI 工作负载。Baseten 成立于 2019 年,将训练后研究、内核级优化和前沿部署工程师与服务层结合,使团队能够从原型快速过渡到生产流量,无需拼凑多个独立工具。
机器学习工程师、平台团队和 AI 产品公司在需要具备可观测性、SOC 2 Type II 和 HIPAA 合规性以及灵活部署选项的生产推理时,会选择 Baseten,而无需从零构建服务基础设施。
OpenAI兼容模型API,用于Kimi K3、DeepSeek-V4-Flash和GLM-5.2 Fast
跨云自动扩展,开箱即用99.99%的正常运行时间
在Baseten Cloud、自托管VPC或混合弹性容量上运行
只为活跃计算时间付费,而非空闲部署分钟数
Baseten Chains通过细粒度自动扩展将复合AI延迟减半
使用Truss打包任何模型,Baseten的开源服务标准
基础套餐起价为每月0美元,按需付费计算在Baseten Cloud上进行。
兼容OpenAI的模型API使得从封闭的大型语言模型提供商切换变得简单。
部署选项涵盖托管云、自托管VPC和混合灵活容量。
SOC 2 Type II和HIPAA合规,支持单租户专用部署。
前置部署工程师在真实流量下帮助调优延迟、吞吐量和成本。
专业版和企业版价格需要联系销售而非自助结账。
按分钟计费的 GPU 费率相比固定订阅价格增加了复杂性。
自托管和混合部署需要与 Baseten 销售团队进行工程协调。
Baseten 有免费套餐吗?
有的。Baseten 的基础套餐在 Baseten 云平台上每月费用为 $0,采用按需付费的计算方式。新账户还会获得免费积分,用于体验用户界面和测试部署,详情请参见价格常见问题。
我可以在 Baseten 上运行哪些模型?
Baseten 支持开源和自定义模型。您可以从模型库开始或部署任何使用 Truss 打包的模型,Truss 是 Baseten 的开源标准,支持在任何框架中构建的模型服务。
Baseten 与 OpenAI 兼容吗?
兼容。Baseten 的模型 API 完全支持 OpenAI,包括函数调用功能。模型 API 产品页面指出,您可以通过替换 URL 轻松迁移现有闭源模型。
在 Baseten 上空闲时需要付费吗?
不需要。Baseten 仅在您的模型实际使用计算资源时收费,包括部署、自动扩缩容或进行预测。您可通过平台控制自动扩缩容行为,详情见价格常见问题。
Baseten 是否安全合规?
是的。Baseten 通过了 SOC 2 Type II 认证,并符合 HIPAA 规定。专用部署为单租户环境,可限制区域访问,且平台绝不存储模型 API 的推理输入或输出数据。
我可以在自己的基础设施上部署 Baseten 吗?
可以。Baseten 提供在您 VPC 内的自托管部署方案,以及结合您自有基础设施与 Baseten 云按需弹性容量的混合方案。企业套餐还支持定制 SLA 和数据驻留控制。

