TokenHot
TokenHot 是一个统一的 LLM API 网关,通过 api.tokenhot.ai 的单一兼容 OpenAI 的端点,将请求路由到 100 多个模型。开发者只需将现有的 OpenAI SDK 客户端指向 TokenHot,替换基础 URL,即可调用 GPT、Claude、Gemini、DeepSeek、Qwen、Grok、GLM、MiniMax 和 Kimi 模型,无需重写集成代码。
与分别注册 OpenAI、Anthropic 和 Google 账户不同,TokenHot 将计费、认证和模型路由整合在一个网关后端。其主页公布了各模型的每令牌价格,较官方标价最高可节省 80%,并提供专用企业线路,响应延迟约为 1.8 秒。
该平台面向管理多个供应商账户、计费仪表盘和 API 格式的团队。后端开发者、AI 初创企业及构建代理、编码工具或多模态应用的产品团队是其核心用户。文档涵盖文本、图像、视频和 TTS 工作流,以及 Claude Code 和 Codex CLI 等环境的工具集成。
通过 api.tokenhot.ai 的一个兼容 OpenAI 的端点即可调用 100 多个模型
只需更改 base_url 和您的 API 密钥即可使用 OpenAI SDK
通过同一 API 接口支持文本、图像、视频和 TTS 调用
按使用的令牌计费,无订阅或席位费用
专用企业路由线路提供 1.8 秒延迟
Seedance 2.0 API 官方全球发布合作伙伴
一个OpenAI兼容端点涵盖100多个主要大型语言模型提供商的模型。
更改base_url后,可与现有的OpenAI SDK客户端兼容。
按用量计费,无强制订阅或席位费用。
承诺对提示和生成输出实行零数据保留政策。
通过Discord开发者社区提供直接的工程支持。
不同型号的费率差异很大,因此成本比固定月费计划更难预测。
tokenhot.ai 域名非常新,公共权威信号有限。
开发者文档位于 docs.tokenhot.ai,与主营销网站分开。
什么是 TokenHot?
TokenHot 是一个统一的 LLM API 网关,允许开发者通过一个兼容 OpenAI 的单一终端 https://api.tokenhot.ai/v1/chat/completions 调用 100 多个 AI 模型。它支持包括 OpenAI、Anthropic、Google Gemini、DeepSeek、Qwen、xAI Grok、知朴 GLM、MiniMax 和 Moonshot Kimi 在内的多家提供商。
TokenHot 是否兼容 OpenAI SDK?
是的。TokenHot 使用兼容 OpenAI 的聊天补全 API。您可以将官方的 OpenAI Python 或 Node.js SDK 指向基础 URL https://api.tokenhot.ai/v1,并在 Authorization 头中传递您的 TokenHot API 密钥。
TokenHot 提供免费套餐吗?
TokenHot 在其网站上未列出免费订阅等级。计费方式为按使用量付费,基于定价页面上显示的每模型令牌数或每请求费率,首页说明您可以使用信用卡开始,无需进行 KYC。
我可以通过 TokenHot 调用哪些模型?
TokenHot 文档记录了可访问的 100 多个模型,涵盖 GPT、Claude、Gemini、Qwen、DeepSeek、Grok、GLM、MiniMax 和 Kimi 系列。开发者文档包含模型表格,列出了上下文窗口大小及模型 ID,供您在 model 字段传入使用。
TokenHot 会存储我的提示或输出内容吗?
TokenHot 声明其遵循零数据保留政策,不会存储、查看或使用任何提示内容或生成的内容。该网关被描述为 API 请求的直通传输层。
TokenHot 除文本外支持哪些模态?
TokenHot 提供一个统一端点,支持文本、视频、视觉和语音合成(TTS)工作负载。其首页突出展示了视频模型如 Seedance 2.0 和 Kling 3.0,图像模型如 Seedream 5.0 Lite,以及音频模型包括 Suno 和 Speech-02。
我如何获取 TokenHot API 密钥?
您可以在 TokenHot 控制台 https://tokenhot.ai/api-key 创建 TokenHot API 密钥。请求中需在调用 https://api.tokenhot.ai/v1/chat/completions 时,使用 Authorization Bearer 令牌进行身份验证。

