BLACKBOX AI
BLACKBOX AI direciona inferência por mais de 300 modelos de ponta e open-weight através de um único endpoint criptografado que seus agentes, CLI e IDE podem compartilhar. Enterprise Inference implanta modelos como Nemotron 3 Ultra em GPUs single-tenant, enquanto o Blackbox Router conecta modelos fechados com retenção zero de dados aplicada no gateway. Um compromisso anual de tokens cobre a API, CLI, extensão VS Code e API de Agentes.
A maioria dos provedores de inferência cobra por assento ou oculta acréscimos no roteamento. BLACKBOX cobra por token nas tarifas de lista publicadas, com descontos por compromisso que melhoram conforme o gasto aumenta. A Artificial Analysis classificou BLACKBOX como #1 na velocidade de saída do Nemotron 3 Ultra com 454 tokens por segundo, 30% mais rápido que o segundo provedor e 2,7x mais barato por token.
Equipes de plataforma e empresas preocupadas com segurança o utilizam quando precisam de chaves gerenciadas pelo cliente, remoção de PII antes de modelos fechados, SAML SSO e retenção zero contratual sem operar sua própria frota de GPUs. Um engenheiro implantado antecipadamente configura o roteamento, ambientes de avaliação e migrações de provedores no início do contrato.
Mais de 300 modelos através de um endpoint com roteamento inteligente, failover e cache de prompts
Nemotron 3 Ultra classificado como #1 com 454 tokens por segundo em benchmarks de Análise Artificial
Inferência Empresarial de locatário único com capacidade de GPU reservada isolada por cliente
API de Agentes, CLI e extensão VS Code cobrados pelo mesmo compromisso de tokens
Dados PII removidos antes de modelos fechados na Enterprise com retenção zero de dados contratual
Engenheiro de implantação incluído para migração, ajuste de roteamento e integrações de produção
Cobrança por token sem taxas de plataforma ou cobranças por assento nas tarifas de lista publicadas.
Classificado como o provedor #1 Nemotron 3 Ultra com 454 t/s com custo 2,7x menor que o provedor #2.
Um compromisso cobre API, CLI, VS Code e API de Agentes em toda a organização.
Engenheiro de implantação incluído para trabalho de migração e integração de produção.
Todos os planos requerem contato com vendas; não há cadastro self-service na página de preços.
Compromisso de tokens não utilizados expira ao final do período de faturamento.
Implantação dedicada de locatário único e residência de dados são recursos exclusivos da Enterprise.
Como funciona a precificação do BLACKBOX AI?
O BLACKBOX AI utiliza compromissos anuais de tokens dimensionados para sua carga de trabalho, cobrados conforme as tarifas publicadas por modelo, sem taxas de plataforma ou cobranças por assento. O saldo do compromisso diminui à medida que as equipes consomem tokens via API, CLI, Agents API e extensão VS Code.
A API do BLACKBOX AI é compatível com OpenAI?
Sim. O BLACKBOX AI oferece endpoints compatíveis com OpenAI em api.blackbox.ai, incluindo /v1/chat/completions, /v1/embeddings e /v1/images/generations. Você pode usar o SDK oficial OpenAI Python ou Node.js alterando apenas a URL base e a chave da API.
Quais modelos o BLACKBOX AI suporta?
O BLACKBOX AI roteia mais de 300 modelos por meio de um único endpoint, incluindo Claude Opus 5, Gemini 3.7 Flash, Kimi K3, Nemotron 3 Ultra e GLM 5.3. As tarifas por token de entrada e saída para cada modelo estão listadas na página de preços.
Como o BLACKBOX AI mantém os prompts privados?
O BLACKBOX AI aplica criptografia de ponta a ponta em todas as conexões e retenção zero contratual de dados no tráfego roteado. Planos empresariais adicionam remoção de PII antes dos prompts chegarem aos modelos fechados, SAML SSO, SCIM, RBAC e implantações dedicadas single-tenant.
Posso usar o BLACKBOX AI em pipelines CI/CD?
Sim. O BLACKBOX CLI suporta modo headless para execuções não interativas em Docker, GitHub Actions, GitLab CI e qualquer ambiente com Node 20+. O uso é contabilizado contra o mesmo compromisso de token organizacional da API.
O que está incluído em um contrato Enterprise do BLACKBOX AI?
O BLACKBOX AI Enterprise inclui um engenheiro dedicado forward-deployed, implementação sem custo adicional, implantação single-tenant, opções de residência de dados, SAML SSO, logs de auditoria, SLAs personalizados e descontos por volume nas tarifas por token.

