LiteLLM

LiteLLM

LiteLLM é um gateway de IA auto-hospedado e proxy LLM que fica entre seus aplicativos e os provedores de modelos. Você direciona os clientes para um endpoint compatível com OpenAI, e o gateway gerencia o roteamento, registro e controles de gastos em mais de 140 backends. Equipes da Netflix, NVIDIA e Okta o utilizam para padronizar o acesso a modelos sem precisar reconstruir cada serviço quando um provedor muda.

Enquanto proxies hospedados cobram por token e mantêm as chaves na nuvem deles, o LiteLLM roda na sua VPC ou em um cluster isolado sob licença MIT. Orçamentos e limites de RPM/TPM são bloqueios rígidos, não alertas, então uma chave vazada ou trabalho descontrolado não pode continuar gastando após atingir o limite.

Equipes de plataforma e infraestrutura de ML recorrem a ele quando precisam de uma única porta de entrada para humanos, agentes e trabalhos em lote. O mesmo gateway cobre chamadas LLM, servidores MCP e fluxos de trabalho de agentes, com SSO empresarial, logs de auditoria e SLAs quando a implantação é em toda a empresa.

Recursos Principais:
  1. Uma API compatível com OpenAI direciona solicitações para mais de 140 provedores e 1.892 modelos

  2. Orçamentos rígidos mais limites de RPM e TPM por chave, equipe e organização interrompem o tráfego no limite

  3. Gateway auto-hospedado licenciado pelo MIT com mais de 240M de pulls no Docker e suporte a implantação isolada

  4. Rust AI Gateway adiciona 0,66 ms de latência p99 em mais de 2.800 solicitações por segundo em benchmarks publicados

  5. Barreiras integradas cobrem mascaramento de PII e verificações de injeção de prompt via Presidio e Lakera

  6. Chaves virtuais, rastreamento de gastos e métricas Prometheus são enviados na camada de código aberto gratuita

Pros:
  1. Gateway de código aberto licenciado pelo MIT que você pode hospedar sozinho sem taxa por token.

  2. Troque modelos de backend por configuração ao invés de reescrever o código da aplicação.

  3. Orçamentos rígidos e limites de taxa interrompem solicitações quando uma chave ou equipe atinge seu limite.

  4. Um endpoint compatível com OpenAI cobre mais de 140 provedores, servidores MCP e fluxos de trabalho de agentes.

  5. Benchmarks publicados mostram uma sobrecarga de gateway de 0,66 ms p99 na compilação Rust.

Cons:
  1. SSO empresarial, SCIM e logs de auditoria requerem uma licença anual paga.

  2. Implantações auto-hospedadas precisam do seu próprio Postgres, Redis e manutenção operacional.

  3. Barreiras avançadas e integrações de gerenciadores de segredos exigem configuração deliberada.

Perguntas frequentes:

LiteLLM é gratuito para usar?

Sim. O gateway open-source do LiteLLM é gratuito para auto-hospedagem sem taxa de licença. O plano Open Source de $0 inclui mais de 100 integrações de provedores, chaves virtuais, orçamentos, limites de taxa, registro de logs e métricas Prometheus.

Como é o preço do LiteLLM Enterprise?

O LiteLLM Enterprise é precificado pela capacidade anual de requisições do gateway, arquitetura de implantação e necessidades de suporte, não por token. Contate as vendas para um orçamento ou inicie uma chave de teste Enterprise de 30 dias na página Enterprise.

O LiteLLM pode funcionar isolado da internet?

Sim. O LiteLLM suporta implantações auto-hospedadas e isoladas (air-gapped) nos planos Enterprise. Seus dados e chaves de API permanecem na infraestrutura que você controla, sem telemetria do fornecedor necessária.

Quais provedores o LiteLLM suporta?

O LiteLLM suporta mais de 140 provedores LLM e 1.892 modelos através de uma API compatível com OpenAI. Integrações documentadas incluem OpenAI, Anthropic, Azure, Amazon Bedrock, Google Vertex AI e Mistral.

O LiteLLM acessa nossos prompts ou chaves?

Não. O LiteLLM é auto-hospedado, então prompts, respostas e chaves de provedores permanecem dentro da sua infraestrutura. O fornecedor não recebe seu tráfego quando você executa o gateway por conta própria.

O que o LiteLLM Enterprise adiciona?

O LiteLLM Enterprise adiciona SSO, SCIM, autenticação OIDC e JWT, logs de auditoria, integrações com gerenciador de segredos, RBAC, opções de plano de controle multi-região e suporte 24/7 com SLAs de tempo de resposta além do gateway open-source.

Preços:

Freemium

Tags:

LLM Proxy
API Gateway
Model Routing
Self-Hosted
Open Source
Spend Management
MCP Gateway
Load Balancing

Tecnologia utilizada:

Chakra UI
jQuery
Webflow
Cloudflare
Amazon CloudFront
Amazon Web Services
Google Analytics
Google Tag Manager
Ruby
GitHub
Emotion
Tailwind CSS

Avaliações:

Give your opinion on LiteLLM :-

Overall rating

Join thousands of AI enthusiasts in the World of AI!

Melhor Gratuito LiteLLM Alternativas (e Pagas)

By Rishit