Millis AI
Millis AI é uma plataforma de agentes de voz para equipes que precisam de conversas em tempo real por telefone e dentro de aplicativos. Ela roda toda a pilha de voz com aproximadamente 600ms de latência, permitindo que os agentes acompanhem chamadas ao vivo sem pausas constrangedoras. Desenvolvedores a usam para linhas de suporte, acompanhamento de vendas, recepcionistas virtuais e voz incorporada em produtos web ou mobile.
A plataforma combina reconhecimento de fala (speech-to-text), raciocínio com LLM e síntese de fala (text-to-speech) em um único pipeline. Você pode criar agentes com comandos em linguagem natural em minutos, ou integrá-los por meio de SDKs em Python, JavaScript e WebSocket. Ela se conecta a OpenAI, Mistral, Llama, ElevenLabs, PlayHT, Cartesia e modelos personalizados, além de suportar números de telefone em mais de 100 países para chamadas de entrada e saída.
Equipes de produto, agências e desenvolvedores que integram voz em suporte, qualificação de leads, pesquisas, coordenação de campo ou fluxos de quiosque são o público principal. A TMate Inc opera a plataforma em uma infraestrutura projetada para comunicação em tempo real de alto volume.
Latência de aproximadamente 600ms de ponta a ponta em chamadas de voz ao vivo
Números de telefone em mais de 100 países para implantação de chamadas recebidas e realizadas
Configuração de agentes sem código ou SDKs para aplicativos em Python, JavaScript e WebSocket
Alternância entre OpenAI, Mistral, Llama ou seu próprio LLM personalizado
Vozes da ElevenLabs, PlayHT, Cartesia, OpenAI ou sua voz clonada
Webhooks conectam agentes a calendários, CRMs e outros SaaS durante a chamada
Integração Make.com para fluxos de trabalho de automação sem código
A meta de latência abaixo de 600ms mantém as conversas por voz ao vivo com sensação natural.
Suporta mais de 30 idiomas em reconhecimento e síntese de fala.
Preço de uso começa em $0,02/min antes das taxas de LLM e do provedor de voz.
Configuração de agente sem código junto com SDKs para Python, JavaScript e WebSocket.
O custo final detalha separadamente as cobranças da plataforma base, LLM, TTS e STT.
Nenhum nível de assinatura listado na página pública de preços.
Descontos por volume para ElevenLabs requerem contato direto com a equipe.
Quanto custa o Millis AI?
O Millis AI cobra uma taxa base de plataforma de US$0,02 por minuto, além de custos separados para tokens LLM, caracteres de texto para fala e fala para texto a US$0,0043 por minuto. Uma sessão de 10 minutos com GPT-4o e ElevenLabs TTS custa cerca de US$0,66 no exemplo publicado.
Quais modelos LLM o Millis AI suporta?
O Millis AI suporta GPT-4o, GPT-4 Turbo, GPT-3.5 Turbo, Meta Llama-3 e LLMs personalizados que você mesmo hospeda. Ele também pode selecionar automaticamente o modelo de menor latência dentre as opções disponíveis para a configuração do seu agente.
Posso usar o Millis AI para chamadas telefônicas?
Sim. O Millis AI permite conectar números de telefone para agentes de voz de entrada e saída em mais de 100 países. Também suporta troncos SIP, WebRTC e widgets de chamadas incorporáveis para aplicativos web.
Quais provedores de voz o Millis AI suporta?
O Millis AI integra-se com ElevenLabs, OpenAI, Cartesia, PlayHT, Deepgram, Neets e Rime para texto para fala. Você também pode trazer uma voz clonada. O TTS é cobrado por 1.000 caracteres, com taxas que variam conforme o provedor.
Quais idiomas o Millis AI suporta?
O Millis AI suporta mais de 30 idiomas, incluindo inglês, espanhol, francês, alemão, japonês, coreano, hindi, português e ucraniano. A documentação lista o conjunto completo na página de introdução.
O Millis AI tem um plano gratuito?
O Millis AI não oferece um plano gratuito na sua página de preços. O uso é pay-as-you-go, começando em US$0,02 por minuto para a taxa base da plataforma antes das cobranças de LLM, TTS e STT.
Como faço para implantar um agente de voz Millis AI?
Os agentes Millis AI podem ser implantados em linhas telefônicas, aplicativos web e móveis via SDKs, aplicativos desktop ou um widget web incorporável. A documentação cobre SDK web, aplicativos nativos WebSocket, configuração de chamadas de entrada e saída, e troncos SIP.

