ggml.ai
ggml executa modelos grandes de linguagem e fala em CPUs e GPUs comuns por meio de uma biblioteca compacta de tensores em C, construída para inferência no dispositivo. Engenheiros de ML e desenvolvedores de aplicativos a adotam via llama.cpp e whisper.cpp quando desejam cargas de trabalho LLaMA ou Whisper sem dependências exclusivas de nuvem.
Frameworks como PyTorch são otimizados para clusters de treinamento e tempos de execução pesados. ggml mantém a biblioteca principal minimalista, sem alocações de memória em tempo de execução, sem dependências de terceiros e com quantização inteira para que o llama.cpp possa servir pesos Meta LLaMA em laptops e Apple Silicon.
A empresa ggml.ai foi fundada em 2023 por Georgi Gerganov para dar suporte à biblioteca e foi adquirida pela Hugging Face em 2026. O projeto principal ggml permanece licenciado sob MIT com desenvolvimento aberto no GitHub.
Potencializa llama.cpp para inferência Meta LLaMA e whisper.cpp para modelos de fala OpenAI Whisper
Escrito em C com zero alocações de memória em tempo de execução durante a inferência
Suporte à quantização de inteiros para modelos menores em hardware comum
Sem dependências de terceiros na biblioteca de tensores principal
Implementação de baixo nível multiplataforma com amplo suporte de hardware
Biblioteca open-core licenciada sob MIT com desenvolvimento público no GitHub
Potencializa stacks de inferência amplamente utilizados llama.cpp e whisper.cpp
Biblioteca C mínima sem dependências de terceiros
Licença MIT com desenvolvimento aberto no GitHub
Quantização de inteiros para inferência eficiente em hardware comum
API C de baixo nível requer mais engenharia do que APIs de LLM hospedadas
Nenhum produto gerenciado na nuvem no ggml.ai
Futuras extensões comerciais podem divergir da base open-core MIT
O que é ggml.ai?
ggml.ai suporta o ggml, uma biblioteca tensorial para aprendizado de máquina que permite grandes modelos em hardware comum. Ele alimenta o llama.cpp e o whisper.cpp para inferência de LLM e fala no dispositivo.
O ggml.ai é gratuito?
Sim, o ggml está disponível gratuitamente sob a licença MIT no GitHub. A página inicial do ggml.ai afirma que a biblioteca e os projetos relacionados são open core com desenvolvimento público.
Quais projetos usam ggml?
O ggml alimenta o llama.cpp para inferência do modelo Meta LLaMA e o whisper.cpp para o OpenAI Whisper de fala para texto. Ambos os projetos estão vinculados diretamente na página inicial do ggml.ai.
Quem fundou o ggml.ai?
O ggml.ai foi fundado em 2023 por Georgi Gerganov para apoiar o desenvolvimento do ggml. Nat Friedman e Daniel Gross forneceram financiamento pré-seed, e a Hugging Face adquiriu a empresa em 2026.
Como posso contribuir para o ggml?
Os colaboradores participam do desenvolvimento através dos repositórios ggml-org no GitHub. A página inicial convida contribuições abertas e descreve o projeto como minimalista, open core e licenciado pela MIT.
Para qual hardware o ggml é direcionado?
O ggml é direcionado para hardware comum com uma implementação de baixo nível multiplataforma, quantização inteira e amplo suporte de hardware. Ele é projetado para inferência na borda, e não apenas para implantações em datacenters.

