ggml.ai

ggml.ai

ggml executa modelos grandes de linguagem e fala em CPUs e GPUs comuns por meio de uma biblioteca compacta de tensores em C, construída para inferência no dispositivo. Engenheiros de ML e desenvolvedores de aplicativos a adotam via llama.cpp e whisper.cpp quando desejam cargas de trabalho LLaMA ou Whisper sem dependências exclusivas de nuvem.

Frameworks como PyTorch são otimizados para clusters de treinamento e tempos de execução pesados. ggml mantém a biblioteca principal minimalista, sem alocações de memória em tempo de execução, sem dependências de terceiros e com quantização inteira para que o llama.cpp possa servir pesos Meta LLaMA em laptops e Apple Silicon.

A empresa ggml.ai foi fundada em 2023 por Georgi Gerganov para dar suporte à biblioteca e foi adquirida pela Hugging Face em 2026. O projeto principal ggml permanece licenciado sob MIT com desenvolvimento aberto no GitHub.

Recursos Principais:
  1. Potencializa llama.cpp para inferência Meta LLaMA e whisper.cpp para modelos de fala OpenAI Whisper

  2. Escrito em C com zero alocações de memória em tempo de execução durante a inferência

  3. Suporte à quantização de inteiros para modelos menores em hardware comum

  4. Sem dependências de terceiros na biblioteca de tensores principal

  5. Implementação de baixo nível multiplataforma com amplo suporte de hardware

  6. Biblioteca open-core licenciada sob MIT com desenvolvimento público no GitHub

Pros:
  1. Potencializa stacks de inferência amplamente utilizados llama.cpp e whisper.cpp

  2. Biblioteca C mínima sem dependências de terceiros

  3. Licença MIT com desenvolvimento aberto no GitHub

  4. Quantização de inteiros para inferência eficiente em hardware comum

Cons:
  1. API C de baixo nível requer mais engenharia do que APIs de LLM hospedadas

  2. Nenhum produto gerenciado na nuvem no ggml.ai

  3. Futuras extensões comerciais podem divergir da base open-core MIT

Perguntas frequentes:

O que é ggml.ai?

ggml.ai suporta o ggml, uma biblioteca tensorial para aprendizado de máquina que permite grandes modelos em hardware comum. Ele alimenta o llama.cpp e o whisper.cpp para inferência de LLM e fala no dispositivo.

O ggml.ai é gratuito?

Sim, o ggml está disponível gratuitamente sob a licença MIT no GitHub. A página inicial do ggml.ai afirma que a biblioteca e os projetos relacionados são open core com desenvolvimento público.

Quais projetos usam ggml?

O ggml alimenta o llama.cpp para inferência do modelo Meta LLaMA e o whisper.cpp para o OpenAI Whisper de fala para texto. Ambos os projetos estão vinculados diretamente na página inicial do ggml.ai.

Quem fundou o ggml.ai?

O ggml.ai foi fundado em 2023 por Georgi Gerganov para apoiar o desenvolvimento do ggml. Nat Friedman e Daniel Gross forneceram financiamento pré-seed, e a Hugging Face adquiriu a empresa em 2026.

Como posso contribuir para o ggml?

Os colaboradores participam do desenvolvimento através dos repositórios ggml-org no GitHub. A página inicial convida contribuições abertas e descreve o projeto como minimalista, open core e licenciado pela MIT.

Para qual hardware o ggml é direcionado?

O ggml é direcionado para hardware comum com uma implementação de baixo nível multiplataforma, quantização inteira e amplo suporte de hardware. Ele é projetado para inferência na borda, e não apenas para implantações em datacenters.

Preços:

Gratuito

Tags:

Tensor Library
Llama.cpp
Whisper.cpp
Edge Inference
Quantization
MIT License
On Device ML
Machine Learning

Tecnologia utilizada:

GitHub
C

Avaliações:

Give your opinion on ggml.ai :-

Overall rating

Join thousands of AI enthusiasts in the World of AI!

Melhor Gratuito ggml.ai Alternativas (e Pagas)

By Rishit