
Última actualización 08-12-2026
Categoría:
Reviews:
Join thousands of AI enthusiasts in the World of AI!
ggml.ai
ggml ejecuta modelos grandes de lenguaje y voz en CPUs y GPUs comunes mediante una biblioteca compacta de tensores en C diseñada para inferencia en el dispositivo. Ingenieros de ML y desarrolladores de aplicaciones la adoptan a través de llama.cpp y whisper.cpp cuando necesitan cargas de trabajo de LLaMA o Whisper sin depender exclusivamente de la nube.
Frameworks como PyTorch están optimizados para clusters de entrenamiento y tiempos de ejecución pesados. ggml mantiene la biblioteca central mínima con cero asignaciones de memoria en tiempo de ejecución, sin dependencias de terceros y cuantización entera para que llama.cpp pueda servir pesos Meta LLaMA en laptops y Apple Silicon.
La empresa ggml.ai fue fundada en 2023 por Georgi Gerganov para apoyar la biblioteca y fue adquirida por Hugging Face en 2026. El proyecto central ggml permanece con licencia MIT y desarrollo abierto en GitHub.
Potencia llama.cpp para inferencia de Meta LLaMA y whisper.cpp para modelos de voz de OpenAI Whisper
Escrito en C sin asignaciones de memoria en tiempo de ejecución durante la inferencia
Soporte de cuantización entera para modelos más pequeños en hardware común
Sin dependencias de terceros en la biblioteca de tensores principal
Implementación multiplataforma de bajo nivel con amplio soporte de hardware
Biblioteca de código abierto con licencia MIT y desarrollo público en GitHub
Potencia pilas de inferencia llama.cpp y whisper.cpp ampliamente utilizadas
Biblioteca C mínima sin dependencias de terceros
Licencia MIT con desarrollo abierto en GitHub
Cuantización entera para inferencia eficiente en hardware común
La API en C de bajo nivel requiere más ingeniería que las APIs de LLM alojadas
No hay un producto en la nube gestionado en ggml.ai
Las futuras extensiones comerciales pueden divergir de la base de código abierto MIT
¿Qué es ggml.ai?
ggml.ai soporta ggml, una biblioteca tensorial para aprendizaje automático que permite modelos grandes en hardware común. Impulsa llama.cpp y whisper.cpp para inferencia LLM y de voz en el dispositivo.
¿ggml.ai es gratis?
Sí, ggml está disponible gratuitamente bajo la licencia MIT en GitHub. La página principal de ggml.ai indica que la biblioteca y proyectos relacionados son open core con desarrollo público.
¿Qué proyectos usan ggml?
ggml impulsa llama.cpp para la inferencia del modelo Meta LLaMA y whisper.cpp para el reconocimiento de voz OpenAI Whisper. Ambos proyectos están enlazados directamente desde la página principal de ggml.ai.
¿Quién fundó ggml.ai?
ggml.ai fue fundada en 2023 por Georgi Gerganov para apoyar el desarrollo de ggml. Nat Friedman y Daniel Gross proporcionaron financiamiento pre-semilla, y Hugging Face adquirió la empresa en 2026.
¿Cómo puedo contribuir a ggml?
Los colaboradores se unen al desarrollo a través de los repositorios ggml-org en GitHub. La página principal invita a contribuciones abiertas y describe el proyecto como minimalista, open core y con licencia MIT.
¿Qué hardware utiliza ggml?
ggml está dirigido a hardware común con una implementación multiplataforma de bajo nivel, cuantización entera y amplio soporte de hardware. Está diseñado para inferencia en el borde y no solo para despliegues en centros de datos.
