llama.cpp
Motor de inferencia en C/C++ para correr LLMs cuantizados en CPU y GPU de consumo; es la base técnica de Ollama y de gran parte del ecosistema de IA local.
- Ingeniería
- ia
- open-source
- local
26 ago
Índice curado
Herramientas de IA, modelos abiertos y stack de creación, curados por categoría y etiqueta.
2 recursos · Quitar filtros
Motor de inferencia en C/C++ para correr LLMs cuantizados en CPU y GPU de consumo; es la base técnica de Ollama y de gran parte del ecosistema de IA local.
26 ago
Ejecuta modelos de lenguaje abiertos (Llama, Gemma, DeepSeek) en tu propia máquina con un solo comando, sin depender de APIs de pago ni enviar datos a la nube.
26 ago