Ecosistema de Modelos Locales

🚧 TRADUCCIÓN PENDIENTE – Contenido en desarrollo Introducción Esta guía compara los principales frameworks para ejecutar modelos de lenguaje grandes (LLMs) localmente, enfocándonos en facilidad de uso, rendimiento y casos de uso. Frameworks Principales Ollama Descripción: Framework ligero para ejecutar…

LLMs en Kubernetes con Helm y ArgoCD

Empaquetar un servicio de inferencia (vLLM, Ollama) como chart de Helm y desplegarlo por GitOps con ArgoCD: values, probes para modelos que tardan minutos en cargar, gestión de pesos, secretos, multi-release y escalado por cola.