[{"data":1,"prerenderedAt":155},["ShallowReactive",2],{"seo-verification":3,"blog-alojar-litellm-en-un-vps-pasarela-llm-privada-es":6},{"google":4,"bing":5},"EycwPY2XMyTkVzas3n1ygeNJFGAH513qrMjfDljzsMQ","",{"key":7,"data":8},"blog-alojar-litellm-en-un-vps-pasarela-llm-privada-es",{"id":9,"slug":10,"slugs":11,"title":15,"excerpt":16,"readTime":17,"views":18,"isPinned":19,"publishedAt":20,"updatedAt":21,"category":22,"categories":28,"featuredImage":30,"bgImage":31,"posterImage":32,"relatedSolution":33,"intro":36,"sections":37,"ctaTitle":89,"ctaBody":90,"ctaButton":91,"ctaUrl":92,"relatedPosts":93},156,"alojar-litellm-en-un-vps-pasarela-llm-privada",{"fr":12,"en":13,"ar":14,"es":10},"self-host-litellm-vps","self-host-litellm-on-a-vps-your-private-llm-api-gateway","استضف-litellm-ذاتيا-على-vps-بوابة-api-خاصة-لنماذج-llm","Alojar LiteLLM en un VPS: su pasarela de API LLM privada","Despliegue LiteLLM en un VPS ServOrbit: pasarela de API compatible con OpenAI hacia Ollama, Anthropic, Azure y 100+ LLM, con control del gasto y límites por clave.",4,1,false,"2026-01-21T00:00:00+00:00","2026-09-07T11:26:10+00:00",{"id":23,"name":24,"slug":25,"color":26,"icon":27},7,"Autoalojamiento","self-hosting","bg-indigo-500\u002F10 text-indigo-400","cloud",[29],{"id":23,"name":24,"slug":25,"color":26,"icon":27},null,"\u002Fblog\u002Fcovers\u002Fbg.svg","\u002Fblog\u002Fcovers\u002Fself-host-litellm-vps-poster.svg",{"categorySlug":34,"appSlug":35},"inteligencia-artificial","litellm","Su aplicación llama a un único endpoint. LiteLLM decide qué modelo procesa la petición: su Ollama local, Anthropic Claude, GPT-4 o cualquiera de los más de 100 proveedores restantes. Habla la API de OpenAI: nunca hace falta modificar ningún SDK. Autoalojado en un VPS, añade la limitación de tasa, topes de presupuesto por clave de API y un panel analítico integrado, lo justo para dar a varios equipos acceso a la IA sin temer que los costes se disparen.",[38,42,52,55,83,86],{"type":39,"title":40,"body":41},"h2","Por qué LiteLLM es la capa que falta en las pilas de IA autoalojadas","Ollama es excelente para ejecutar modelos en local. Open WebUI lo viste con una interfaz de chat. Pero en cuanto empieza a construir aplicaciones —y no solo a conversar— necesita un intermediario: un proxy que normalice la superficie de API, siga los costes por proyecto y le permita cambiar de modelo sin tocar el código de la aplicación. Ese es precisamente el papel de LiteLLM. Se interpone entre su aplicación y cualquier backend LLM, exponiendo un único endpoint compatible con OpenAI. Su código no cambia, tanto si dirige las peticiones a Llama 3.1 en Ollama como a Claude 3.5 Haiku o a GPT-4o.",{"type":43,"title":44,"items":45},"ul","Lo que LiteLLM le aporta desde el primer momento",[46,47,48,49,50,51],"API unificada y compatible con OpenAI: funciona con todos los SDK, bibliotecas y herramientas que apuntan a la API de OpenAI.","Más de 100 integraciones de proveedores: Ollama, Anthropic, OpenAI, Azure OpenAI, Mistral, Cohere, Bedrock y muchos otros.","Claves de API virtuales con límites de gasto y de tasa por clave: reparta claves entre los equipos y ponga topes a los costes mensuales.","Panel integrado en \u002Fui con análisis del gasto en tiempo real, desglose por modelo y registros de las peticiones.","Reparto de carga y conmutación automática entre varios endpoints de proveedores o réplicas de modelos.","Licencia Apache 2.0: sin telemetría, sin envío de información al exterior, totalmente compatible con entornos air-gap cuando se asocia a Ollama.",{"type":39,"title":53,"body":54},"Requisitos","Al menos 1 GB de RAM y Ubuntu 22.04. Docker y el plugin Compose instalados. El puerto 4000 abierto, o un reverse proxy Caddy\u002FNginx para el HTTPS. Eso es todo: LiteLLM es en sí mismo un proxy Python que reclama unos 256 MB; PostgreSQL absorbe la mayor parte del presupuesto de RAM restante. Para equipos que generan tráfico concurrente, 2 GB resultan más cómodos.",{"type":56,"title":57,"steps":58},"steps","Desplegar LiteLLM en un VPS",[59,62,65,68,71,74,77,80],{"title":60,"body":61},"Aprovisionar el VPS","Contrate un VPS Start (2 vCPU, 4 GB, Ubuntu 22.04): LiteLLM se conforma con 1 GB y el plan más pequeño del catálogo sirve el doble. Conéctese por SSH e instale Docker: `curl -fsSL https:\u002F\u002Fget.docker.com | sh`. El plugin Compose viene incluido.",{"title":63,"body":64},"Generar los secretos","Ejecute `openssl rand -hex 32` para generar LITELLM_MASTER_KEY: es la que desbloquea el panel y todos los endpoints de API de administración. Cree `\u002Fopt\u002Flitellm\u002F.env` con: `LITELLM_MASTER_KEY`, `UI_USERNAME`, `UI_PASSWORD`, `DB_NAME=litellm`, `DB_USER=litellm`, `DB_PASSWORD=\u003Cstrong-password>`.",{"title":66,"body":67},"Redactar docker-compose.yml","Cree `\u002Fopt\u002Flitellm\u002Fdocker-compose.yml` con dos servicios: `db` (postgres:16-alpine, variables de entorno procedentes del .env, volumen litellm_db) y `litellm` (ghcr.io\u002Fberriai\u002Flitellm:main-latest, puerto 4000:4000, depends_on db, DATABASE_URL + LITELLM_MASTER_KEY + UI_USERNAME + UI_PASSWORD, volumen litellm_config:\u002Fapp\u002Fdata). Ejecute `docker compose up -d`.",{"title":69,"body":70},"Abrir el panel","Vaya a `http:\u002F\u002F\u003Cvps-ip>:4000\u002Fui` y conéctese con sus UI_USERNAME \u002F UI_PASSWORD. Llegará al panel de LiteLLM. Entre en Models para añadir su primer proveedor. Para una instancia de Ollama local en el mismo VPS, defina el nombre del modelo como `ollama\u002Fllama3.1` y la API base como `http:\u002F\u002Fhost.docker.internal:11434`. Para Anthropic, pegue su clave de API y añada `anthropic\u002Fclaude-3-5-haiku-20241022`.",{"title":72,"body":73},"Probar la pasarela","Desde su puesto de trabajo, pruebe: `curl http:\u002F\u002F\u003Cvps-ip>:4000\u002Fv1\u002Fchat\u002Fcompletions -H \"Authorization: Bearer \u003CLITELLM_MASTER_KEY>\" -H 'Content-Type: application\u002Fjson' -d '{\"model\": \"ollama\u002Fllama3.1\", \"messages\": [{\"role\": \"user\", \"content\": \"Hello\"}]}'`. Debería recibir una respuesta en streaming, encaminada por LiteLLM hacia su Ollama.",{"title":75,"body":76},"Repartir claves de API entre los equipos","En el panel, dentro de API Keys, haga clic en New Key. Póngale una descripción (por ejemplo «frontend-team»), defina `max_budget: 50` (USD\u002Fmes) y un `tpm_limit` opcional. Comparta esa clave con el equipo: apuntará su SDK de OpenAI a `http:\u002F\u002F\u003Cvps-ip>:4000` y usará esa clave. El gasto se sigue por clave en el panel.",{"title":78,"body":79},"Añadir el HTTPS con Caddy","Instale Caddy: `apt install -y caddy`. Edite `\u002Fetc\u002Fcaddy\u002FCaddyfile`: `llm.su-dominio.com { reverse_proxy localhost:4000 }`. Recargue: `systemctl reload caddy`. Cierre el puerto 4000 en su firewall: todo el tráfico pasa ya por el 443 con TLS automático.",{"title":81,"body":82},"Conectarse por primera vez","Abra la interfaz de administración en \u002Fui: LiteLLM muestra un formulario de usuario y contraseña. Introduzca admin y la contraseña facilitada, y después cree sus claves virtuales desde el panel.",{"type":84,"body":85},"tip","Asocie LiteLLM a Ollama en el mismo VPS para obtener una pila de IA totalmente aislada (air-gap). Ollama se encarga de la inferencia de los modelos; LiteLLM añade la capa de pasarela: encaminamiento, limitación de tasa y seguimiento del consumo. Para las cargas de trabajo sensibles en materia de confidencialidad (jurídico, finanzas, sanidad), esto significa que ningún dato sale de su infraestructura.",{"type":84,"title":87,"body":88},"La documentación oficial","Para la configuración avanzada y las opciones propias de la herramienta, consulte la \u003Ca href=\"https:\u002F\u002Fdocs.litellm.ai\" target=\"_blank\" rel=\"noopener noreferrer\">documentación oficial de LiteLLM\u003C\u002Fa>. Esta guía cubre la puesta en línea en un VPS; la documentación del editor sigue siendo la referencia para los ajustes finos, las actualizaciones mayores y los casos de uso específicos.","Despliegue su pasarela LLM privada","Autoaloje LiteLLM en un VPS ServOrbit — dirija las peticiones entre Ollama, Anthropic y más de 100 proveedores desde un único endpoint compatible con OpenAI, con control de presupuesto por clave.","Desplegar LiteLLM","\u002Fmarketplace\u002Finteligencia-artificial\u002Flitellm",[94,116,133],{"id":95,"slug":96,"slugs":97,"title":101,"excerpt":102,"readTime":103,"views":104,"isPinned":19,"publishedAt":105,"updatedAt":21,"category":106,"categories":111,"featuredImage":30,"bgImage":31,"posterImage":113,"relatedSolution":114},11,"como-alojar-ollama-en-un-vps",{"fr":98,"en":99,"ar":100,"es":96},"heberger-ollama-vps","how-to-host-ollama-on-a-vps","كيفية-استضافة-ollama-على-خادم-vps","Alojar Ollama en un VPS: guía operativa avanzada","Ollama avanzado en VPS: gestión de modelos, reverse proxy nginx, seguridad de la API, cuantización Q4_K_M\u002FQ8, CVE-2026-45672 en Open WebUI y acoplamiento seguro.",9,0,"2026-06-09T00:00:00+00:00",{"id":18,"name":107,"slug":108,"color":109,"icon":110},"Inteligencia Artificial","intelligence-artificielle","bg-purple-500\u002F10 text-purple-400","ia",[112],{"id":18,"name":107,"slug":108,"color":109,"icon":110},"\u002Fblog\u002Fcovers\u002Fheberger-ollama-vps-poster.svg",{"categorySlug":34,"appSlug":115},"ollama",{"id":117,"slug":118,"slugs":119,"title":123,"excerpt":124,"readTime":125,"views":104,"isPinned":19,"publishedAt":126,"updatedAt":21,"category":127,"categories":128,"featuredImage":30,"bgImage":31,"posterImage":130,"relatedSolution":131},2,"desplegar-dify-en-un-vps",{"fr":120,"en":121,"ar":122,"es":118},"deployer-dify-vps","deploying-dify-on-a-vps-ai-workflows-under-control","نشر-dify-على-vps-سير-عمل-الذكاء-الاصطناعي-تحت-السيطرة","Desplegar Dify en un VPS: guía completa de instalación y plugins","Instale Dify en un VPS ServOrbit: requisitos reales, Docker Compose, plugins offline, reverse proxy y solución de problemas.",8,"2026-02-11T00:00:00+00:00",{"id":18,"name":107,"slug":108,"color":109,"icon":110},[129],{"id":18,"name":107,"slug":108,"color":109,"icon":110},"\u002Fblog\u002Fcovers\u002Fdeployer-dify-vps-poster.svg",{"categorySlug":108,"appSlug":132},"dify",{"id":134,"slug":135,"slugs":136,"title":140,"excerpt":141,"readTime":142,"views":117,"isPinned":19,"publishedAt":143,"updatedAt":144,"category":145,"categories":149,"featuredImage":30,"bgImage":31,"posterImage":151,"relatedSolution":152},3,"instalar-n8n-en-vps-con-docker",{"fr":137,"en":138,"ar":139,"es":135},"installer-n8n-vps","install-n8n-on-vps-with-docker-complete-2026-guide","تثبيت-n8n-على-vps-مع-docker-دليل-شامل-2026","Instalar n8n en un VPS con Docker: guía completa 2026","Despliegue n8n en VPS con Docker, reverse proxy y HTTPS. Crash V8, 502 nginx, migración de npm a Docker y seguridad de ejecuciones persistidas (advisory agosto 2026).",12,"2026-06-05T00:00:00+00:00","2026-09-08T22:00:02+00:00",{"id":117,"name":146,"slug":147,"color":148,"icon":147},"Automatización","automatisation","bg-brand-action\u002F10 text-brand-action",[150],{"id":117,"name":146,"slug":147,"color":148,"icon":147},"\u002Fblog\u002Fcovers\u002Finstaller-n8n-vps-poster.svg",{"categorySlug":153,"appSlug":154},"automatizacion","n8n",1789665001641]