[{"data":1,"prerenderedAt":120},["ShallowReactive",2],{"seo-verification":3,"marketplace-app-es-litellm":6},{"google":4,"bing":5},"EycwPY2XMyTkVzas3n1ygeNJFGAH513qrMjfDljzsMQ","",{"key":7,"data":8},"marketplace-app-es-litellm",{"slug":9,"slugs":10,"categorySlugs":11,"name":16,"description":17,"phase":18,"unavailableReason":19,"docsUrl":20,"logo":21,"github":22,"tagline":23,"longDescription":24,"features":25,"useCases":32,"steps":42,"faq":61,"specs":80,"compatibleOs":88,"relatedApps":90,"relatedPosts":113,"category":117},"litellm",{"fr":9,"en":9,"ar":9,"es":9},{"fr":12,"en":13,"ar":14,"es":15},"ia","artificial-intelligence","الذكاء-الاصطناعي","inteligencia-artificial","LiteLLM","Pasarela de API autoalojada para más de 100 proveedores de LLM: un único punto de entrada compatible con OpenAI que enruta hacia Ollama, Anthropic, Azure y los demás, con claves virtuales, cuotas y seguimiento del gasto.",1,null,"https:\u002F\u002Fservorbit.com\u002Fblog\u002Falojar-litellm-en-un-vps-pasarela-llm-privada","https:\u002F\u002Favatars.githubusercontent.com\u002Fu\u002F132372032","https:\u002F\u002Fgithub.com\u002FBerriAI\u002Flitellm","Pasarela LLM autoalojada — un único punto de entrada compatible con OpenAI que enruta hacia Ollama, Anthropic y más de 100 proveedores.","LiteLLM es un proxy de LLM de código abierto (licencia Apache 2.0) que presenta una API unificada, compatible con OpenAI, delante de más de cien proveedores de modelos. La diferencia con Ollama y LocalAI es estructural: estos dos ejecutan los modelos, LiteLLM no ejecuta ninguno. Se sitúa delante de ellos y arbitra — cada solicitud parte hacia el Ollama instalado en el mismo VPS, hacia Anthropic Claude, hacia Azure OpenAI o hacia cualquier otro motor declarado, sin que cambie una sola línea de su aplicación. Es además el único de los tres componentes de inferencia del catálogo que aporta una capa de administración: interfaz web, claves virtuales, topes de gasto y límites de velocidad por clave.\n\nDesplegado en un VPS ServOrbit, LiteLLM ofrece a su equipo una pasarela de IA privada con un panel de uso integrado. Funciona en dos contenedores — la pasarela Python y una base de datos PostgreSQL 16 que conserva las claves, los registros de solicitudes y los contadores de gasto — y el servicio solo se publica en el bucle local del VPS. Por eso esta aplicación requiere un dominio: es a través de `https:\u002F\u002F\u003Csu-dominio>` como sus desarrolladores y sus aplicaciones la alcanzan, ya que ServOrbit instala el vhost de nginx y el certificado TLS en cuanto el dominio queda asociado. LiteLLM se coloca igual de bien delante de un Ollama local, para una inferencia totalmente sin conexión, que delante de API comerciales, para centralizar el seguimiento de los costos de todos sus proyectos.",[26,27,28,29,30,31],"API REST compatible con OpenAI — sustitución directa, compatible con todos los SDK que hablan con OpenAI","Más de 100 proveedores: Ollama, Anthropic, OpenAI, Azure, Mistral, Cohere, Bedrock y otros","Límites de velocidad y topes de presupuesto por clave — lo necesario para frenar una desviación de costos en un contexto multiequipo o multiproyecto","Análisis del gasto en tiempo real, con un detalle por modelo y por clave","Reparto de carga y conmutación automática entre varios puntos de entrada de proveedores","Licencia Apache 2.0 — totalmente auditable, sin telemetría y capaz de funcionar sin conexión a Internet con Ollama",[33,36,39],{"title":34,"body":35},"Backend de IA multimodelo","Envíe las tareas sensibles al costo hacia una instancia local de Ollama y las solicitudes de razonamiento complejo hacia Anthropic Claude, desde la misma llamada al SDK de OpenAI en su aplicación. El arbitraje se cambia en la configuración de LiteLLM, nunca en el código de la aplicación.",{"title":37,"body":38},"Control del presupuesto de IA de un equipo","Distribuya una clave de API virtual por equipo o por proyecto, con un tope de gasto mensual. Cuando una clave alcanza su presupuesto, LiteLLM responde con un error 429: se acabaron las facturas de nube descubiertas a fin de mes.",{"title":40,"body":41},"Cambio de proveedor de LLM","Haga que toda su aplicación pase de un proveedor a otro modificando un archivo de configuración. La superficie compatible con OpenAI garantiza que ningún código de aplicación se mueva: pasar de GPT-4 a Llama 3 servido por Ollama no exige tocar un solo import.",[43,46,49,52,55,58],{"title":44,"body":45},"Pedir el VPS","Un VPS ServOrbit de 1 GB de RAM basta para un uso individual: LiteLLM en sí consume unos 256 MB y PostgreSQL ocupa la mayor parte del resto. Cuente con 2 GB para un equipo que envía solicitudes en paralelo. Prevea también el dominio por el que se alcanzará la pasarela: no es accesible de otro modo.",{"title":47,"body":48},"Dejar que la instalación genere los secretos","No tiene nada que fabricar a mano: el despliegue genera la clave maestra `LITELLM_MASTER_KEY`, las credenciales de la base de datos PostgreSQL y la contraseña de la interfaz de administración. La clave maestra abre el panel de control y el conjunto de los puntos de entrada de administración — trátela como una contraseña y consérvela fuera del servidor.",{"title":50,"body":51},"Conectarse por primera vez","Abra la interfaz de administración en `https:\u002F\u002F\u003Csu-dominio>\u002Fui`: LiteLLM muestra un formulario de identificador y contraseña. Introduzca `admin` y la contraseña generada durante la instalación, que se muestra en la ficha de la aplicación en su área de cliente, y cree después sus claves virtuales desde el panel de control.",{"title":53,"body":54},"Lo que despliega la instalación","Dos contenedores se inician a la vez: la pasarela `ghcr.io\u002Fberriai\u002Flitellm:main-latest`, publicada en `127.0.0.1:4000`, y una base de datos `postgres:16-alpine`. Los datos persisten en dos volúmenes, `litellm_db` para la base de datos y `litellm_config` para la configuración de la pasarela. Cuente unos treinta segundos en el primer arranque.",{"title":56,"body":57},"Declarar su primer modelo","En el panel de control, abra Models y luego Add. Para enrutar hacia un Ollama instalado en la misma máquina, introduzca un nombre de modelo del tipo `ollama\u002Fllama3.1` con la URL base `http:\u002F\u002Fhost.docker.internal:11434`; para un proveedor remoto, pegue la clave de API correspondiente, por ejemplo para `anthropic\u002Fclaude-3-5-haiku-20241022`. Compruébelo con `curl -H \"Authorization: Bearer \u003CLITELLM_MASTER_KEY>\" https:\u002F\u002F\u003Csu-dominio>\u002Fv1\u002Fmodels`: esa misma dirección, `https:\u002F\u002F\u003Csu-dominio>\u002Fv1`, es la URL base que debe indicar a sus SDK.",{"title":59,"body":60},"Distribuir claves a sus equipos","En la sección API Keys del panel de control, cree una clave virtual por equipo, con un `max_budget` si procede — el presupuesto acumulado, expresado en dólares —, un `tpm_limit` en tokens por minuto y un `rpm_limit` en solicitudes por minuto. Sus desarrolladores apuntan su SDK de OpenAI a la pasarela, y el gasto se contabiliza clave por clave.",[62,65,68,71,74,77],{"q":63,"a":64},"¿Qué es LiteLLM?","LiteLLM es un proxy de LLM de código abierto, con licencia Apache 2.0, que expone una API unificada compatible con OpenAI delante de más de cien proveedores de modelos: Ollama, Anthropic Claude, OpenAI GPT-4, Azure OpenAI, Mistral, Cohere y otros. Se intercala entre sus aplicaciones y los motores de inferencia, y se encarga del enrutamiento, la limitación de velocidad y el seguimiento de los costos.",{"q":66,"a":67},"¿Cuánta RAM se necesita para LiteLLM?","LiteLLM consume unos 256 MB por sí solo. PostgreSQL, que conserva el seguimiento de uso y las estadísticas, añade entre 256 y 512 MB. Un VPS de 1 GB constituye el mínimo cómodo para un único usuario; se recomiendan 2 GB para un despliegue de equipo con solicitudes simultáneas.",{"q":69,"a":70},"¿Puede LiteLLM utilizar mi instancia de Ollama?","Sí. Añada Ollama como proveedor en el panel de control e indique `http:\u002F\u002Fhost.docker.internal:11434` como URL base — Docker añade este host automáticamente. Cualquier aplicación que utilice el SDK de OpenAI llamará entonces a sus modelos de Ollama a través de LiteLLM sin cambiar un solo import.",{"q":72,"a":73},"¿Cómo limitar el gasto por equipo?","Cree claves de API virtuales en el panel de control e indique su `max_budget` en dólares. En cuanto el gasto acumulado de una clave alcanza el tope, LiteLLM responde con un error 429. También puede establecer un `tpm_limit`, en tokens por minuto, y un `rpm_limit`, en solicitudes por minuto, para un control por velocidad.",{"q":75,"a":76},"¿Hay un panel de control integrado?","Sí. LiteLLM incorpora una interfaz web servida en `\u002Fui`. Muestra el gasto en tiempo real por clave y por modelo, los registros de solicitudes y el detalle de las latencias, y permite gestionar modelos, claves virtuales y presupuestos de equipo — sin desplegar nada más.",{"q":78,"a":79},"¿Funciona LiteLLM sin conexión a Internet, únicamente con modelos locales?","Sí. Declare Ollama como único proveedor y retire toda clave de API externa: la inferencia permanece íntegramente en su VPS. LiteLLM añade entonces el enrutamiento, el reparto de carga y el panel de control por encima de su Ollama local, sin exigir la menor conexión saliente.",{"ram":81,"cpu":82,"stack":83,"port":87},"1 GB (2 GB recomendado)","2 vCPU",[84,85,86],"Docker","Python","PostgreSQL 16","4000",[89],"ubuntu-24.04",[91,99,105],{"name":92,"slug":93,"categorySlug":15,"categoryName":94,"categoryColor":95,"logo":96,"tagline":97,"description":98},"Ollama","ollama","Inteligencia Artificial","text-purple-400 bg-purple-500\u002F10","https:\u002F\u002Fcdn.simpleicons.org\u002Follama","Sirva LLM de código abierto desde su VPS — API compatible con OpenAI, sin coste por token.","Sirva LLM de código abierto desde su propio servidor. Descargue Llama 3, Mistral, Qwen o DeepSeek con un solo comando, detrás de una API compatible con OpenAI y sin coste por token.",{"name":100,"slug":101,"categorySlug":15,"categoryName":94,"categoryColor":95,"logo":102,"tagline":103,"description":104},"Open WebUI","open-webui","https:\u002F\u002Fcdn.jsdelivr.net\u002Fgh\u002Fselfhst\u002Ficons\u002Fsvg\u002Fopen-webui.svg","Interfaz web para sus LLM — Ollama, OpenAI, Mistral — alojada en su propio servidor.","Interfaz web para interactuar con sus LLM locales o remotos. Sus datos permanecen en su infraestructura — ningún tercero implicado.",{"name":106,"slug":106,"categorySlug":107,"categoryName":108,"categoryColor":109,"logo":110,"tagline":111,"description":112},"n8n","automatizacion","Automatización y flujos de trabajo","text-brand-action bg-brand-action\u002F10","https:\u002F\u002Fcdn.simpleicons.org\u002Fn8n","Automatice sus procesos de negocio con 400+ integraciones — 100 % autoalojado en su VPS.","Automatice sus flujos de trabajo entre aplicaciones sin código. Más de 400 integraciones, 100 % autoalojado en su VPS.",[114,115,116],"self-host-litellm-vps","heberger-ollama-vps","deployer-dify-vps",{"key":12,"slug":15,"name":94,"objective":118,"icon":119,"color":95},"Crear, alojar y operar soluciones de IA.","ai",1789665092277]