[{"data":1,"prerenderedAt":169},["ShallowReactive",2],{"seo-verification":3,"blog-github-copilot-ai-credits-recuperar-control-con-un-vps-es":6},{"google":4,"bing":5},"EycwPY2XMyTkVzas3n1ygeNJFGAH513qrMjfDljzsMQ","",{"key":7,"data":8},"blog-github-copilot-ai-credits-recuperar-control-con-un-vps-es",{"id":9,"slug":10,"slugs":11,"title":15,"excerpt":16,"readTime":17,"views":18,"isPinned":19,"publishedAt":20,"updatedAt":21,"category":22,"categories":28,"featuredImage":30,"bgImage":31,"posterImage":32,"relatedSolution":33,"intro":36,"sections":37,"ctaTitle":110,"ctaBody":111,"ctaButton":112,"ctaUrl":113,"relatedPosts":114},271,"github-copilot-ai-credits-recuperar-control-con-un-vps",{"fr":12,"en":13,"ar":14,"es":10},"github-copilot-ai-credits-alternative-vps","github-copilot-ai-credits-take-back-control-with-a-vps","github-copilot-ai-credits-استعد-السيطرة-مع-خادم-vps","GitHub Copilot AI Credits: recuperar el control en un VPS","Desde junio de 2026, Copilot factura en AI Credits y la previsibilidad desaparece. Aloje Ollama o Tabby en un VPS: costo fijo y prompts privados.",8,0,false,"2026-08-16T00:00:00+00:00","2026-09-07T11:26:10+00:00",{"id":23,"name":24,"slug":25,"color":26,"icon":27},1,"Inteligencia Artificial","intelligence-artificielle","bg-purple-500\u002F10 text-purple-400","ia",[29],{"id":23,"name":24,"slug":25,"color":26,"icon":27},null,"\u002Fblog\u002Fcovers\u002Fbg.svg","\u002Fblog\u002Fcovers\u002Fgithub-copilot-ai-credits-alternative-vps-poster.svg",{"categorySlug":34,"appSlug":35},"inteligencia-artificial","ollama","Desde el 1 de junio de 2026, GitHub Copilot factura en AI Credits: unidades indexadas al consumo de tokens. Desde el primer día, desarrolladores con el plan Pro+ consumieron el 8 % de su cuota mensual de 7000 créditos en dos horas, durante sesiones agénticas ordinarias. La previsibilidad desaparece justo en el momento en que el uso sube. Existe una alternativa directa: alojar su propio motor de inferencia en un VPS, conectar VS Code a él mediante Continue.dev y recuperar un costo mensual fijo sin que un solo prompt salga de su servidor.",[38,42,52,55,58,80,83,98,101,104,107],{"type":39,"title":40,"body":41},"h2","Por qué el cambio a los AI Credits lo cambia todo","Hasta el 31 de mayo de 2026, Copilot Pro+ facturaba un importe fijo al mes, sin importar el volumen de peticiones. Desde el 1 de junio, cada plan de Copilot incluye un presupuesto mensual en AI Credits que se convierte en tokens según el modelo utilizado. El resultado medido por los primeros usuarios: una sesión agéntica de dos horas bastó para consumir el 8 % de la cuota mensual del plan Pro+, con una cuota estimada en 7000 créditos que se agota en menos de dos días a ese ritmo. El problema no es el precio por petición: es que ya no existe un importe fijo de base. Un flujo de trabajo agéntico que abre varios archivos, llama a herramientas e itera consume un múltiplo de lo que usaría un simple autocompletado. La previsibilidad, que era la promesa de la tarifa plana, ya no existe.",{"type":43,"title":44,"items":45},"ul","Seis razones para pasar a un asistente de código self-hosted",[46,47,48,49,50,51],"**Costo mensual fijo**: un VPS con Ollama cuesta lo mismo cada mes, sea cual sea la carga agéntica.","**Confidencialidad de los prompts**: ninguna línea de código ni ningún contexto de proyecto sale de su infraestructura.","**Libre elección del modelo**: Qwen2.5-Coder, DeepSeek Coder, Llama 3.2 o cualquier modelo en formato GGUF disponible a través de Ollama.","**Sin cuota por sesión**: nada de degradación ni de bloqueo a fin de mes.","**Portabilidad**: el mismo servidor Ollama alimenta VS Code, JetBrains, Neovim o un pipeline de CI.","**Independencia de las decisiones de precios**: los cambios de precio o de política de GitHub ya no afectan a su asistente de código.",{"type":39,"title":53,"body":54},"Requisitos con cifras","Para ejecutar un modelo 7B cuantizado en Q4_K_M — el formato recomendado para un buen equilibrio entre calidad y rendimiento — cuente con **un mínimo de 4 GB de RAM dedicados al proceso Ollama**. Con 8 GB, el modelo permanece en memoria entre peticiones y evita la recarga. Para los modelos 14B, apunte a 16 GB.\n\nEn cuanto al software: Docker y Docker Compose instalados en el VPS, un subdominio (p. ej. `ollama.su-dominio.com`) apuntando a la IP del VPS, y el puerto 443 abierto. No se requiere ninguna tarjeta gráfica: un modelo 7B en Q4_K_M funciona en CPU a entre 5 y 15 tokens por segundo según el número de vCPU, suficiente para el autocompletado de funciones y el chat interactivo.",{"type":39,"title":56,"body":57},"Opción 1 — Continue.dev + Ollama: la configuración en cinco minutos","Continue.dev se instala como cualquier otra extensión de VS Code. Lee un archivo `config.json` para saber a qué modelo conectarse. Ese modelo puede ser local o remoto — es este segundo caso el que nos interesa: su VPS aloja el motor de inferencia, su equipo aloja el IDE. La cadena completa: extensión de VS Code → `~\u002F.continue\u002Fconfig.json` → URL HTTPS del reverse proxy → puerto `11434` de Ollama en el VPS.",{"type":59,"title":60,"steps":61},"steps","Desplegar Continue.dev + Ollama en un VPS",[62,65,68,71,74,77],{"title":63,"body":64},"Aprovisionar el VPS e instalar Docker","Conéctese por SSH, actualice el sistema y luego instale Docker con el instalador oficial:\n```bash\ncurl -fsSL https:\u002F\u002Fget.docker.com | sh\n```\nCompruébelo con `docker compose version`. Cree una carpeta dedicada: `mkdir -p \u002Fopt\u002Follama`.",{"title":66,"body":67},"Iniciar Ollama y descargar un modelo","Lance el contenedor oficial exponiendo el puerto únicamente en localhost:\n```bash\ndocker run -d --name ollama -p 127.0.0.1:11434:11434 -v ollama:\u002Froot\u002F.ollama ollama\u002Follama\n```\nDescargue un modelo orientado a código: `docker exec ollama ollama pull qwen2.5-coder:7b-instruct-q4_K_M`. La descarga tarda unos minutos según la conexión.",{"title":69,"body":70},"Configurar el reverse proxy con TLS","No exponga nunca el puerto 11434 directamente en Internet: Ollama no tiene ninguna autenticación nativa. Con Caddy, basta una directiva en el Caddyfile para terminar TLS y redirigir hacia `localhost:11434`. Añada una autenticación básica o una cabecera secreta para restringir el acceso. Cierre el puerto directo: `ufw deny 11434`.",{"title":72,"body":73},"Instalar Continue.dev en VS Code","Abra el panel de Extensiones (`Ctrl+Shift+X`), busque **Continue** y haga clic en Instalar. La extensión añade un icono en la barra lateral. Abra `~\u002F.continue\u002Fconfig.json` (macOS\u002FLinux) desde el icono de engranaje del panel Continue.",{"title":75,"body":76},"Editar config.json para apuntar al VPS","En el array `models`, añada una entrada de tipo `ollama` con el campo `apiBase` apuntando a la URL HTTPS de su reverse proxy. Rellene también el campo `model` con el nombre exacto del modelo descargado (`qwen2.5-coder:7b-instruct-q4_K_M`). Guarde: Continue.dev recarga la configuración sin reiniciar.",{"title":78,"body":79},"Probar el autocompletado desde VS Code","Abra un archivo de código, coloque el cursor después de una firma de función parcial y espere el autocompletado en línea. O abra el panel de chat de Continue y haga una pregunta sobre su base de código. La respuesta proviene de su VPS: ningún prompt pasa por los servidores de GitHub.",{"type":39,"title":81,"body":82},"Opción 2 — Tabby: servidor de autocompletado dedicado para un equipo","Tabby es un servidor de autocompletado de código autoalojado con alrededor de 33 800 estrellas en GitHub y una licencia Apache 2.0 para el núcleo de código abierto. Expone una API compatible con los plugins oficiales de VS Code, JetBrains y Neovim, y gestiona la autenticación por token: cada desarrollador obtiene una clave individual. Esa es la diferencia principal con Ollama + Continue.dev: Tabby está diseñado para servir a varios puestos de trabajo desde un único servidor, con una interfaz de administración y registros de uso por desarrollador.",{"type":59,"title":84,"steps":85},"Desplegar Tabby con Docker Compose",[86,89,92,95],{"title":87,"body":88},"Crear el archivo Docker Compose","Defina el servicio con la imagen oficial `tabbyml\u002Ftabby`. Para un uso solo con CPU, omita las opciones de GPU y elija un modelo compacto como argumento de arranque: `--model StarCoder2-3B` o `--model Qwen2.5-Coder-1.5B`. Monte un volumen para conservar los modelos descargados entre reinicios y exponga el puerto 8080 únicamente en `127.0.0.1`.",{"title":90,"body":91},"Iniciar el servidor y esperar la carga del modelo","Ejecute `docker compose up -d` y luego siga los logs: `docker compose logs -f tabby`. El modelo se descarga en el primer arranque. Tabby confirma que está operativo cuando muestra el puerto de escucha en los logs.",{"title":93,"body":94},"Configurar el reverse proxy y activar la autenticación","Apunte un subdominio a `localhost:8080` mediante Caddy o Nginx Proxy Manager con TLS. En la interfaz de administración de Tabby, active la gestión de usuarios, cree la cuenta de administrador y genere tokens de acceso individuales para cada desarrollador.",{"title":96,"body":97},"Instalar el plugin de VS Code e introducir el token","En VS Code, instale la extensión **Tabby** disponible en el Marketplace. Introduzca la URL de su servidor (p. ej. `https:\u002F\u002Ftabby.su-dominio.com`) y el token personal en los ajustes de la extensión. El autocompletado en línea se activa de inmediato en todos los archivos abiertos.",{"type":39,"title":99,"body":100},"LiteLLM como pasarela multimodelo","Si orquesta varias fuentes de modelos — Ollama en un VPS para el trabajo diario, una API externa para las tareas complejas — LiteLLM lo unifica todo detrás de un único punto de entrada compatible con OpenAI. Continue.dev o cualquier cliente que hable OpenAI apunta a LiteLLM, que enruta hacia el backend adecuado según reglas de prioridad o de presupuesto.\n\nUsted define topes de gasto por clave API, fallbacks automáticos en caso de error de un proveedor y una rotación entre modelos desde un archivo de configuración central. La plantilla VPS LiteLLM del catálogo ServOrbit despliega el proxy y su base de datos PostgreSQL con un solo comando. Es la capa indicada si quiere conservar la posibilidad de cambiar a un modelo en la nube sin modificar la configuración de su editor.",{"type":102,"body":103},"tip","No exponga nunca Ollama directamente en Internet. Cierre el puerto `11434` con `ufw deny 11434` y deje que solo el reverse proxy se conecte a él en local. Si varias personas comparten el mismo servidor Ollama, LiteLLM añade por encima una capa de gestión de claves API individuales, sin modificar la configuración de Ollama: cada desarrollador tiene su token de LiteLLM, y LiteLLM habla con Ollama internamente.",{"type":39,"title":105,"body":106},"Resolución de problemas","**Timeout de Ollama en la primera llamada.** Compruebe que el contenedor está en marcha (`docker ps`) y que el modelo está cargado (`docker exec ollama ollama list`). Un modelo 7B puede tardar de 30 a 60 segundos en cargarse en memoria en la primera llamada tras un reinicio del contenedor.\n\n**Modelo demasiado pesado para la RAM disponible.** Vigile `docker stats` para seguir el uso de memoria. Pase a una cuantización más ligera (`Q3_K_M` o `Q2_K`) o a un modelo más compacto (1.5B o 3B).\n\n**Continue.dev no encuentra la API.** Compruebe que `apiBase` en `config.json` apunta a la URL HTTPS de su reverse proxy y no a `localhost:11434`. Pruebe con `curl -I https:\u002F\u002Follama.su-dominio.com` para confirmar que el certificado TLS es válido y que el servidor responde.\n\n**Latencia elevada solo con CPU.** En un modelo 7B en Q4 sin GPU, cuente entre 5 y 15 tokens por segundo según el número de vCPU. Reduzca el contexto enviado a Continue.dev limitando el número de archivos abiertos incluidos en el índice (parámetro `contextLength`).",{"type":39,"title":108,"body":109},"Lo que cambia en la práctica","El paso de Copilot a los AI Credits ha vuelto variable la facturación justo cuando las sesiones agénticas son las que más consumen. Un VPS con Ollama responde con un costo mensual fijo, un control total sobre los modelos utilizados y prompts que se quedan en su infraestructura.\n\nContinue.dev cubre el caso individual en cinco minutos sin cambiar de IDE. Tabby cubre el caso de equipo con autenticación por token y administración centralizada. LiteLLM se intercala si orquesta varias fuentes de modelos desde un punto único. Estas tres herramientas son complementarias, no competidoras: la elección depende del número de desarrolladores, de la necesidad de auditoría y de la diversidad de modelos que orquestar.","Motor de inferencia listo en VPS, a costo fijo","La plantilla Ollama del catálogo ServOrbit despliega el motor de inferencia en un VPS Cloud con un solo comando. API compatible con OpenAI, puerto expuesto únicamente en local, volumen persistente para los modelos. Añada Continue.dev a VS Code y su asistente de código funcionará en su propia infraestructura.","Activar Ollama en VPS","\u002Fmarketplace\u002Finteligencia-artificial\u002Follama",[115,131,153],{"id":116,"slug":117,"slugs":118,"title":122,"excerpt":123,"readTime":124,"views":18,"isPinned":19,"publishedAt":125,"updatedAt":21,"category":126,"categories":127,"featuredImage":30,"bgImage":31,"posterImage":129,"relatedSolution":130},11,"como-alojar-ollama-en-un-vps",{"fr":119,"en":120,"ar":121,"es":117},"heberger-ollama-vps","how-to-host-ollama-on-a-vps","كيفية-استضافة-ollama-على-خادم-vps","Alojar Ollama en un VPS: guía operativa avanzada","Ollama avanzado en VPS: gestión de modelos, reverse proxy nginx, seguridad de la API, cuantización Q4_K_M\u002FQ8, CVE-2026-45672 en Open WebUI y acoplamiento seguro.",9,"2026-06-09T00:00:00+00:00",{"id":23,"name":24,"slug":25,"color":26,"icon":27},[128],{"id":23,"name":24,"slug":25,"color":26,"icon":27},"\u002Fblog\u002Fcovers\u002Fheberger-ollama-vps-poster.svg",{"categorySlug":34,"appSlug":35},{"id":132,"slug":133,"slugs":134,"title":138,"excerpt":139,"readTime":140,"views":23,"isPinned":19,"publishedAt":141,"updatedAt":21,"category":142,"categories":148,"featuredImage":30,"bgImage":31,"posterImage":150,"relatedSolution":151},156,"alojar-litellm-en-un-vps-pasarela-llm-privada",{"fr":135,"en":136,"ar":137,"es":133},"self-host-litellm-vps","self-host-litellm-on-a-vps-your-private-llm-api-gateway","استضف-litellm-ذاتيا-على-vps-بوابة-api-خاصة-لنماذج-llm","Alojar LiteLLM en un VPS: su pasarela de API LLM privada","Despliegue LiteLLM en un VPS ServOrbit: pasarela de API compatible con OpenAI hacia Ollama, Anthropic, Azure y 100+ LLM, con control del gasto y límites por clave.",4,"2026-01-21T00:00:00+00:00",{"id":143,"name":144,"slug":145,"color":146,"icon":147},7,"Autoalojamiento","self-hosting","bg-indigo-500\u002F10 text-indigo-400","cloud",[149],{"id":143,"name":144,"slug":145,"color":146,"icon":147},"\u002Fblog\u002Fcovers\u002Fself-host-litellm-vps-poster.svg",{"categorySlug":34,"appSlug":152},"litellm",{"id":154,"slug":155,"slugs":156,"title":160,"excerpt":161,"readTime":162,"views":23,"isPinned":19,"publishedAt":163,"updatedAt":164,"category":165,"categories":166,"featuredImage":30,"bgImage":31,"posterImage":168,"relatedSolution":30},214,"desplegar-servidor-mcp-en-un-vps",{"fr":157,"en":158,"ar":159,"es":155},"mcp-serveur-ia-auto-heberge-vps","how-to-deploy-an-mcp-server-on-a-vps","كيفية-نشر-خادم-mcp-على-vps","Desplegar un servidor MCP en un VPS","El protocolo MCP 2026-07-28 se ha convertido en el estándar universal de los agentes de IA. Así se aloja su propio servidor MCP en un VPS, paso a paso.",5,"2026-08-03T00:00:00+00:00","2026-09-07T19:17:13+00:00",{"id":23,"name":24,"slug":25,"color":26,"icon":27},[167],{"id":23,"name":24,"slug":25,"color":26,"icon":27},"\u002Fblog\u002Fcovers\u002Fmcp-serveur-ia-auto-heberge-vps-poster.svg",1789665021395]