Crear, alojar y operar soluciones de IA.
Observabilidad autoalojada para aplicaciones LLM: cada llamada trazada, cada costo medido, cada prompt versionado y evaluado — sin enviar sus trazas a terceros.
Langfuse es una plataforma de observabilidad de código abierto para aplicaciones basadas en modelos de lenguaje. Ofrece una visibilidad detallada de cada llamada de IA que realiza su aplicación: traza completa del prompt y de la respuesta, desglose de las latencias, seguimiento del costo por modelo y por usuario, y puntuaciones de evaluación estructuradas, reunidos en un único panel de control. Mientras que una herramienta de monitoreo de infraestructura le dice que el servidor funciona bien, Langfuse le dice lo que su modelo respondió realmente, cuánto costó y si la calidad se ha degradado desde la última versión del prompt.
Desplegado en su VPS, Langfuse sustituye a los servicios alojados equivalentes (Langsmith, Helicone, Arize) sin transmitir sus trazas ni los datos de sus usuarios a terceros. Basta una sola llamada del SDK para instrumentar una pila Python, TypeScript o compatible con OpenAI — decorador `@observe()` o `langfuse.trace()` — y las integraciones LiteLLM, LangChain, LlamaIndex y Dify emiten sus trazas automáticamente. La versión 3.x, cuyo núcleo se publica bajo licencia MIT, añade un centro de gestión de prompts: sus ingenieros comparan variantes, lanzan evaluaciones mediante juez LLM o mediante anotación humana, y promueven la versión ganadora a producción sin volver a desplegar el código. Una API REST y un SDK web completan el conjunto.
Cuando un nuevo modelo o una nueva versión de prompt degrada las respuestas, filtre las trazas por puntuación de evaluación, compárelas en paralelo con la versión anterior y reproduzca la entrada defectuosa con un solo clic. Busca la causa en casos reales en lugar de en comentarios aproximados de los usuarios.
Haga un seguimiento del consumo de tokens por modelo, por usuario y por funcionalidad, y detecte el endpoint que supera su presupuesto. La decisión de pasar de un modelo caro a un modelo más económico se toma entonces con mediciones, no con una intuición.
Publique una nueva versión de prompt desde la interfaz de Langfuse, dirija hacia ella una parte del tráfico, recopile las puntuaciones de evaluación y promueva la versión ganadora — sin tocar el código de su aplicación ni esperar una ventana de despliegue.
Guía optimizada para los VPS Cloud ServOrbit.
Langfuse ejecuta seis servicios: la interfaz web, un worker en segundo plano, PostgreSQL 16, ClickHouse 24, Redis 7 y MinIO. 4 GB constituyen el mínimo practicable y se recomiendan 8 GB para una carga de producción. Prevea también espacio en disco: ClickHouse acumula las trazas con el paso del tiempo.
Langfuse exige un dominio: su autenticación se basa en NextAuth.js, que necesita un FQDN resoluble públicamente en HTTPS para establecer la URL de retorno y las cookies de sesión. Basta con un subdominio de un dominio de su propiedad — cree un registro A hacia la IP del VPS antes de iniciar el despliegue.
La URL abre la pantalla de Langfuse con un enlace «Sign up»: cree su cuenta y, a continuación, su organización y su primer proyecto en el asistente.
Seleccione Langfuse en el Marketplace de ServOrbit y haga clic en Desplegar. Docker Compose levanta los seis servicios automáticamente. La interfaz web responde en su dominio en cuanto se superan los controles de estado: cuente entre 60 y 90 segundos en el primer arranque, el tiempo que ClickHouse necesita para inicializarse.
Abra su dominio y cree su cuenta — el registro está activo de forma predeterminada. Cree después un proyecto y anote su par de claves pública y secreta desde la página Settings. Cree un par distinto por entorno para poder revocar los accesos de desarrollo sin tocar la producción.
En Python: pip install langfuse, indique LANGFUSE_HOST con su dominio, así como LANGFUSE_PUBLIC_KEY y LANGFUSE_SECRET_KEY, y luego decore sus llamadas al modelo con @observe(). En TypeScript: npm install langfuse y, a continuación, inicialice el cliente con los mismos valores. Si LiteLLM ya está en su pila, añada success_callback = ["langfuse"] a su litellm_config.yaml y las llamadas que pasan por el proxy quedan trazadas sin modificar ni una línea de la aplicación. Las primeras trazas aparecen en el panel de control en unos segundos.
¿Mantiene un proyecto que utiliza Langfuse? Este botón permite a sus lectores desplegarlo en un VPS con un clic, sin leer documentación de Docker.
[](https://servorbit.com/vps-cloud?template=langfuse&utm_source=deploy-badge&utm_medium=referral&utm_campaign=langfuse)<a href="https://servorbit.com/vps-cloud?template=langfuse&utm_source=deploy-badge&utm_medium=referral&utm_campaign=langfuse"><img src="https://servorbit.com/brand/deploy/button.svg" alt="Deploy Langfuse on ServOrbit" height="40"></a>El botón lleva al pedido de un VPS con la plantilla preseleccionada. La imagen se sirve desde servorbit.com: no tiene que alojar nada por su parte.
Interfaz web para interactuar con sus LLM locales o remotos. Sus datos permanecen en su infraestructura — ningún tercero implicado.
Inteligencia ArtificialSirva LLM de código abierto desde su propio servidor. Descargue Llama 3, Mistral, Qwen o DeepSeek con un solo comando, detrás de una API compatible con OpenAI y sin coste por token.
Inteligencia ArtificialCree aplicaciones LLM de forma visual: chatbots, agentes RAG, pipelines — sin escribir código backend.
Consulte nuestro centro de ayuda y nuestra FAQ, o contacte con nuestro equipo: llamada, WhatsApp o correo electrónico. Soporte en francés, inglés y árabe.
Escribir por WhatsAppse abre en una pestaña nueva