Crear, alojar y operar soluciones de IA.
Base de datos vectorial multimodal autoalojada — GraphQL, RAG y módulos de vectorización integrados en su VPS.
En validación
La instalación automática de esta solución está lista y ahora mismo está pasando nuestras pruebas en un servidor real. El pedido se abrirá en cuanto termine la validación.
Weaviate es una base de datos vectorial de código abierto escrita en Go, diseñada para la búsqueda semántica y la generación aumentada de recuperación (RAG) a escala. A diferencia de los almacenes de vectores puros, Weaviate incluye módulos de vectorización integrados — text2vec-openai, text2vec-cohere, img2vec — que convierten sus datos en embeddings durante la ingesta, sin necesidad de preprocesamiento en el cliente. Datos, vectores y metadatos estructurados conviven en el mismo registro, de modo que una única consulta GraphQL o REST devuelve objetos semánticamente relevantes con todas sus propiedades.
Desplegado en un VPS de ServOrbit, Weaviate se convierte en la capa de memoria y recuperación de su pila de IA: ingiera documentos, imágenes o entradas de una base de conocimiento y deje que su LLM — a través de LangChain, LlamaIndex o una llamada directa a la API — recupere el contexto más relevante antes de generar una respuesta. El enlace de bucle local mantiene todos los datos en su máquina: ningún embedding ni contenido privado abandona el servidor.
Indexe su documentación o base de conocimiento en Weaviate usando el módulo text2vec de su elección. En el momento de la consulta, recupere los k fragmentos más relevantes y páselos como contexto a su LLM. Toda la cadena se ejecuta en su VPS — ningún dato abandona la máquina.
Sustituya la búsqueda por palabras clave por una recuperación basada en el significado. Una consulta sobre 'resolución de disputas de factura' devuelve resultados sobre 'gestión de conflictos de facturación' aunque esas palabras exactas no aparezcan, porque Weaviate compara intenciones codificadas como vectores.
Almacene imágenes de productos junto a sus descripciones y metadatos en la misma colección de Weaviate. Busque por similitud de imagen, descripción textual o una combinación de ambas — útil para catálogos de comercio electrónico, bibliotecas de activos de diseño o archivos que mezclan texto y visuales.
Guía optimizada para los VPS Cloud ServOrbit.
Prevea al menos 2 GB de RAM: Weaviate en sí consume unos 400–600 MB en reposo, más memoria adicional para su índice y cualquier módulo de vectorización que habilite. Un VPS de 4 GB es un punto de partida cómodo. La máquina se entrega con Ubuntu 24.04 y Docker preinstalado.
En su área de cliente de ServOrbit: Marketplace → Inteligencia Artificial → Weaviate → Desplegar. La imagen semitechnologies/weaviate:1.27.2 arranca en segundos. Las APIs REST y GraphQL responden en el puerto 8080; la API gRPC escucha en el puerto 50051 — ambos restringidos a 127.0.0.1. El volumen weaviate_data conserva su esquema y objetos entre reinicios del contenedor.
Esta instancia de Weaviate funciona con acceso anónimo habilitado — no se necesita ninguna clave de API para conectarse. Los puertos están enlazados solo a 127.0.0.1, por lo que la base de datos no es accesible desde internet. Para llamar a la API REST o GraphQL desde su equipo, abra un túnel SSH: ssh -L 8080:127.0.0.1:<puerto> root@<ip-vps> (sustituya <puerto> por el que aparece en su área de cliente) y consulte http://localhost:8080/v1/schema.
Defina su esquema con una sola llamada REST: curl -X POST http://localhost:8080/v1/schema -H 'Content-Type: application/json' -d '{"class":"Document","vectorizer":"none","properties":[{"name":"content","dataType":["text"]}]}'. Con vectorizer: none usted suministra sus propios vectores en cada importación. Cambie a text2vec-openai (y añada OPENAI_APIKEY a las variables de entorno del contenedor) para que Weaviate llame al modelo de embedding automáticamente durante la ingesta.
Ejecute una búsqueda de vecino más cercano en GraphQL: curl http://localhost:8080/v1/graphql -d '{"query":"{Get{Document(nearVector:{vector:[0.1,0.2,...]},limit:5){content _additional{certainty}}}}"}' -H 'Content-Type: application/json'. Para el acceso estructurado, los endpoints REST /v1/objects y /v1/batch están disponibles a través de los clientes oficiales para Python, Go, TypeScript y Java.
Habilite la autenticación por clave de API añadiendo AUTHENTICATION_APIKEY_ENABLED=true y AUTHENTICATION_APIKEY_ALLOWED_KEYS=<su-clave> a las variables de entorno del contenedor y reiniciándolo. Una vez establecida una clave, cada petición debe incluir la cabecera Authorization: Bearer <clave>. La instancia puede entonces publicarse detrás de un dominio, con el vhost de nginx y el certificado TLS que gestiona ServOrbit.
Base de datos vectorial autoalojada para la búsqueda semántica y el RAG. Almacene, indexe y consulte embeddings de alta dimensión con indexación HNSW: la capa de infraestructura que le falta a su pila de LLM.
Inteligencia ArtificialSirva LLM de código abierto desde su propio servidor. Descargue Llama 3, Mistral, Qwen o DeepSeek con un solo comando, detrás de una API compatible con OpenAI y sin coste por token.
Inteligencia ArtificialInterfaz web para interactuar con sus LLM locales o remotos. Sus datos permanecen en su infraestructura — ningún tercero implicado.
Consulte nuestro centro de ayuda y nuestra FAQ, o contacte con nuestro equipo: llamada, WhatsApp o correo electrónico. Soporte en francés, inglés y árabe.
Escribir por WhatsAppse abre en una pestaña nueva