SOVNEX AISOVEREIGN NEXUS
Local primero · Soberano · Multi-agentes

Tu conocimiento, tus modelos,
tu infraestructura

Sovnex es un espacio de trabajo de IA autoalojado construido sobre tres pilares: una base de conocimiento soberana y multilingüe gobernada por agentes locales, el análisis de RFP y la redacción de ofertas con múltiples agentes, y un Token Factory local que pone todos los modelos —incluidos los tuyos— detrás de una única API. Nada sale de tu red.

Pilar 01

Una base de conocimiento soberana,
agentes locales, cualquier idioma

Documentos, embeddings y prompts se quedan en tu propia infraestructura. Agentes especializados recuperan y razonan sobre ellos, y el idioma nunca es una barrera entre la pregunta y la respuesta.

Funciona por completo dentro de tu red
Despliega on-premise o en tu nube privada. Archivos, embeddings, prompts e inferencia permanecen en hardware que tú controlas, así que el material sensible nunca llega a una API de terceros.
Recuperación multi-agentes local
Agentes especializados —recuperar, analizar, redactar, revisar— descomponen una pregunta compleja en pasos y la resuelven juntos, en lugar de comprimirlo todo en un único prompt.
Multilingüe y translingüe
El espacio de trabajo habla seis idiomas y la recuperación los cruza: pregunta en francés y Sovnex fundamentará la respuesta en tus documentos en inglés o chino, citando el pasaje original.
Cada respuesta rastreable hasta su fuente
Cada respuesta apunta al fragmento exacto del que procede, hasta la página. El troceado es visible y editable, así que tu equipo corrige la fuente en lugar de discutir con el modelo.
El espacio de trabajo de Sovnex: bases de conocimiento, preguntas y respuestas, chat y búsqueda sobre tus propios documentos

Un único espacio de trabajo sobre tus documentos: bases de conocimiento, preguntas y respuestas, chat y búsqueda, respondiendo desde un modelo local.

Pilar 02

Del pliego de licitación a
una oferta con fuentes

Sube una RFP, un pliego de licitación o un cuestionario de seguridad. Sovnex lo descompone en requisitos, encuentra la evidencia en tu base de conocimiento y redacta una respuesta para cada uno, con su cita en cada afirmación.

  1. 1

    Extraer cada requisito

    El pliego se convierte en una lista detallada de requisitos y preguntas, de modo que nada enterrado en la página 40 se queda fuera.

  2. 2

    Recuperar la evidencia

    Para cada requisito, los agentes buscan en tus propuestas anteriores, certificaciones y fichas técnicas, y reúnen los pasajes que realmente lo responden.

  3. 3

    Redactar la respuesta

    Se produce una respuesta escrita por requisito, en el idioma del pliego, con cada afirmación enlazada a la fuente de la que procede.

  4. 4

    Revisar y exportar

    Tu equipo revisa, edita y exporta. Las puntuaciones de confianza y las citas dejan claro qué respuestas necesitan antes un ojo humano.

app.sovnexai.com

Redacta una respuesta al requisito 4.2: «Describe tu cifrado de datos en reposo y en tránsito».

Y

Todos los datos están cifrados: AES-256 en reposo y TLS 1.3 en tránsito. Sovnex se ejecuta íntegramente dentro de tu red, por lo que los datos de clientes nunca salen de tu infraestructura. La gestión de claves se integra con tu KMS/HSM existente…

Fuente: Security_Whitepaper.pdf p.7Confianza: 98 %

Pregunta o pega un requisito de la RFP…

Pilar 03

Una API delante de cada modelo,
para que tus agentes cuesten menos

Token Factory es la pasarela de modelos que se entrega con Sovnex. Apunta cualquier SDK de OpenAI hacia ella y alcanza a todos los proveedores —o a tus propios modelos locales— a través de una única interfaz, con presupuestos, cuotas y uso completamente bajo tu control.

Endpoints compatibles con OpenAI
Cambia una sola base URL y tu código actual sigue funcionando. /v1/chat/completions y /v1/embeddings se comportan exactamente como espera el SDK de OpenAI, así que nada más en tu stack tiene que cambiar.
Todos los proveedores tras una sola interfaz
OpenAI, Claude, Gemini, DeepSeek y Qwen junto a despliegues locales de vLLM u Ollama. Agrúpalos en canales, mapea nombres de modelos y conmuta automáticamente cuando uno falla.
Enruta el trabajo rutinario a modelos locales
El tráfico diario y por lotes de tus agentes se ejecuta en tu propio despliegue de Ollama o vLLM con coste de tokens externo cero. Solo salen las llamadas que de verdad necesitan un modelo de frontera, que es donde se va la mayor parte del gasto.
Presupuestos, cuotas y límites de tasa
Emite un token de API por equipo o proyecto y luego limita su presupuesto, fija una caducidad, restringe los modelos que puede llamar y controla su tasa de peticiones, sin repartir ni una sola clave del proveedor original.
Uso y coste auditables
Cada llamada registra el modelo, el número de tokens, la latencia y el coste. Desglosa el gasto por token, usuario o canal para ver exactamente adónde fue el presupuesto.
python
from openai import OpenAI

client = OpenAI(
    base_url="https://sovnex.internal/v1",  el único cambio
    api_key="sk-sovnex-••••",
)

client.chat.completions.create(
    model="qwen2.5-72b",  # o cualquier canal que hayas configurado
    messages=[{"role": "user", …}],
)
OpenAIClaudeGeminiDeepSeekQwenvLLMOllama

El mismo endpoint tanto si hoy enruta a un Qwen local como si mañana lo hace a un modelo de frontera.

Lista de tokens de Token Factory con cuota usada, cuota restante y caducidad de cada token

Cada token lleva su propia cuota, caducidad y lista de modelos permitidos, e informa de lo que ha gastado.

Sobre Sovnex AI

Hecho para quedarse dentro de tus muros

Sovnex AI construye un motor RAG soberano para equipos que no pueden enviar sus documentos a la nube de otro. El motor es open source, se despliega en tu propio hardware y responde a tus reglas.

Apache 2.0
El motor es open source: audítalo, bifúrcalo, ejecútalo sin nosotros.
Local primero
Desplegado en tus propios servidores o nube privada, con inferencia local para datos sensibles.
Alojado en tu propia infraestructura
El motor se ejecuta en servidores que tú posees o alquilas. Tus documentos y embeddings nunca se almacenan en una nube que operemos nosotros.