SOVNEX AISOVEREIGN NEXUS
Local d'abord · Souverain · Multi-agents

Vos connaissances, vos modèles,
votre infrastructure

Sovnex est un espace de travail IA auto-hébergé bâti sur trois piliers : une base de connaissances souveraine et multilingue animée par des agents locaux, l'analyse d'appels d'offres et la rédaction des réponses par agents multiples, et un Token Factory local qui place tous les modèles — y compris les vôtres — derrière une seule API. Rien ne quitte votre réseau.

Pilier 01

Une base de connaissances souveraine,
des agents locaux, toutes les langues

Documents, plongements et invites restent sur votre propre infrastructure. Des agents spécialisés y récupèrent l'information et raisonnent — et la langue n'est jamais une barrière entre la question et la réponse.

Fonctionne entièrement dans votre réseau
Déployez sur site ou dans votre cloud privé. Fichiers, plongements, invites et inférence restent sur du matériel que vous contrôlez : aucun élément sensible n'atteint une API tierce.
Récupération multi-agents locale
Des agents spécialisés — récupération, analyse, rédaction, relecture — découpent une question complexe en étapes et la traitent ensemble, au lieu de tout comprimer dans une seule invite.
Multilingue et translingue
L'espace de travail parle six langues, et la recherche les traverse : posez la question en français, Sovnex fonde la réponse sur vos documents anglais ou chinois en citant le passage d'origine.
Chaque réponse remonte à sa source
Chaque réponse pointe vers le fragment exact dont elle provient, à la page près. Le découpage est visible et modifiable : votre équipe corrige la source au lieu de discuter avec le modèle.
L'espace de travail Sovnex : bases de connaissances, questions-réponses, chat et recherche sur vos propres documents

Un seul espace de travail sur vos documents — bases de connaissances, questions-réponses, chat et recherche, avec un modèle local qui répond.

Pilier 02

Du dossier d'appel d'offres à
une réponse sourcée

Chargez un appel d'offres, un dossier de consultation ou un questionnaire de sécurité. Sovnex le décompose en exigences, trouve les preuves dans votre base de connaissances et rédige une réponse pour chacune — chaque affirmation portant sa citation.

  1. 1

    Extraire chaque exigence

    Le dossier est converti en une liste détaillée d'exigences et de questions : rien de ce qui est enfoui page 40 n'est oublié.

  2. 2

    Retrouver les preuves

    Pour chaque exigence, les agents fouillent vos propositions passées, vos certifications et vos fiches techniques, et rassemblent les passages qui y répondent vraiment.

  3. 3

    Rédiger la réponse

    Une réponse rédigée est produite pour chaque exigence, dans la langue du dossier, chaque affirmation étant reliée à la source dont elle provient.

  4. 4

    Relire et exporter

    Votre équipe relit, modifie et exporte. Les scores de confiance et les citations montrent immédiatement quelles réponses méritent un œil humain en priorité.

app.sovnexai.com

Rédige une réponse à l'exigence 4.2 : « Décrivez votre chiffrement des données au repos et en transit. »

Y

Toutes les données sont chiffrées : AES-256 au repos et TLS 1.3 en transit. Sovnex fonctionne entièrement à l'intérieur de votre réseau ; les données clients ne quittent jamais votre infrastructure. La gestion des clés s'intègre à votre KMS/HSM existant…

Source : Security_Whitepaper.pdf p.7Confiance : 98 %

Posez une question ou collez une exigence d'appel d'offres…

Pilier 03

Une seule API devant tous vos modèles,
pour des agents qui coûtent moins cher

Token Factory est la passerelle de modèles livrée avec Sovnex. Pointez n'importe quel SDK OpenAI dessus et atteignez tous les fournisseurs — ou vos propres modèles locaux — par une interface unique, budgets, quotas et usage entièrement sous votre contrôle.

Points de terminaison compatibles OpenAI
Changez une seule base URL et votre code existant continue de fonctionner. /v1/chat/completions et /v1/embeddings se comportent exactement comme le SDK OpenAI l'attend : rien d'autre dans votre pile n'a à changer.
Tous les fournisseurs derrière une interface
OpenAI, Claude, Gemini, DeepSeek et Qwen aux côtés de vos déploiements locaux vLLM ou Ollama. Regroupez-les en canaux, mappez les noms de modèles et basculez automatiquement quand l'un tombe.
Routez le travail courant vers vos modèles locaux
Le trafic quotidien et par lots de vos agents s'exécute sur votre propre déploiement Ollama ou vLLM, à coût de tokens externe nul. Seuls les appels qui exigent vraiment un modèle de pointe sortent — et c'est là que part l'essentiel de la dépense.
Budgets, quotas et limites de débit
Émettez un token d'API par équipe ou par projet, puis plafonnez son budget, fixez une expiration, restreignez les modèles qu'il peut appeler et limitez son débit — sans distribuer la moindre clé de fournisseur en amont.
Un usage et un coût auditables
Chaque appel enregistre le modèle, le nombre de tokens, la latence et le coût. Ventilez les dépenses par token, par utilisateur ou par canal pour voir exactement où est passé le budget.
python
from openai import OpenAI

client = OpenAI(
    base_url="https://sovnex.internal/v1",  la seule modification
    api_key="sk-sovnex-••••",
)

client.chat.completions.create(
    model="qwen2.5-72b",  # ou tout canal que vous avez configuré
    messages=[{"role": "user", …}],
)
OpenAIClaudeGeminiDeepSeekQwenvLLMOllama

Le même point de terminaison, qu'il route aujourd'hui vers un Qwen local ou demain vers un modèle de pointe.

Liste des tokens de Token Factory, avec quota utilisé, quota restant et expiration pour chacun

Chaque token porte son propre quota, son expiration et sa liste de modèles autorisés — et rend compte de ce qu'il a dépensé.

À propos de Sovnex AI

Conçu pour rester dans vos murs

Sovnex AI développe un moteur RAG souverain pour les équipes qui ne peuvent pas confier leurs documents au cloud d'un tiers. Le moteur est open source, déployé sur votre propre matériel, et obéit à vos règles.

Apache 2.0
Le moteur est open source : auditez-le, forkez-le, faites-le tourner sans nous.
Local d'abord
Déployé sur vos propres serveurs ou votre cloud privé, avec inférence locale pour les données sensibles.
Hébergé sur votre propre infrastructure
Le moteur tourne sur des serveurs que vous possédez ou louez. Vos documents et vos plongements ne sont jamais stockés dans un cloud que nous exploitons.