SOVNEX AISOVEREIGN NEXUS
Local-first · Sovrano · Multi-agents

La tua conoscenza, i tuoi modelli,
la tua infrastruttura

Sovnex è uno spazio di lavoro IA self-hosted costruito su tre pilastri: una base di conoscenza sovrana e multilingue guidata da agenti locali, l'analisi delle RFP e la stesura delle offerte con più agenti, e una Token Factory locale che mette ogni modello — compresi i tuoi — dietro un'unica API. Nulla lascia la tua rete.

Pilastro 01

Una base di conoscenza sovrana,
agenti locali, qualsiasi lingua

Documenti, embedding e prompt restano sulla tua infrastruttura. Agenti specializzati vi recuperano informazioni e ragionano — e la lingua non è mai una barriera tra la domanda e la risposta.

Funziona interamente dentro la tua rete
Distribuisci on-premise o nel tuo cloud privato. File, embedding, prompt e inferenza restano su hardware che controlli tu, così il materiale sensibile non raggiunge mai un'API di terze parti.
Recupero multi-agents locale
Agenti specializzati — recupero, analisi, redazione, revisione — scompongono una domanda complessa in passaggi e la affrontano insieme, invece di comprimere tutto in un unico prompt.
Multilingue e cross-lingua
Lo spazio di lavoro parla sei lingue e il recupero le attraversa: chiedi in francese e Sovnex fonderà la risposta sui tuoi documenti in inglese o cinese, citando il passaggio originale.
Ogni risposta risalibile alla sua fonte
Ogni risposta rimanda esattamente al frammento da cui proviene, fino alla pagina. Il chunking è visibile e modificabile, così il tuo team corregge la fonte invece di discutere con il modello.
Lo spazio di lavoro Sovnex: basi di conoscenza, domande e risposte, chat e ricerca sui tuoi documenti

Un unico spazio di lavoro sui tuoi documenti — basi di conoscenza, domande e risposte, chat e ricerca, con un modello locale che risponde.

Pilastro 02

Dal bando di gara a
un'offerta con fonti

Carica una RFP, un fascicolo di gara o un questionario di sicurezza. Sovnex lo scompone in requisiti, trova le prove nella tua base di conoscenza e redige una risposta per ciascuno — ogni affermazione con la sua citazione.

  1. 1

    Estrai ogni requisito

    Il bando viene convertito in un elenco dettagliato di requisiti e domande, così nulla di sepolto a pagina 40 va perso.

  2. 2

    Recupera le prove

    Per ogni requisito gli agenti cercano nelle tue proposte passate, nelle certificazioni e nelle schede tecniche, e raccolgono i passaggi che rispondono davvero.

  3. 3

    Redigi la risposta

    Per ogni requisito viene prodotta una risposta scritta, nella lingua del bando, con ogni affermazione collegata alla fonte da cui proviene.

  4. 4

    Rivedi ed esporta

    Il tuo team rivede, modifica ed esporta. I punteggi di affidabilità e le citazioni rendono evidente quali risposte richiedono prima un occhio umano.

app.sovnexai.com

Redigi una risposta al requisito 4.2: «Descrivi la cifratura dei dati a riposo e in transito».

Y

Tutti i dati sono cifrati: AES-256 a riposo e TLS 1.3 in transito. Sovnex funziona interamente all'interno della tua rete, quindi i dati dei clienti non lasciano mai la tua infrastruttura. La gestione delle chiavi si integra con il tuo KMS/HSM esistente…

Fonte: Security_Whitepaper.pdf p.7Affidabilità: 98%

Fai una domanda o incolla un requisito della RFP…

Pilastro 03

Un'unica API davanti a ogni modello,
così i tuoi agenti costano meno

Token Factory è il gateway dei modelli incluso in Sovnex. Punta qualsiasi SDK OpenAI su di esso e raggiungi ogni provider — o i tuoi modelli locali — attraverso un'unica interfaccia, con budget, quote e consumi completamente sotto il tuo controllo.

Endpoint compatibili con OpenAI
Cambia una sola base URL e il codice esistente continua a funzionare. /v1/chat/completions e /v1/embeddings si comportano esattamente come si aspetta l'SDK OpenAI, quindi nel resto dello stack non cambia nulla.
Ogni provider dietro un'unica interfaccia
OpenAI, Claude, Gemini, DeepSeek e Qwen accanto a deployment locali vLLM o Ollama. Raggruppali in canali, mappa i nomi dei modelli e passa automaticamente a un altro quando uno cade.
Instrada il lavoro ordinario sui modelli locali
Il traffico quotidiano e batch dei tuoi agenti gira sul tuo deployment Ollama o vLLM a costo zero di token esterni. Escono solo le chiamate che hanno davvero bisogno di un modello di frontiera, ed è lì che finisce gran parte della spesa.
Budget, quote e limiti di frequenza
Emetti un token API per team o progetto, poi limitane il budget, imposta una scadenza, restringi i modelli che può chiamare e riduci la frequenza delle richieste — senza distribuire nemmeno una chiave del provider a monte.
Consumi e costi verificabili
Ogni chiamata registra modello, numero di token, latenza e costo. Suddividi la spesa per token, utente o canale per vedere esattamente dov'è finito il budget.
python
from openai import OpenAI

client = OpenAI(
    base_url="https://sovnex.internal/v1",  l'unica modifica
    api_key="sk-sovnex-••••",
)

client.chat.completions.create(
    model="qwen2.5-72b",  # o qualsiasi canale tu abbia configurato
    messages=[{"role": "user", …}],
)
OpenAIClaudeGeminiDeepSeekQwenvLLMOllama

Lo stesso endpoint, sia che oggi instradi verso un Qwen locale sia che domani lo faccia verso un modello di frontiera.

Elenco dei token di Token Factory con quota usata, quota residua e scadenza per ciascun token

Ogni token porta con sé la propria quota, la scadenza e la lista dei modelli consentiti — e riporta quanto ha speso.

Chi è Sovnex AI

Fatto per restare dentro le tue mura

Sovnex AI costruisce un motore RAG sovrano per i team che non possono affidare i propri documenti al cloud di qualcun altro. Il motore è open source, viene distribuito sul tuo hardware e risponde alle tue regole.

Apache 2.0
Il motore è open source: verificalo, forkalo, eseguilo senza di noi.
Local-first
Distribuito sui tuoi server o nel tuo cloud privato, con inferenza locale per i dati sensibili.
Ospitato sulla tua infrastruttura
Il motore gira su server che possiedi o affitti. I tuoi documenti e i tuoi embedding non vengono mai conservati in un cloud gestito da noi.