SOVNEX AISOVEREIGN NEXUS
本地优先 · 数据主权 · 多 Agent

你的知识、你的模型、
你的基础设施

Sovnex 是一套自托管的 AI 工作台,由三大支柱构成:由本地 Agent 驱动的多语言主权知识库,多 Agent 的 RFP 标书分析与答标撰写,以及把所有模型(包括你自己的模型)收拢到同一个 API 之后的本地 Token Factory。数据不出网络。

支柱 01

主权知识库,
本地 Agent,不限语言

文档、向量嵌入与提示词都留在你自己的基础设施上。专职 Agent 在其上检索与推理——语言不再是提问与答案之间的障碍。

完全运行在你的网络内
可部署在本地或你的私有云。文件、向量嵌入、提示词与推理全部留在你掌控的硬件上,敏感材料绝不会流向第三方 API。
本地多 Agent 检索
检索、分析、撰写、审校等专职 Agent 把复杂问题拆成若干步骤协同处理,而不是把一切塞进同一个提示词。
多语言与跨语言检索
工作台支持六种语言,检索本身也跨语言:用法语提问,Sovnex 会在你的英文或中文文档中找到依据,并引用原文段落。
每条答复都可溯源
每一条答复都能回溯到它引用的原文分块,精确到页。分块结果可视化且可修改——纠正的是源头,而不是跟模型争辩。
Sovnex 工作台:在你自己的文档上使用知识库、问答、对话与检索

面向你自己文档的统一工作台——知识库、问答、对话与检索,由本地模型作答。

支柱 02

从一份招标文件到
带来源的投标答复

上传 RFP、招标文件包或安全问卷。Sovnex 把它拆解为一条条需求,在知识库中找到证据,并为每一条起草答复——每一句主张都带着它的引用。

  1. 1

    抽取每一条需求

    招标文件被解析成逐条列出的需求与问题清单,埋在第 40 页的条款也不会漏掉。

  2. 2

    检索支撑证据

    针对每条需求,Agent 检索你过往的标书、资质证明与规格文档,汇集真正能回答它的原文段落。

  3. 3

    起草答复

    为每条需求生成一份书面答复,使用招标文件的语言,每一句陈述都链接到它的出处。

  4. 4

    审核并导出

    由你的团队审阅、修改、导出。置信度评分与引用让你一眼看出哪些答复需要优先人工把关。

app.sovnexai.com

请就需求 4.2 起草答复:“说明你的数据在静态存储和传输过程中的加密方式。”

Y

所有数据均经过加密:静态存储采用 AES-256,传输采用 TLS 1.3。Sovnex 完全在你的网络内运行,客户数据绝不离开你的基础设施。密钥管理可与你现有的 KMS/HSM 集成……

来源:Security_Whitepaper.pdf 第7页置信度:98%

提问或粘贴一条 RFP 需求…

支柱 03

一个 API 接管所有模型,
让 Agent 的运行成本降下来

Token Factory 是随 Sovnex 一同交付的模型网关。把任意 OpenAI SDK 指向它,即可通过同一套接口调用所有厂商的模型或你自己的本地模型,预算、配额与用量全部掌握在你手里。

OpenAI 兼容端点
只改一个 base URL,现有代码即可继续运行。/v1/chat/completions 与 /v1/embeddings 的行为与 OpenAI SDK 完全一致,技术栈其余部分无需改动。
一套接口接入所有厂商
OpenAI、Claude、Gemini、DeepSeek、Qwen,以及本地部署的 vLLM 或 Ollama。可按渠道分组、映射模型名称,某一路不可用时自动故障转移。
日常流量路由到本地模型
日常与批量的 Agent 流量跑在你自己的 Ollama 或 vLLM 上,零外部 token 费用。只有真正需要前沿模型的调用才会出网——而这正是 Agent 开销的大头。
预算、配额与限流
按团队或项目签发 API Token,为其设定额度上限、有效期、可调用模型白名单与请求速率——无需把任何上游厂商密钥交出去。
用量与成本可审计
每次调用都记录模型、token 数、耗时与成本。可按令牌、用户或渠道拆分统计,清楚看到预算花在哪里。
python
from openai import OpenAI

client = OpenAI(
    base_url="https://sovnex.internal/v1",  只需改这一行
    api_key="sk-sovnex-••••",
)

client.chat.completions.create(
    model="qwen2.5-72b",  # 或任何你配置过的渠道
    messages=[{"role": "user", …}],
)
OpenAIClaudeGeminiDeepSeekQwenvLLMOllama

同一个接口——今天路由到本地 Qwen,明天换成前沿模型也不用改代码。

Token Factory 令牌列表,显示每个令牌的已用额度、剩余额度与有效期

每个令牌都有自己的额度、有效期与模型白名单——并且如实汇报它花了多少。

关于 Sovnex AI

为「数据不出内网」 而设计

Sovnex AI 打造的是一套主权 RAG 引擎,服务于那些无法把文档交给别人云端的团队。引擎开源,部署在你自己的硬件上,规则由你定。

Apache 2.0
引擎开源——可审计、可 fork,离开我们也能自己跑起来。
本地优先
部署在你自己的服务器或私有云上,敏感数据交由本地推理处理。
部署在你自己的基础设施上
引擎运行在你自有或租用的服务器上。你的文档与向量嵌入绝不会存放在我们运营的云端。