五个模块,拼成一条
从知识到行动的链路
MiliAgent 决定做什么,MiliFlow 让动作落到审批与工单上,MiliRAG 提供有出处的依据,MiliGate 管住每一次模型调用,MiliEval 回答这次改动到底有没有变好。五个模块可以单独接进你已有的技术栈,也可以拼成一套完整的智能体底座。全部能力都对外开放 API 与插件扩展点,不要求你先换掉现有系统。
各自解决一个卡点,串起来才是一条链路
很多团队买到了模型能力却用不起来,卡点分散在不同环节:不知道该让它做什么、做完接不进流程、答案拿不出依据、调用没人管、改完不知道好坏。这五个模块正好对应这五个卡点。
怎么选
先接哪一块?
已经有知识库和应用的团队,通常先接 MiliGate 和 MiliEval,把成本和效果先管起来;从零开始的团队,建议 MiliRAG 加 MiliAgent 先跑通一个真实场景再往外扩。
智能体平台:把一句需求变成可执行的步骤
做智能体不等于把提示词写长一点。MiliAgent 在运行时维护一份可以改的计划:先拆子任务,执行中拿到新信息就重新规划剩余步骤;工具调用失败会按策略重试、降级到备用链路,或者直接把任务交回给人。复杂场景可以拆成多个角色分工,检索、计算、撰写、复核各管一段,由主控智能体汇总结果。
- 任务拆解与重规划 按目标拆出子任务,执行中信息发生变化就调整剩余步骤
- 工具注册与参数校验 工具用 JSON Schema 声明入参,调用前校验不通过就不发出
- 短期与长期记忆 会话内保留上下文,跨会话沉淀用户偏好、常用实体与历史结论
- 人工确认节点 写库、发消息、提交审批这类动作先挂起,等指定角色确认后再执行
流程编排:让 AI 出现在流程图里,而不是流程之外
MiliFlow 用可视化编排把智能体节点、人工节点和外部系统连成一条能执行的流程:工单创建即触发,按金额和风险等级走不同分支,超过阈值转人工审批,失败按补偿动作回滚。执行结果会写回工单系统,也支持在企业 IM 里直接完成确认、补充信息或驳回,处理记录同步回流程实例。
- 事件与定时触发 工单创建、邮件到达、数据变更可触发,也支持按周期定时跑批
- 条件分支与审批 按金额、风险等级或模型置信度分流,必要时插入多级审批节点
- 幂等与重试 每次执行带唯一键,重复触发不会产生第二条工单或第二次提交
- 失败可回滚 已写入外部系统的动作按补偿步骤回退,全过程保留执行记录
知识引擎:让每句回答都能翻回原文
检索质量的上限,往往在文档解析那一步就定下来了。MiliRAG 先把 PDF 双栏排版、跨页表格和扫描件还原成带标题层级的结构化文本,再按语义和结构混合切分,避免把一张表或一条款项拦腰截断。知识源更新后按变更做增量同步,不需要每次全量重建索引。
- 复杂版式解析 PDF 双栏、跨页表格与扫描件 OCR,保留标题层级和单元格结构
- 混合检索与重排 向量召回配合关键词精确匹配,再用重排模型收敛候选集
- 权限透传 检索前先取用户在源系统的可见范围,无权访问的文档不进候选
- 引用定位到段落 每条依据都能跳回原文件的具体页码与段落,方便人工复核
模型网关:所有对模型的调用都从这里出去
统一出口的价值,在于换东西的时候不用改业务代码。MiliGate 对上提供一套稳定的 API,对下接闭源模型 API、开源模型自部署实例与领域微调模型,按场景、成本上限和时延要求选路,主模型超时或报错时自动切到备用。新模型可以先切一小部分流量灰度观察,指标不对随时回退到上一版路由配置。
- 统一 API 闭源、开源与微调模型共用一套调用接口,切换供应商不动业务代码
- 策略路由 按场景、成本上限与时延要求选模型,异常时自动降级到备用链路
- 限流与分部门核算 按部门、应用和场景设配额,Token 与调用开销逐条记账
- 脱敏与审计 出站前识别并替换敏感字段,入参出参与路由决策完整留档
评测与观测:判断这次改动是变好还是变坏
「感觉还行」不能作为上线依据。MiliEval 从真实工单、问答和文档里整理出带标准答案的评测集,每次改提示词、换模型或加工具都跑一遍,逐条列出变好和变坏的样本。上线之后按比例采样真实会话复盘,把线上暴露的问题回补进评测集,让基线持续跟着业务走。
- 业务样本建集 用真实工单与问答整理评测集,覆盖常见问法和已知边界情况
- 自动加人工双评 规则与模型先打分,分歧样本转人工复核并回写标准答案
- 版本回归对比 任意两个版本逐条对比,退化样本单独列出,不靠平均分掩盖问题
- 线上追踪与告警 采样复盘真实会话,命中率、时延或成本跌破阈值即触发告警
三种部署方式,按数据边界来选
决定选哪种的通常不是技术偏好,而是数据允许走到哪一步。下面三种形态在数据边界和运维责任上的划分完全不同,功能本身没有阉割。
公有云托管
适合想先验证价值、暂时不打算投基础设施的团队。数据放在按客户隔离的独立租户里,可指定境内可用区,知识库与日志不与其他客户混存。版本升级、扩容和值守由 Milisoft 负责,你的团队只管配置场景和看效果。
私有化部署
适合数据不能出内网的金融与制造场景。全部组件装在你自己的机房或专有云里,模型权重、向量库和审计日志都留在域内,支持信创软硬件环境与离线升级包。日常运维由你的团队承担,我们提供部署脚本、巡检清单、升级手册与远程支持。
混合模式
适合大部分数据敏感、少数场景需要更强模型的组织。知识库、日志和业务系统留在内网,只有脱敏后的必要片段经 MiliGate 出网调用外部模型。哪些字段可以出网由策略明确定义,出网记录逐条留档,运维责任按内网与出网两段分别约定。
一页看完关键规格
下面是选型阶段最常被追问的几项。更细的接口清单、性能基线和部署清单在技术白皮书里,需要的话直接找我们要。
| 能力项 | 说明 |
|---|---|
| 部署方式 | 公有云托管、私有化部署与混合模式三选一。私有化支持 Kubernetes 集群与单机 Docker Compose 两种形态,提供离线安装包。 |
| 模型接入 | 通过 MiliGate 统一接入主流闭源模型 API、开源模型自部署实例与领域微调模型,可按场景配置主备与降级顺序。 |
| 身份与权限 | 对接 SSO、LDAP 与 OAuth2 单点登录,角色和数据权限沿用源系统;检索结果与工具调用均按调用者身份二次校验。 |
| 审计与留痕 | 记录每次会话、模型调用、工具动作与引用来源,日志可导出到你的 SIEM 或数据仓库,保留期按策略配置。 |
| 可观测性 | 内置调用量、时延、Token 成本、失败率与评测得分看板,同时暴露 Prometheus 指标,支持 Webhook 告警。 |
| 扩展方式 | 工具、数据源、文档解析器与评分器都按插件接入,提供 HTTP 与 SDK 两种扩展途径以及本地调试环境。 |
| 交付物 | 定制部分源码、容器镜像与部署脚本、架构与接口文档、评测集、运维手册和分角色培训材料。 |
| 支持级别 | 标准、专业、旗舰三档,响应时限、值守时段与回归频率随档位不同,详见 服务分级与 SLA。 |
选型阶段最常被问到的六个问题
能不能只用其中一块?
可以。五个模块各自有独立的 API 和部署单元,最常见的起步方式是先接 MiliRAG 建知识层,或者先接 MiliGate 把已有应用散落各处的模型调用统一起来。MiliFlow 单独用可以编排人工节点和外部系统调用,只是流程里的智能体节点需要由 MiliAgent 提供,这是能力边界,不是捆绑。
上了这套,要不要换掉现有系统?
不需要。我们的定位是在你现有的 ERP、CRM、OA、工单和数据平台之上加一层,通过 API、消息队列或数据库只读视图接入,不改动原系统的表结构和业务逻辑。
如果某个系统确实没有可用接口,我们会先做一层接口适配,而不是建议你把它替换掉。
私有化部署最低需要什么硬件?
取决于用哪几个模块、以及模型放在哪。只跑 MiliRAG 加 MiliGate、推理走外部 API 的话,三台常规 x86 服务器就能起步;如果要在内网跑开源模型推理,需要按并发量另外配 GPU 服务器。
方案阶段我们会按你的并发、文档规模和响应时延要求,出一份带余量说明的具体配置清单,不用先按最大规格采购。
以后想换模型供应商,成本有多大?
业务代码通常一行都不用改。调用统一走 MiliGate,换供应商是改一条路由配置的事。真正的工作量在提示词适配和效果验证上,这部分用 MiliEval 跑一遍回归就能量化,多数场景在几个工作日内能完成切换评估。
上线后效果不达标怎么办?
验收标准在项目开始时就写进评测集,不达标不进入下一阶段,这是我们控制风险的方式,也是给你的退出点。
真出现退化时,先用 MiliEval 定位问题出在检索没召回、提示词漂移还是模型版本变更,再针对那一环节修复,并把这批样本补进回归集,避免下次重犯。
我们的数据会被拿去训练模型吗?
不会。私有化部署下数据完全留在你的环境里,我们没有取数通道;使用外部模型 API 时,MiliGate 会在出站前做脱敏,并按供应商提供的选项关闭数据用于训练。
数据用途、留存期限和删除方式会写进合同的数据处理条款,也可以参考 隐私政策。