多模型接入路由
同一智能体可挂载多个模型——按 query 类型、响应速度要求、成本预算自动路由到最合适的那一个。
五步走完——每一步都可单独配置、按业务定制。引擎封装了底层细节,让运营同学也能"配置出"一个专业级智能体。
自研 LLM / Dify / 扣子 / 公有云——按场景按 query 智能路由。
APP 一拍一说一传 → 自动切片向量化 → 召回优化。
性格、口吻、立场、安全边界——一次配置,全终端生效。
订单、查询、推送、外部 API——Agent 真正"动手做事"。
硬件终端 / H5 / 公众号 / 企微——一处配置,多端同步。
不是 demo 级的"ChatGPT 套壳"——下面六项是企业把 AI 长期运营起来必须要的能力。
同一智能体可挂载多个模型——按 query 类型、响应速度要求、成本预算自动路由到最合适的那一个。
人设、知识、工具、记忆、安全边界——五件事的一致性管理,不是临时拼接的 prompt 堆叠。
多模态素材自动切片、向量化、归类、索引——召回结合 LLM 自动重排,准确率持续优化。
对话日志保密 / 模型权重不外泄 / 调用可审计 / 内容安全过滤——支持私有化部署到内网。
流式响应 / 缓存复用 / 并发调度——同等模型下的端到端响应时间显著优于直接调用。
RESTful + WebSocket + MCP 三套协议——按合作场景由宇芽工程师配合贵司技术团队提供对接示例与接入文档。
不只是名字不同——名字、性格、音色、形象、知识范围、可用工具、对话风格都可独立配置。同一组织可创建多个 Agent,对应不同业务场景。
温暖 / 专业 / 俏皮 / 严谨——按场景调。
系统音色任选 + 音色克隆;虚拟形象库 + 自定义。
精确指定 Agent 可访问哪些知识库分类。
一个企业,多个 Agent——客服、销售、培训各司其职。
LLM 服务页要让非技术用户理解:模型只是发动机,真正能交付的是人设、知识库、工具、权限、日志和终端体验。
把企业资料整理成可检索、可更新、可审计的知识库。
让智能体能查系统、建工单、发通知,而不是只回答问题。
控制谁能问、能问什么、回答依据是什么、如何回滚。
默认接入主流大模型:DeepSeek、智谱、通义千问、百度文心、火山豆包、OpenAI、Anthropic、Gemini;同时支持 OpenAI 兼容协议接入企业自研 LLM 与 Dify / 扣子 / FastGPT / RagFlow 等平台。
PDF / Word / Markdown / HTML / 图片(OCR)/ 录音(ASR 转写)/ 视频字幕;可按文档级、段落级、句子级切分;支持多模态混合检索(文本 + 图片)。
MCP(Model Context Protocol)是 Anthropic 提出的开放协议,让大模型可调用外部业务系统(OA / CRM / ERP / 数据库)。我们已实现 MCP 服务端,对接企业系统 2-3 天可上线。
按场景选择:强推理用 DeepSeek-R1 / Claude;中文长对话用 Qwen / 智谱;低延迟简单场景用本地小模型;视觉任务用 GPT-4o / Gemini;可基于成本 / 速度 / 准确度自动路由。
智能音箱(端侧或云端)、Web H5、企微机器人、钉钉机器人、飞书机器人、小程序、API(供客户系统集成)。统一管理后台、统一知识库、统一对话历史。