Cadra

放手更多工作,掌控不减。

Cadra 是我们的 AI 智能体背后的平台。带智能体泳道和人工泳道的智能看板、工作流、每个客户独立的知识库、每位顾客的持久记忆、定时和事件触发器,以及包括 MCP 在内的连接器推进工作;审批、真人接手、工具权限和运行上限让人始终掌控。模型路由让每个技能、角色和智能体都跑在合适的模型上,覆盖闭源、开源和本地模型,并在供应商之间做负载均衡和故障切换。

Imaginato 是 Cadra 官方解决方案伙伴。

从请求到结果

让对话有个去处。

智能体可以用您的信息和已连接的系统,把一个请求往前推。哪些操作它可以做、哪些需要人来做,由您的流程决定。

证据 · SoyakaAI 每份信贷申请都按工作流运行:评估、匹配、解释,并对照贷款机构自己的规则检查。超出贷款机构阈值的决定,要等人批准。
方向

用业务的语言定义成功。

给每个智能体一个您的团队一看就懂的目标:一张待确认的订单,一个已解决或已转给合适的人的请求,一个走完的流程。Cadra 把这个目标连接到达成它所需的步骤和信息。

人来定标准、审阅结果。智能体在这个范围内把工作往前推。

看一个目标如何变成能运转的流程

权限

信任,从清楚谁来决定开始。

给智能体足够的权限去完成它的工作,把需要判断的决定留给您的人,并把这些边界变成工作运转方式的一部分。

  • 审批在您选定的任何步骤设置审批,或在看板上给人留出自己的泳道。
  • 访问权限按智能体设定的工具权限,决定它可以使用哪些系统、工具和连接器操作。
  • 上限每次运行都有成本、时间和工具调用次数的上限,每个智能体还有花费上限。
  • 可见性每次运行都记在运行日志里:做了哪些步骤、用了哪些工具、花了多少。
  • 隔离每个客户的工作都在各自独立隔离的工作空间里。
证据 · ChainXP 高风险证据、标记、冻结和申诉都在人工泳道里等待处理。不会自动撤销任何东西,每一次申诉都由人来听。

阅读 ChainXP 案例

模型策略

让每项工作都跑在对的模型上。

不同的工作需要不同的模型。Cadra 按技能、按角色、按智能体设定模型,再在它们之间做路由、测试和负载均衡,让成本、速度和质量按每项工作调优,而不是整个业务只用一种配置。

每个技能、角色和智能体各用各的模型

调研、写作和审阅可以在同一个智能体团队里,各自运行在不同的模型上。

模型路由

每项任务按类型、成本和响应时间,送到合适的模型。快速分拣交给快模型,关键回答交给更强的模型。

A/B 测试

让挑战者模型在一部分真实流量上和现用模型对比,切换之前先比较质量、成本和速度。

负载均衡与故障切换

把流量分散到多家 AI 供应商;某一家变慢或无响应时自动切换,工作不停。

闭源、开源和本地

前沿托管模型,Llama、Qwen、DeepSeek、Kimi、GLM 等开源模型,以及通过 Cadra 桌面版运行的本地模型,可以在同一个工作流里并肩工作。

您的密钥,您的上限

使用您自己的供应商密钥,或使用 Cadra 提供的模型,并按智能体设定花费上限。

换模型,不用重建智能体。

更好或更便宜的模型一出现,就把工作路由过去,用真实流量测试,再正式启用。智能体周围的工作流、权限和审批都原样不动。

跨地区开展业务时,选定配置之前,先确认模型可以在哪里使用、信息可以流向哪里。本地模型处理只是其中一环;连接的系统和渠道同样会处理数据。

实际做法 一个客服智能体可以用快模型分拣每条消息,用更强的模型根据知识库作答;第一家供应商变慢时,自动切换到第二家。客户完全察觉不到切换。
在一个地方运行工作

让每个智能体在业务里都有自己的位置。

Cadra 把智能体、共享工作、公司知识、连接和管控集中在一起。Imaginato 以此为基础,围绕您的流程来构建,并随着工作的变化持续维护。

  • 多智能体团队协调智能体把工作交给专长不同的智能体,再把结果汇总。
  • 智能看板卡片按泳道推进。智能体泳道处理常规工作,人在自己的泳道里审批或接手。
  • 工作流固定的步骤顺序,适合每次都必须一样运行的工作,任何一步都可以设置审批。
  • 每个客户独立的知识库由您的文档、网站和记录构建,让智能体按您的政策作答。
  • 持久记忆按顾客、商家或个案保存的记忆,跨对话、跨渠道、跨转人工都持续保留。
  • 触发器按每位接收者当地时间运行的定时触发器,以及来自您系统的事件触发器。工作自动开始,无需任何人按按钮。
  • 工具与连接器接入您的系统(包括通过 MCP),按智能体、按工具操作设定权限。
  • 渠道一个智能体覆盖 WhatsApp、网页聊天、Slack 和短信,每个渠道共用同一份记忆。
  • 转人工与审批真人在对话中途接手同一段对话,再交回去;智能体带着完整的记忆继续。
  • 护栏每次运行都有成本、时间和工具调用上限,每个智能体还有花费上限。一触及上限,运行立即停止。
  • 模型路由按技能、角色和智能体分配模型,按任务路由,用真实流量做 A/B 测试,并在供应商之间负载均衡和故障切换。闭源、开源,以及通过 Cadra 桌面版运行的本地模型。
  • 运行日志与自我学习每一步、每次工具调用和每笔成本都记录在运行日志里。智能体从审批和结果中学习,下一次运行沿用有效的做法。

目标、规则和模型策略,始终是业务上的决定。背后的构建和运行,交给我们。